Constraint-Generation Policy Optimization (CGPO): Nonlinear Programming for Policy Optimization in Mixed Discrete-Continuous MDPs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gimelfarb, Michael, Taitler, Ayal, Sanner, Scott |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FORESEE: Prediction with Expansion-Compression Unscented Transform for Online Policy Optimization
par: Parwana, Hardik, et autres
Publié: (2022)
par: Parwana, Hardik, et autres
Publié: (2022)
Discrete GCBF Proximal Policy Optimization for Multi-agent Safe Optimal Control
par: Zhang, Songyuan, et autres
Publié: (2025)
par: Zhang, Songyuan, et autres
Publié: (2025)
Mitigating Partial Observability in Adaptive Traffic Signal Control with Transformers
par: Wang, Xiaoyu, et autres
Publié: (2024)
par: Wang, Xiaoyu, et autres
Publié: (2024)
Diffusion Policies for Generative Modeling of Spacecraft Trajectories
par: Briden, Julia, et autres
Publié: (2025)
par: Briden, Julia, et autres
Publié: (2025)
Adaptive Smooth Tchebycheff Attention for Multi-Objective Policy Optimization
par: Murillo-Gonzalez, Alejandro, et autres
Publié: (2026)
par: Murillo-Gonzalez, Alejandro, et autres
Publié: (2026)
Certifying Stability of Reinforcement Learning Policies using Generalized Lyapunov Functions
par: Long, Kehan, et autres
Publié: (2025)
par: Long, Kehan, et autres
Publié: (2025)
Probabilistic Safety Guarantee for Stochastic Control Systems Using Average Reward MDPs
par: Omidi, Saber, et autres
Publié: (2025)
par: Omidi, Saber, et autres
Publié: (2025)
Symbolic and Numerical Tools for $L_{\infty}$-Norm Calculation
par: Younes, Grace, et autres
Publié: (2025)
par: Younes, Grace, et autres
Publié: (2025)
SONC Optimization and Exact Nonnegativity Certificates via Second-Order Cone Programming
par: Magron, Victor, et autres
Publié: (2020)
par: Magron, Victor, et autres
Publié: (2020)
Distributionally Robust Policy and Lyapunov-Certificate Learning
par: Long, Kehan, et autres
Publié: (2024)
par: Long, Kehan, et autres
Publié: (2024)
Model-Based Diffusion for Trajectory Optimization
par: Pan, Chaoyi, et autres
Publié: (2024)
par: Pan, Chaoyi, et autres
Publié: (2024)
Compositional Diffusion Models for Powered Descent Trajectory Generation with Flexible Constraints
par: Briden, Julia, et autres
Publié: (2024)
par: Briden, Julia, et autres
Publié: (2024)
Unifying Entropy Regularization in Optimal Control: From and Back to Classical Objectives via Iterated Soft Policies and Path Integral Solutions
par: Bhole, Ajinkya, et autres
Publié: (2025)
par: Bhole, Ajinkya, et autres
Publié: (2025)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
par: Ding, Dongsheng, et autres
Publié: (2023)
par: Ding, Dongsheng, et autres
Publié: (2023)
Denoising Diffusion-Based Control of Nonlinear Systems
par: Elamvazhuthi, Karthik, et autres
Publié: (2024)
par: Elamvazhuthi, Karthik, et autres
Publié: (2024)
Certificates for nonnegativity of multivariate integer polynomials under perturbations
par: Bender, Matías R, et autres
Publié: (2025)
par: Bender, Matías R, et autres
Publié: (2025)
Probabilistic algorithm for computing all local minimizers of Morse functions on a compact domain
par: Din, Mohab Safey El, et autres
Publié: (2025)
par: Din, Mohab Safey El, et autres
Publié: (2025)
Data-Driven Motion Planning for Uncertain Nonlinear Systems
par: Esmaeili, Babak, et autres
Publié: (2025)
par: Esmaeili, Babak, et autres
Publié: (2025)
From Optimization to Control: Quasi Policy Iteration
par: Kolarijani, Mohammad Amin Sharifi, et autres
Publié: (2023)
par: Kolarijani, Mohammad Amin Sharifi, et autres
Publié: (2023)
An $O(n$)-Algorithm for the Higher-Order Kinematics and Inverse Dynamics of Serial Manipulators using Spatial Representation of Twists
par: Mueller, Andreas
Publié: (2025)
par: Mueller, Andreas
Publié: (2025)
An Adaptive Data-Enabled Policy Optimization Approach for Autonomous Bicycle Control
par: Persson, Niklas, et autres
Publié: (2025)
par: Persson, Niklas, et autres
Publié: (2025)
Score Matching Diffusion Based Feedback Control and Planning of Nonlinear Systems
par: Elamvazhuthi, Karthik, et autres
Publié: (2025)
par: Elamvazhuthi, Karthik, et autres
Publié: (2025)
Iterative Tuning of Nonlinear Model Predictive Control for Robotic Manufacturing Tasks
par: Ingole, Deepak, et autres
Publié: (2025)
par: Ingole, Deepak, et autres
Publié: (2025)
Tight Constraint Prediction of Six-Degree-of-Freedom Transformer-based Powered Descent Guidance
par: Briden, Julia, et autres
Publié: (2025)
par: Briden, Julia, et autres
Publié: (2025)
Analytical Lyapunov Function Discovery: An RL-based Generative Approach
par: Zou, Haohan, et autres
Publié: (2025)
par: Zou, Haohan, et autres
Publié: (2025)
Contraction Theory for Nonlinear Stability Analysis and Learning-based Control: A Tutorial Overview
par: Tsukamoto, Hiroyasu, et autres
Publié: (2021)
par: Tsukamoto, Hiroyasu, et autres
Publié: (2021)
Multi-CALF: A Policy Combination Approach with Statistical Guarantees
par: Malaniya, Georgiy, et autres
Publié: (2025)
par: Malaniya, Georgiy, et autres
Publié: (2025)
Landscape of Policy Optimization for Finite Horizon MDPs with General State and Action
par: Chen, Xin, et autres
Publié: (2024)
par: Chen, Xin, et autres
Publié: (2024)
Efficient Policy Optimization in Robust Constrained MDPs with Iteration Complexity Guarantees
par: Ganguly, Sourav, et autres
Publié: (2025)
par: Ganguly, Sourav, et autres
Publié: (2025)
Nonlinear Robust Optimization for Planning and Control
par: Abdul, Arshiya Taj, et autres
Publié: (2025)
par: Abdul, Arshiya Taj, et autres
Publié: (2025)
Solving Stochastic Constraints by Oracle-based Gradient Descent and Interval Arithmetic
par: Li, Xiakun, et autres
Publié: (2026)
par: Li, Xiakun, et autres
Publié: (2026)
Line-Search Filter Differential Dynamic Programming for Optimal Control with Nonlinear Equality Constraints
par: Xu, Ming, et autres
Publié: (2025)
par: Xu, Ming, et autres
Publié: (2025)
Real-time Velocity Profile Optimization for Time-Optimal Maneuvering with Generic Acceleration Constraints
par: Piazza, Mattia, et autres
Publié: (2025)
par: Piazza, Mattia, et autres
Publié: (2025)
Feasibility Analysis and Constraint Selection in Optimization-Based Controllers
par: Rousseas, Panagiotis, et autres
Publié: (2025)
par: Rousseas, Panagiotis, et autres
Publié: (2025)
Kernel-Based Optimal Control: An Infinitesimal Generator Approach
par: Bevanda, Petar, et autres
Publié: (2024)
par: Bevanda, Petar, et autres
Publié: (2024)
Regret Analysis of Policy Optimization over Submanifolds for Linearly Constrained Online LQG
par: Chang, Ting-Jui, et autres
Publié: (2024)
par: Chang, Ting-Jui, et autres
Publié: (2024)
Harnessing Data from Clustered LQR Systems: Personalized and Collaborative Policy Optimization
par: Kanakeri, Vinay, et autres
Publié: (2025)
par: Kanakeri, Vinay, et autres
Publié: (2025)
Optimizing Logical Execution Time Model for Both Determinism and Low Latency
par: Wang, Sen, et autres
Publié: (2023)
par: Wang, Sen, et autres
Publié: (2023)
Hierarchical Neuro-Symbolic Decision Transformer
par: Baheri, Ali, et autres
Publié: (2025)
par: Baheri, Ali, et autres
Publié: (2025)
Formal Safety Verification and Refinement for Generative Motion Planners via Certified Local Stabilization
par: Nath, Devesh, et autres
Publié: (2025)
par: Nath, Devesh, et autres
Publié: (2025)
Documents similaires
-
FORESEE: Prediction with Expansion-Compression Unscented Transform for Online Policy Optimization
par: Parwana, Hardik, et autres
Publié: (2022) -
Discrete GCBF Proximal Policy Optimization for Multi-agent Safe Optimal Control
par: Zhang, Songyuan, et autres
Publié: (2025) -
Mitigating Partial Observability in Adaptive Traffic Signal Control with Transformers
par: Wang, Xiaoyu, et autres
Publié: (2024) -
Diffusion Policies for Generative Modeling of Spacecraft Trajectories
par: Briden, Julia, et autres
Publié: (2025) -
Adaptive Smooth Tchebycheff Attention for Multi-Objective Policy Optimization
par: Murillo-Gonzalez, Alejandro, et autres
Publié: (2026)