On Globally Optimal Stochastic Policy Gradient Methods for Domain Randomized LQR Synthesis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nguyen-Le, Alex, Matni, Nikolai |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Policy Gradient for LQR with Domain Randomization
par: Fujinami, Tesshu, et autres
Publié: (2025)
par: Fujinami, Tesshu, et autres
Publié: (2025)
A Stochastic Gradient Descent Approach to Design Policy Gradient Methods for LQR
par: Song, Bowen, et autres
Publié: (2026)
par: Song, Bowen, et autres
Publié: (2026)
Convergence Guarantees of Model-free Policy Gradient Methods for LQR with Stochastic Data
par: Song, Bowen, et autres
Publié: (2025)
par: Song, Bowen, et autres
Publié: (2025)
Policy Gradient Methods for the Cost-Constrained LQR: Strong Duality and Global Convergence
par: Zhao, Feiran, et autres
Publié: (2024)
par: Zhao, Feiran, et autres
Publié: (2024)
Domain Randomization is Sample Efficient for Linear Quadratic Control
par: Fujinami, Tesshu, et autres
Publié: (2025)
par: Fujinami, Tesshu, et autres
Publié: (2025)
Policy Gradient Bounds in Multitask LQR
par: Stamouli, Charis, et autres
Publié: (2025)
par: Stamouli, Charis, et autres
Publié: (2025)
Sample-Efficient Model-Free Policy Gradient Methods for Stochastic LQR via Robust Linear Regression
par: Song, Bowen, et autres
Publié: (2025)
par: Song, Bowen, et autres
Publié: (2025)
Coordinating Planning and Tracking in Layered Control Policies via Actor-Critic Learning
par: Yang, Fengjun, et autres
Publié: (2024)
par: Yang, Fengjun, et autres
Publié: (2024)
A Quantitative Framework for Navigating Controller Design Tradeoffs under Computational Constraints
par: Verhoek, Chris, et autres
Publié: (2026)
par: Verhoek, Chris, et autres
Publié: (2026)
Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches
par: Zhao, Feiran, et autres
Publié: (2025)
par: Zhao, Feiran, et autres
Publié: (2025)
Single Trajectory Conformal Prediction
par: Lee, Brian, et autres
Publié: (2024)
par: Lee, Brian, et autres
Publié: (2024)
LQR for Systems with Probabilistic Parametric Uncertainties: A Gradient Method
par: Cui, Leilei, et autres
Publié: (2026)
par: Cui, Leilei, et autres
Publié: (2026)
Stability-Certified On-Policy Data-Driven LQR via Recursive Learning and Policy Gradient
par: Sforni, Lorenzo, et autres
Publié: (2024)
par: Sforni, Lorenzo, et autres
Publié: (2024)
Safe Planning in Interactive Environments via Iterative Policy Updates and Adversarially Robust Conformal Prediction
par: Mirzaeedodangeh, Omid, et autres
Publié: (2025)
par: Mirzaeedodangeh, Omid, et autres
Publié: (2025)
On the (almost) Global Exponential Convergence of the Overparameterized Policy Optimization for the LQR Problem
par: Wafi, Moh Kamalul, et autres
Publié: (2025)
par: Wafi, Moh Kamalul, et autres
Publié: (2025)
Stochastic LQR Design With Disturbance Preview
par: Liu, Jietian, et autres
Publié: (2024)
par: Liu, Jietian, et autres
Publié: (2024)
Learning Flatness-Preserving Residuals for Pure-Feedback Systems
par: Yang, Fengjun, et autres
Publié: (2025)
par: Yang, Fengjun, et autres
Publié: (2025)
Scalable Distributed Nonlinear Control Under Flatness-Preserving Coupling
par: Yang, Fengjun, et autres
Publié: (2025)
par: Yang, Fengjun, et autres
Publié: (2025)
Revisiting LQR Control from the Perspective of Receding-Horizon Policy Gradient
par: Zhang, Xiangyuan, et autres
Publié: (2023)
par: Zhang, Xiangyuan, et autres
Publié: (2023)
Closed-loop Analysis of ADMM-based Suboptimal Linear Model Predictive Control
par: Srikanthan, Anusha, et autres
Publié: (2024)
par: Srikanthan, Anusha, et autres
Publié: (2024)
Convergence Analysis of Gradient Flow for Overparameterized LQR Formulations
par: de Oliveira, Arthur Castello B., et autres
Publié: (2024)
par: de Oliveira, Arthur Castello B., et autres
Publié: (2024)
Separation is Optimal for LQR under Intermittent Feedback
par: Etcibasi, Abdullah Y., et autres
Publié: (2026)
par: Etcibasi, Abdullah Y., et autres
Publié: (2026)
Towards a Theory of Control Architecture: A quantitative framework for layered multi-rate control
par: Matni, Nikolai, et autres
Publié: (2024)
par: Matni, Nikolai, et autres
Publié: (2024)
Analyzing the Impact of Computation in Adaptive Dynamic Programming for Stochastic LQR Problem
par: Cao, Wenhan, et autres
Publié: (2024)
par: Cao, Wenhan, et autres
Publié: (2024)
Data-Enabled Policy Optimization for Direct Adaptive Learning of the LQR
par: Zhao, Feiran, et autres
Publié: (2024)
par: Zhao, Feiran, et autres
Publié: (2024)
Nonasymptotic Regret Analysis of Adaptive Linear Quadratic Control with Model Misspecification
par: Lee, Bruce D., et autres
Publié: (2023)
par: Lee, Bruce D., et autres
Publié: (2023)
State space models, emergence, and ergodicity: How many parameters are needed for stable predictions?
par: Ziemann, Ingvar, et autres
Publié: (2024)
par: Ziemann, Ingvar, et autres
Publié: (2024)
Learning Complex Motion Plans using Neural ODEs with Safety and Stability Guarantees
par: Nawaz, Farhad, et autres
Publié: (2023)
par: Nawaz, Farhad, et autres
Publié: (2023)
Distributionally Robust Regret Optimal LQR with Common Stage-Law Ambiguity
par: Fiechtner, Lukas-Benedikt, et autres
Publié: (2026)
par: Fiechtner, Lukas-Benedikt, et autres
Publié: (2026)
Power-Constrained Policy Gradient Methods for LQR
par: Verma, Ashwin, et autres
Publié: (2025)
par: Verma, Ashwin, et autres
Publié: (2025)
Small-Disturbance Input-to-State Stability of Perturbed Gradient Flows: Applications to LQR Problem
par: Cui, Leilei, et autres
Publié: (2023)
par: Cui, Leilei, et autres
Publié: (2023)
Statistical Efficiency of Single- and Multi-step Models for Forecasting and Control
par: Somalwar, Anne, et autres
Publié: (2026)
par: Somalwar, Anne, et autres
Publié: (2026)
Global Convergence of Policy Gradient Methods for ReLU Controllers in Linear Quadratic Regulation
par: Rodriguez-Gil, Jhojan A., et autres
Publié: (2026)
par: Rodriguez-Gil, Jhojan A., et autres
Publié: (2026)
A Globally Convergent Policy Gradient Method for Linear Quadratic Gaussian (LQG) Control
par: Sadamoto, Tomonori, et autres
Publié: (2023)
par: Sadamoto, Tomonori, et autres
Publié: (2023)
Towards Optimal Passive Feedback Control of LTI Systems under LQR Performance
par: Gießler, Armin, et autres
Publié: (2026)
par: Gießler, Armin, et autres
Publié: (2026)
Data-Driven LQR with Finite-Time Experiments via Extremum-Seeking Policy Iteration
par: Carnevale, Guido, et autres
Publié: (2024)
par: Carnevale, Guido, et autres
Publié: (2024)
Bridging Continuous-time LQR and Reinforcement Learning via Gradient Flow of the Bellman Error
par: Gießler, Armin, et autres
Publié: (2025)
par: Gießler, Armin, et autres
Publié: (2025)
The Fragility of Learning LQG Controllers
par: Lee, Bruce D., et autres
Publié: (2026)
par: Lee, Bruce D., et autres
Publié: (2026)
Stochastic Trajectory Influence Functions for LQR: Joint Sensitivity Through Dynamics and Noise Covariance
par: Li, Jiachen, et autres
Publié: (2026)
par: Li, Jiachen, et autres
Publié: (2026)
Quad-LCD: Layered Control Decomposition Enables Actuator-Feasible Quadrotor Trajectory Planning
par: Srikanthan, Anusha, et autres
Publié: (2025)
par: Srikanthan, Anusha, et autres
Publié: (2025)
Documents similaires
-
Policy Gradient for LQR with Domain Randomization
par: Fujinami, Tesshu, et autres
Publié: (2025) -
A Stochastic Gradient Descent Approach to Design Policy Gradient Methods for LQR
par: Song, Bowen, et autres
Publié: (2026) -
Convergence Guarantees of Model-free Policy Gradient Methods for LQR with Stochastic Data
par: Song, Bowen, et autres
Publié: (2025) -
Policy Gradient Methods for the Cost-Constrained LQR: Strong Duality and Global Convergence
par: Zhao, Feiran, et autres
Publié: (2024) -
Domain Randomization is Sample Efficient for Linear Quadratic Control
par: Fujinami, Tesshu, et autres
Publié: (2025)