Bridging Continuous-time LQR and Reinforcement Learning via Gradient Flow of the Bellman Error
Fuente:
arXiv
Salvato in:
| Autori principali: | Gießler, Armin, Malan, Albertus Johannes, Hohmann, Sören |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Data-Driven Continuous-Time Linear Quadratic Regulator via Closed-Loop and Reinforcement Learning Parameterizations
di: Gießler, Armin, et al.
Pubblicazione: (2026)
di: Gießler, Armin, et al.
Pubblicazione: (2026)
Towards Optimal Passive Feedback Control of LTI Systems under LQR Performance
di: Gießler, Armin, et al.
Pubblicazione: (2026)
di: Gießler, Armin, et al.
Pubblicazione: (2026)
Dynamic State-Feedback Control for LPV Systems: Ensuring Stability and LQR Performance
di: Gießler, Armin, et al.
Pubblicazione: (2025)
di: Gießler, Armin, et al.
Pubblicazione: (2025)
Data-driven Linear Quadratic Integral Control: A Convex Formulation and Policy Gradient Approach
di: Gießler, Armin, et al.
Pubblicazione: (2026)
di: Gießler, Armin, et al.
Pubblicazione: (2026)
Passivation of Clustered DC Microgrids with Non-Monotone Loads
di: Malan, Albertus Johannes, et al.
Pubblicazione: (2024)
di: Malan, Albertus Johannes, et al.
Pubblicazione: (2024)
Convergence Analysis of Gradient Flow for Overparameterized LQR Formulations
di: de Oliveira, Arthur Castello B., et al.
Pubblicazione: (2024)
di: de Oliveira, Arthur Castello B., et al.
Pubblicazione: (2024)
Policy Gradient Bounds in Multitask LQR
di: Stamouli, Charis, et al.
Pubblicazione: (2025)
di: Stamouli, Charis, et al.
Pubblicazione: (2025)
Small-Disturbance Input-to-State Stability of Perturbed Gradient Flows: Applications to LQR Problem
di: Cui, Leilei, et al.
Pubblicazione: (2023)
di: Cui, Leilei, et al.
Pubblicazione: (2023)
Stability-Certified On-Policy Data-Driven LQR via Recursive Learning and Policy Gradient
di: Sforni, Lorenzo, et al.
Pubblicazione: (2024)
di: Sforni, Lorenzo, et al.
Pubblicazione: (2024)
Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches
di: Zhao, Feiran, et al.
Pubblicazione: (2025)
di: Zhao, Feiran, et al.
Pubblicazione: (2025)
Disentangling Uncertainty for Safe Social Navigation using Deep Reinforcement Learning
di: Flögel, Daniel, et al.
Pubblicazione: (2024)
di: Flögel, Daniel, et al.
Pubblicazione: (2024)
Policy Gradient for LQR with Domain Randomization
di: Fujinami, Tesshu, et al.
Pubblicazione: (2025)
di: Fujinami, Tesshu, et al.
Pubblicazione: (2025)
A Stochastic Gradient Descent Approach to Design Policy Gradient Methods for LQR
di: Song, Bowen, et al.
Pubblicazione: (2026)
di: Song, Bowen, et al.
Pubblicazione: (2026)
LQR for Systems with Probabilistic Parametric Uncertainties: A Gradient Method
di: Cui, Leilei, et al.
Pubblicazione: (2026)
di: Cui, Leilei, et al.
Pubblicazione: (2026)
Cooperative Trajectory Planning: Principles for Human-Machine System Design on Trajectory Level
di: Schneider, Julian, et al.
Pubblicazione: (2024)
di: Schneider, Julian, et al.
Pubblicazione: (2024)
Study on Human-Variability-Respecting Optimal Control Affecting Human Interaction Experience
di: Kille, Sean, et al.
Pubblicazione: (2024)
di: Kille, Sean, et al.
Pubblicazione: (2024)
Cooperative Decision-Making in Shared Spaces: Making Urban Traffic Safer through Human-Machine Cooperation
di: Varga, Balint, et al.
Pubblicazione: (2023)
di: Varga, Balint, et al.
Pubblicazione: (2023)
Transfer Learning for LQR Control
di: Guo, Taosha, et al.
Pubblicazione: (2025)
di: Guo, Taosha, et al.
Pubblicazione: (2025)
Adaptive Control of an Inverted Pendulum by a Reinforcement Learning-based LQR Method
di: Yildiran, Ugur
Pubblicazione: (2023)
di: Yildiran, Ugur
Pubblicazione: (2023)
Error-State LQR Formulation for Quadrotor UAV Trajectory Tracking
di: Reich, Micah
Pubblicazione: (2025)
di: Reich, Micah
Pubblicazione: (2025)
Policy Gradient Methods for the Cost-Constrained LQR: Strong Duality and Global Convergence
di: Zhao, Feiran, et al.
Pubblicazione: (2024)
di: Zhao, Feiran, et al.
Pubblicazione: (2024)
An optimistic planning algorithm for switched discrete-time LQR
di: Granzotto, Mathieu, et al.
Pubblicazione: (2025)
di: Granzotto, Mathieu, et al.
Pubblicazione: (2025)
Captivity-Escape Games as a Means for Safety in Online Motion Generation
di: Bohn, Christopher, et al.
Pubblicazione: (2025)
di: Bohn, Christopher, et al.
Pubblicazione: (2025)
Towards Universal Shared Control in Teleoperation Without Haptic Feedback
di: Grobbel, Max, et al.
Pubblicazione: (2025)
di: Grobbel, Max, et al.
Pubblicazione: (2025)
Shared Telemanipulation with VR controllers in an anti slosh scenario
di: Grobbel, Max, et al.
Pubblicazione: (2023)
di: Grobbel, Max, et al.
Pubblicazione: (2023)
Adaptive Model Predictive Control for Differential-Algebraic Systems towards a Higher Path Accuracy for Physically Coupled Robots
di: Ye, Xin, et al.
Pubblicazione: (2024)
di: Ye, Xin, et al.
Pubblicazione: (2024)
Rendezvous and Docking of Mobile Ground Robots for Efficient Transportation Systems
di: Fischer, Lars, et al.
Pubblicazione: (2026)
di: Fischer, Lars, et al.
Pubblicazione: (2026)
Sample-Efficient Model-Free Policy Gradient Methods for Stochastic LQR via Robust Linear Regression
di: Song, Bowen, et al.
Pubblicazione: (2025)
di: Song, Bowen, et al.
Pubblicazione: (2025)
Convergence Guarantees of Model-free Policy Gradient Methods for LQR with Stochastic Data
di: Song, Bowen, et al.
Pubblicazione: (2025)
di: Song, Bowen, et al.
Pubblicazione: (2025)
On Globally Optimal Stochastic Policy Gradient Methods for Domain Randomized LQR Synthesis
di: Nguyen-Le, Alex, et al.
Pubblicazione: (2026)
di: Nguyen-Le, Alex, et al.
Pubblicazione: (2026)
Reachable Sets-based Trajectory Planning Combining Reinforcement Learning and iLQR
di: Huang, Wenjie, et al.
Pubblicazione: (2025)
di: Huang, Wenjie, et al.
Pubblicazione: (2025)
Asynchronous Distributed Reinforcement Learning for LQR Control via Zeroth-Order Block Coordinate Descent
di: Jing, Gangshan, et al.
Pubblicazione: (2021)
di: Jing, Gangshan, et al.
Pubblicazione: (2021)
SINRL: Socially Integrated Navigation with Reinforcement Learning using Spiking Neural Networks
di: Tretter, Florian, et al.
Pubblicazione: (2025)
di: Tretter, Florian, et al.
Pubblicazione: (2025)
On the System Theoretic Offline Learning of Continuous-Time LQR with Exogenous Disturbances
di: Mukherjee, Sayak, et al.
Pubblicazione: (2025)
di: Mukherjee, Sayak, et al.
Pubblicazione: (2025)
Socially Integrated Navigation: A Social Acting Robot with Deep Reinforcement Learning
di: Flögel, Daniel, et al.
Pubblicazione: (2024)
di: Flögel, Daniel, et al.
Pubblicazione: (2024)
Scenario-based Thermal Management Parametrization Through Deep Reinforcement Learning
di: Rudolf, Thomas, et al.
Pubblicazione: (2024)
di: Rudolf, Thomas, et al.
Pubblicazione: (2024)
Parameter Tuning Under Uncertain Road Perception in Driver Assistance Systems
di: Greiser, Leon, et al.
Pubblicazione: (2025)
di: Greiser, Leon, et al.
Pubblicazione: (2025)
Passivity-Based Local Design Conditions for Global Optimality in Distributed Convex Optimization
di: Jane-Soneira, Pol, et al.
Pubblicazione: (2025)
di: Jane-Soneira, Pol, et al.
Pubblicazione: (2025)
Off-Policy Reinforcement Learning with Anytime Safety Guarantees via Robust Safe Gradient Flow
di: Mestres, Pol, et al.
Pubblicazione: (2025)
di: Mestres, Pol, et al.
Pubblicazione: (2025)
Stability of Certainty-Equivalent Adaptive LQR for Linear Systems with Unknown Time-Varying Parameters
di: Bartos, Marcell, et al.
Pubblicazione: (2025)
di: Bartos, Marcell, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Data-Driven Continuous-Time Linear Quadratic Regulator via Closed-Loop and Reinforcement Learning Parameterizations
di: Gießler, Armin, et al.
Pubblicazione: (2026) -
Towards Optimal Passive Feedback Control of LTI Systems under LQR Performance
di: Gießler, Armin, et al.
Pubblicazione: (2026) -
Dynamic State-Feedback Control for LPV Systems: Ensuring Stability and LQR Performance
di: Gießler, Armin, et al.
Pubblicazione: (2025) -
Data-driven Linear Quadratic Integral Control: A Convex Formulation and Policy Gradient Approach
di: Gießler, Armin, et al.
Pubblicazione: (2026) -
Passivation of Clustered DC Microgrids with Non-Monotone Loads
di: Malan, Albertus Johannes, et al.
Pubblicazione: (2024)