Policy Gradient Methods for Discrete Time Linear Quadratic Regulator With Random Parameters
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Li, Deyue |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Policy Gradient Converges to the Globally Optimal Policy for Nearly Linear-Quadratic Regulators
par: Han, Yinbin, et autres
Publié: (2023)
par: Han, Yinbin, et autres
Publié: (2023)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
par: Carmona, René, et autres
Publié: (2019)
par: Carmona, René, et autres
Publié: (2019)
Meta-Learning Linear Quadratic Regulators: A Policy Gradient MAML Approach for Model-free LQR
par: Toso, Leonardo F., et autres
Publié: (2024)
par: Toso, Leonardo F., et autres
Publié: (2024)
Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application
par: Li, Lucky
Publié: (2024)
par: Li, Lucky
Publié: (2024)
Accelerated Optimization Landscape of Linear-Quadratic Regulator
par: Feng, Lechen, et autres
Publié: (2023)
par: Feng, Lechen, et autres
Publié: (2023)
Fast Policy Learning for Linear Quadratic Control with Entropy Regularization
par: Guo, Xin, et autres
Publié: (2023)
par: Guo, Xin, et autres
Publié: (2023)
Tsallis Entropy Regularization for Linearly Solvable MDP and Linear Quadratic Regulator
par: Hashizume, Yota, et autres
Publié: (2024)
par: Hashizume, Yota, et autres
Publié: (2024)
Learning Decentralized Linear Quadratic Regulators with $\sqrt{T}$ Regret
par: Ye, Lintao, et autres
Publié: (2022)
par: Ye, Lintao, et autres
Publié: (2022)
Asynchronous Parallel Policy Gradient Methods for the Linear Quadratic Regulator
par: Sha, Xingyu, et autres
Publié: (2024)
par: Sha, Xingyu, et autres
Publié: (2024)
Regret Bounds for Episodic Risk-Sensitive Linear Quadratic Regulator
par: Xu, Wenhao, et autres
Publié: (2024)
par: Xu, Wenhao, et autres
Publié: (2024)
Sample Complexity of Linear Quadratic Regulator Without Initial Stability
par: Moghaddam, Amirreza Neshaei, et autres
Publié: (2025)
par: Moghaddam, Amirreza Neshaei, et autres
Publié: (2025)
Elementary Analysis of Policy Gradient Methods
par: Liu, Jiacai, et autres
Publié: (2024)
par: Liu, Jiacai, et autres
Publié: (2024)
Sample Complexity of the Linear Quadratic Regulator: A Reinforcement Learning Lens
par: Moghaddam, Amirreza Neshaei, et autres
Publié: (2024)
par: Moghaddam, Amirreza Neshaei, et autres
Publié: (2024)
Quadratic Gradient: A Unified Framework Bridging Gradient Descent and Newton-Type Methods by Synthesizing Hessians and Gradients
par: Chiang, John
Publié: (2022)
par: Chiang, John
Publié: (2022)
Model-Free Learning for the Linear Quadratic Regulator over Rate-Limited Channels
par: Ye, Lintao, et autres
Publié: (2024)
par: Ye, Lintao, et autres
Publié: (2024)
Rate-Optimal Regret for the Safe Learning-based Control of the Constrained Linear Quadratic Regulator
par: Hutchinson, Spencer, et autres
Publié: (2026)
par: Hutchinson, Spencer, et autres
Publié: (2026)
Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
par: Cayci, Semih, et autres
Publié: (2021)
par: Cayci, Semih, et autres
Publié: (2021)
Optimization of Discrete Parameters Using the Adaptive Gradient Method and Directed Evolution
par: Beinarovich, Andrei, et autres
Publié: (2024)
par: Beinarovich, Andrei, et autres
Publié: (2024)
Gradient Dominance in the Linear Quadratic Regulator: A Unified Analysis for Continuous-Time and Discrete-Time Systems
par: Watanabe, Yuto, et autres
Publié: (2026)
par: Watanabe, Yuto, et autres
Publié: (2026)
Global Convergence of Policy Gradient Methods for ReLU Controllers in Linear Quadratic Regulation
par: Rodriguez-Gil, Jhojan A., et autres
Publié: (2026)
par: Rodriguez-Gil, Jhojan A., et autres
Publié: (2026)
Near-Optimal Distributed Linear-Quadratic Regulator for Networked Systems
par: Shin, Sungho, et autres
Publié: (2022)
par: Shin, Sungho, et autres
Publié: (2022)
Towards Simple and Provable Parameter-Free Adaptive Gradient Methods
par: Tao, Yuanzhe, et autres
Publié: (2024)
par: Tao, Yuanzhe, et autres
Publié: (2024)
Mutual Information Optimal Control of Discrete-Time Linear Systems
par: Enami, Shoju, et autres
Publié: (2025)
par: Enami, Shoju, et autres
Publié: (2025)
Analysis of On-policy Policy Gradient Methods under the Distribution Mismatch
par: Wang, Weizhen, et autres
Publié: (2025)
par: Wang, Weizhen, et autres
Publié: (2025)
Reheated Gradient-based Discrete Sampling for Combinatorial Optimization
par: Li, Muheng, et autres
Publié: (2025)
par: Li, Muheng, et autres
Publié: (2025)
DoWG Unleashed: An Efficient Universal Parameter-Free Gradient Descent Method
par: Khaled, Ahmed, et autres
Publié: (2023)
par: Khaled, Ahmed, et autres
Publié: (2023)
Interpreting Adaptive Gradient Methods by Parameter Scaling for Learning-Rate-Free Optimization
par: Suh, Min-Kook, et autres
Publié: (2024)
par: Suh, Min-Kook, et autres
Publié: (2024)
Fixed Horizon Linear Quadratic Covariance Steering in Continuous Time with Hilbert-Schmidt Terminal Cost
par: Sial, Tushar, et autres
Publié: (2025)
par: Sial, Tushar, et autres
Publié: (2025)
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
par: Klein, Sara, et autres
Publié: (2023)
par: Klein, Sara, et autres
Publié: (2023)
Model-Free Output Feedback Stabilization via Policy Gradient Methods
par: Zhang, Ankang, et autres
Publié: (2026)
par: Zhang, Ankang, et autres
Publié: (2026)
Convergence for Discrete Parameter Update Schemes
par: Wilson, Paul, et autres
Publié: (2025)
par: Wilson, Paul, et autres
Publié: (2025)
Regret Lower Bounds for Learning Linear Quadratic Gaussian Systems
par: Ziemann, Ingvar, et autres
Publié: (2022)
par: Ziemann, Ingvar, et autres
Publié: (2022)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
par: Ding, Dongsheng, et autres
Publié: (2023)
par: Ding, Dongsheng, et autres
Publié: (2023)
Parameter Symmetry and Noise Equilibrium of Stochastic Gradient Descent
par: Ziyin, Liu, et autres
Publié: (2024)
par: Ziyin, Liu, et autres
Publié: (2024)
Generalized Continuous-Time Models for Nesterov's Accelerated Gradient Methods
par: Park, Chanwoong, et autres
Publié: (2024)
par: Park, Chanwoong, et autres
Publié: (2024)
On the Effectiveness of the z-Transform Method in Quadratic Optimization
par: Bach, Francis
Publié: (2025)
par: Bach, Francis
Publié: (2025)
Gradient Descent Converges Linearly to Flatter Minima than Gradient Flow in Shallow Linear Networks
par: Beneventano, Pierfrancesco, et autres
Publié: (2025)
par: Beneventano, Pierfrancesco, et autres
Publié: (2025)
Natural Policy Gradient and Actor Critic Methods for Constrained Multi-Task Reinforcement Learning
par: Zeng, Sihan, et autres
Publié: (2024)
par: Zeng, Sihan, et autres
Publié: (2024)
Nonconvex Optimization Framework for Group-Sparse Feedback Linear-Quadratic Optimal Control: Penalty Approach
par: Feng, Lechen, et autres
Publié: (2025)
par: Feng, Lechen, et autres
Publié: (2025)
Robustness of Iteratively Pre-Conditioned Gradient-Descent Method: The Case of Distributed Linear Regression Problem
par: Chakrabarti, Kushal, et autres
Publié: (2021)
par: Chakrabarti, Kushal, et autres
Publié: (2021)
Documents similaires
-
Policy Gradient Converges to the Globally Optimal Policy for Nearly Linear-Quadratic Regulators
par: Han, Yinbin, et autres
Publié: (2023) -
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
par: Carmona, René, et autres
Publié: (2019) -
Meta-Learning Linear Quadratic Regulators: A Policy Gradient MAML Approach for Model-free LQR
par: Toso, Leonardo F., et autres
Publié: (2024) -
Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application
par: Li, Lucky
Publié: (2024) -
Accelerated Optimization Landscape of Linear-Quadratic Regulator
par: Feng, Lechen, et autres
Publié: (2023)