Elementary Analysis of Policy Gradient Methods
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Jiacai, Li, Wenye, Wei, Ke |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the Convergence of Policy Mirror Descent with Temporal Difference Evaluation
par: Liu, Jiacai, et autres
Publié: (2025)
par: Liu, Jiacai, et autres
Publié: (2025)
Policy Mirror Descent with Temporal Difference Learning: Sample Complexity under Online Markov Data
par: Li, Wenye, et autres
Publié: (2025)
par: Li, Wenye, et autres
Publié: (2025)
On the Convergence of Projected Policy Gradient for Any Constant Step Sizes
par: Liu, Jiacai, et autres
Publié: (2023)
par: Liu, Jiacai, et autres
Publié: (2023)
Analysis of On-policy Policy Gradient Methods under the Distribution Mismatch
par: Wang, Weizhen, et autres
Publié: (2025)
par: Wang, Weizhen, et autres
Publié: (2025)
Global Convergence of Natural Policy Gradient with Hessian-aided Momentum Variance Reduction
par: Feng, Jie, et autres
Publié: (2024)
par: Feng, Jie, et autres
Publié: (2024)
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
par: Klein, Sara, et autres
Publié: (2023)
par: Klein, Sara, et autres
Publié: (2023)
Policy Gradient Methods for Discrete Time Linear Quadratic Regulator With Random Parameters
par: Li, Deyue
Publié: (2023)
par: Li, Deyue
Publié: (2023)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
par: Ding, Dongsheng, et autres
Publié: (2023)
par: Ding, Dongsheng, et autres
Publié: (2023)
A Concise Lyapunov Analysis of Nesterov's Accelerated Gradient Method
par: Liu, Jun
Publié: (2025)
par: Liu, Jun
Publié: (2025)
Almost Sure Convergence Analysis of Differentially Private Stochastic Gradient Methods
par: Mukherjee, Amartya, et autres
Publié: (2025)
par: Mukherjee, Amartya, et autres
Publié: (2025)
Model-Free Output Feedback Stabilization via Policy Gradient Methods
par: Zhang, Ankang, et autres
Publié: (2026)
par: Zhang, Ankang, et autres
Publié: (2026)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
par: Carmona, René, et autres
Publié: (2019)
par: Carmona, René, et autres
Publié: (2019)
Natural Policy Gradient and Actor Critic Methods for Constrained Multi-Task Reinforcement Learning
par: Zeng, Sihan, et autres
Publié: (2024)
par: Zeng, Sihan, et autres
Publié: (2024)
Clipped Gradient Methods for Nonsmooth Convex Optimization under Heavy-Tailed Noise: A Refined Analysis
par: Liu, Zijian
Publié: (2025)
par: Liu, Zijian
Publié: (2025)
A Weighted Gradient Tracking Privacy-Preserving Method for Distributed Optimization
par: Xie, Furan, et autres
Publié: (2025)
par: Xie, Furan, et autres
Publié: (2025)
On the Last-Iterate Convergence of Shuffling Gradient Methods
par: Liu, Zijian, et autres
Publié: (2024)
par: Liu, Zijian, et autres
Publié: (2024)
Fill-and-Spill: Deep Reinforcement Learning Policy Gradient Methods for Reservoir Operation Decision and Control
par: Tabas, Sadegh Sadeghi, et autres
Publié: (2024)
par: Tabas, Sadegh Sadeghi, et autres
Publié: (2024)
On the Global Convergence of Risk-Averse Natural Policy Gradient Methods with Expected Conditional Risk Measures
par: Yu, Xian, et autres
Publié: (2023)
par: Yu, Xian, et autres
Publié: (2023)
Compressed Decentralized Momentum Stochastic Gradient Methods for Nonconvex Optimization
par: Liu, Wei, et autres
Publié: (2025)
par: Liu, Wei, et autres
Publié: (2025)
Revisiting the Last-Iterate Convergence of Stochastic Gradient Methods
par: Liu, Zijian, et autres
Publié: (2023)
par: Liu, Zijian, et autres
Publié: (2023)
Recurrent Natural Policy Gradient for POMDPs
par: Cayci, Semih, et autres
Publié: (2024)
par: Cayci, Semih, et autres
Publié: (2024)
Gradient Methods with Online Scaling
par: Gao, Wenzhi, et autres
Publié: (2024)
par: Gao, Wenzhi, et autres
Publié: (2024)
In-Expectation Convergence of Stochastic Gradient Methods under Heavy-Tailed Noise
par: Liu, Zijian
Publié: (2026)
par: Liu, Zijian
Publié: (2026)
Communication-Efficient Adaptive Batch Size Strategies for Distributed Local Gradient Methods
par: Lau, Tim Tsz-Kit, et autres
Publié: (2024)
par: Lau, Tim Tsz-Kit, et autres
Publié: (2024)
Policy Gradient Converges to the Globally Optimal Policy for Nearly Linear-Quadratic Regulators
par: Han, Yinbin, et autres
Publié: (2023)
par: Han, Yinbin, et autres
Publié: (2023)
Global Convergence Guarantees for Federated Policy Gradient Methods with Adversaries
par: Ganesh, Swetha, et autres
Publié: (2024)
par: Ganesh, Swetha, et autres
Publié: (2024)
Towards Efficient Risk-Sensitive Policy Gradient: An Iteration Complexity Analysis
par: Liu, Rui, et autres
Publié: (2024)
par: Liu, Rui, et autres
Publié: (2024)
Stochastic Gradient Methods with Preconditioned Updates
par: Sadiev, Abdurakhmon, et autres
Publié: (2022)
par: Sadiev, Abdurakhmon, et autres
Publié: (2022)
Decentralized Riemannian Conjugate Gradient Method on the Stiefel Manifold
par: Chen, Jun, et autres
Publié: (2023)
par: Chen, Jun, et autres
Publié: (2023)
Natural Policy Gradient as Doubly Smoothed Policy Iteration: A Bellman-Operator Framework
par: Nanda, Phalguni, et autres
Publié: (2026)
par: Nanda, Phalguni, et autres
Publié: (2026)
Towards Simple and Provable Parameter-Free Adaptive Gradient Methods
par: Tao, Yuanzhe, et autres
Publié: (2024)
par: Tao, Yuanzhe, et autres
Publié: (2024)
Faster Gradient Methods for Highly-Smooth Stochastic Bilevel Optimization
par: Chen, Lesi, et autres
Publié: (2025)
par: Chen, Lesi, et autres
Publié: (2025)
Improved Last-Iterate Convergence of Shuffling Gradient Methods for Nonsmooth Convex Optimization
par: Liu, Zijian, et autres
Publié: (2025)
par: Liu, Zijian, et autres
Publié: (2025)
Soft Robust MDPs and Risk-Sensitive MDPs: Equivalence, Policy Gradient, and Sample Complexity
par: Zhang, Runyu, et autres
Publié: (2023)
par: Zhang, Runyu, et autres
Publié: (2023)
Quadratic Gradient: A Unified Framework Bridging Gradient Descent and Newton-Type Methods by Synthesizing Hessians and Gradients
par: Chiang, John
Publié: (2022)
par: Chiang, John
Publié: (2022)
Nonconvex Stochastic Bregman Proximal Gradient Method with Application to Deep Learning
par: Ding, Kuangyu, et autres
Publié: (2023)
par: Ding, Kuangyu, et autres
Publié: (2023)
Provable Acceleration of Nesterov's Accelerated Gradient Method over Heavy Ball Method in Training Over-Parameterized Neural Networks
par: Liu, Xin, et autres
Publié: (2022)
par: Liu, Xin, et autres
Publié: (2022)
Directional Smoothness and Gradient Methods: Convergence and Adaptivity
par: Mishkin, Aaron, et autres
Publié: (2024)
par: Mishkin, Aaron, et autres
Publié: (2024)
On the Convergence of Adaptive Gradient Methods for Nonconvex Optimization
par: Zhou, Dongruo, et autres
Publié: (2018)
par: Zhou, Dongruo, et autres
Publié: (2018)
On Penalty-based Bilevel Gradient Descent Method
par: Shen, Han, et autres
Publié: (2023)
par: Shen, Han, et autres
Publié: (2023)
Documents similaires
-
On the Convergence of Policy Mirror Descent with Temporal Difference Evaluation
par: Liu, Jiacai, et autres
Publié: (2025) -
Policy Mirror Descent with Temporal Difference Learning: Sample Complexity under Online Markov Data
par: Li, Wenye, et autres
Publié: (2025) -
On the Convergence of Projected Policy Gradient for Any Constant Step Sizes
par: Liu, Jiacai, et autres
Publié: (2023) -
Analysis of On-policy Policy Gradient Methods under the Distribution Mismatch
par: Wang, Weizhen, et autres
Publié: (2025) -
Global Convergence of Natural Policy Gradient with Hessian-aided Momentum Variance Reduction
par: Feng, Jie, et autres
Publié: (2024)