Natural Policy Gradient and Actor Critic Methods for Constrained Multi-Task Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zeng, Sihan, Doan, Thinh T., Romberg, Justin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Finite-Time Complexity of Online Primal-Dual Natural Actor-Critic Algorithm for Constrained Markov Decision Processes
par: Zeng, Sihan, et autres
Publié: (2021)
par: Zeng, Sihan, et autres
Publié: (2021)
A Two-Time-Scale Stochastic Optimization Framework with Applications in Control and Reinforcement Learning
par: Zeng, Sihan, et autres
Publié: (2021)
par: Zeng, Sihan, et autres
Publié: (2021)
Fast Two-Time-Scale Stochastic Gradient Method with Applications in Reinforcement Learning
par: Zeng, Sihan, et autres
Publié: (2024)
par: Zeng, Sihan, et autres
Publié: (2024)
Accelerating Multi-Task Temporal Difference Learning under Low-Rank Representation
par: Bai, Yitao, et autres
Publié: (2025)
par: Bai, Yitao, et autres
Publié: (2025)
Accelerated Multi-Time-Scale Stochastic Approximation: Optimal Complexity and Applications in Reinforcement Learning and Multi-Agent Games
par: Zeng, Sihan, et autres
Publié: (2024)
par: Zeng, Sihan, et autres
Publié: (2024)
A Hessian-Free Actor-Critic Algorithm for Bi-Level Reinforcement Learning with Applications to LLM Fine-Tuning
par: Zeng, Sihan, et autres
Publié: (2026)
par: Zeng, Sihan, et autres
Publié: (2026)
Fast Nonlinear Two-Time-Scale Stochastic Approximation: Achieving $O(1/k)$ Finite-Sample Complexity
par: Doan, Thinh T.
Publié: (2024)
par: Doan, Thinh T.
Publié: (2024)
Quasi-Newton Compatible Actor-Critic for Deterministic Policies
par: Kordabad, Arash Bahari, et autres
Publié: (2025)
par: Kordabad, Arash Bahari, et autres
Publié: (2025)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
par: Carmona, René, et autres
Publié: (2019)
par: Carmona, René, et autres
Publié: (2019)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
par: Ding, Dongsheng, et autres
Publié: (2023)
par: Ding, Dongsheng, et autres
Publié: (2023)
Finite-Time Analysis of Projected Two-Time-Scale Stochastic Approximation
par: Bai, Yitao, et autres
Publié: (2026)
par: Bai, Yitao, et autres
Publié: (2026)
Weak Convergence Analysis of Online Neural Actor-Critic Algorithms
par: Lam, Samuel Chun-Hei, et autres
Publié: (2024)
par: Lam, Samuel Chun-Hei, et autres
Publié: (2024)
Fill-and-Spill: Deep Reinforcement Learning Policy Gradient Methods for Reservoir Operation Decision and Control
par: Tabas, Sadegh Sadeghi, et autres
Publié: (2024)
par: Tabas, Sadegh Sadeghi, et autres
Publié: (2024)
CACTO-SL: Using Sobolev Learning to improve Continuous Actor-Critic with Trajectory Optimization
par: Alboni, Elisa, et autres
Publié: (2023)
par: Alboni, Elisa, et autres
Publié: (2023)
Recurrent Natural Policy Gradient for POMDPs
par: Cayci, Semih, et autres
Publié: (2024)
par: Cayci, Semih, et autres
Publié: (2024)
Resilient Two-Time-Scale Local Stochastic Gradient Descent for Byzantine Federated Learning
par: Dutta, Amit, et autres
Publié: (2024)
par: Dutta, Amit, et autres
Publié: (2024)
On the Global Convergence of Risk-Averse Natural Policy Gradient Methods with Expected Conditional Risk Measures
par: Yu, Xian, et autres
Publié: (2023)
par: Yu, Xian, et autres
Publié: (2023)
Elementary Analysis of Policy Gradient Methods
par: Liu, Jiacai, et autres
Publié: (2024)
par: Liu, Jiacai, et autres
Publié: (2024)
Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence
par: Xiao, Minheng, et autres
Publié: (2024)
par: Xiao, Minheng, et autres
Publié: (2024)
Double Duality: Variational Primal-Dual Policy Optimization for Constrained Reinforcement Learning
par: Li, Zihao, et autres
Publié: (2024)
par: Li, Zihao, et autres
Publié: (2024)
DR-SAC: Distributionally Robust Soft Actor-Critic for Reinforcement Learning under Uncertainty
par: Cui, Mingxuan, et autres
Publié: (2025)
par: Cui, Mingxuan, et autres
Publié: (2025)
A Communication-Efficient Decentralized Actor-Critic Algorithm
par: Ren, Xiaoxing, et autres
Publié: (2025)
par: Ren, Xiaoxing, et autres
Publié: (2025)
Natural Policy Gradient as Doubly Smoothed Policy Iteration: A Bellman-Operator Framework
par: Nanda, Phalguni, et autres
Publié: (2026)
par: Nanda, Phalguni, et autres
Publié: (2026)
Resilient Constrained Reinforcement Learning
par: Ding, Dongsheng, et autres
Publié: (2023)
par: Ding, Dongsheng, et autres
Publié: (2023)
Sequential Bayesian Optimal Experimental Design in Infinite Dimensions via Policy Gradient Reinforcement Learning
par: Shen, Kaichen, et autres
Publié: (2026)
par: Shen, Kaichen, et autres
Publié: (2026)
Performative Policy Gradient: Optimality in Performative Reinforcement Learning
par: Basu, Debabrota, et autres
Publié: (2025)
par: Basu, Debabrota, et autres
Publié: (2025)
Towards Fast Rates for Federated and Multi-Task Reinforcement Learning
par: Zhu, Feng, et autres
Publié: (2024)
par: Zhu, Feng, et autres
Publié: (2024)
Exploration from a Primal-Dual Lens: Value-Incentivized Actor-Critic Methods for Sample-Efficient Online RL
par: Yang, Tong, et autres
Publié: (2025)
par: Yang, Tong, et autres
Publié: (2025)
QCQP-Net: Reliably Learning Feasible Alternating Current Optimal Power Flow Solutions Under Constraints
par: Zeng, Sihan, et autres
Publié: (2024)
par: Zeng, Sihan, et autres
Publié: (2024)
Analysis of On-policy Policy Gradient Methods under the Distribution Mismatch
par: Wang, Weizhen, et autres
Publié: (2025)
par: Wang, Weizhen, et autres
Publié: (2025)
Wasserstein Flow Meets Replicator Dynamics: A Mean-Field Analysis of Representation Learning in Actor-Critic
par: Zhang, Yufeng, et autres
Publié: (2021)
par: Zhang, Yufeng, et autres
Publié: (2021)
Global Convergence of Natural Policy Gradient with Hessian-aided Momentum Variance Reduction
par: Feng, Jie, et autres
Publié: (2024)
par: Feng, Jie, et autres
Publié: (2024)
Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
par: Cayci, Semih, et autres
Publié: (2021)
par: Cayci, Semih, et autres
Publié: (2021)
Deterministic Policy Gradient for Reinforcement Learning with Continuous Time and State
par: Cheng, Ziheng, et autres
Publié: (2025)
par: Cheng, Ziheng, et autres
Publié: (2025)
Variational Quantum Eigensolver with Constraints (VQEC): Solving Constrained Optimization Problems via VQE
par: Le, Thinh Viet, et autres
Publié: (2023)
par: Le, Thinh Viet, et autres
Publié: (2023)
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
par: Klein, Sara, et autres
Publié: (2023)
par: Klein, Sara, et autres
Publié: (2023)
Model-Free Output Feedback Stabilization via Policy Gradient Methods
par: Zhang, Ankang, et autres
Publié: (2026)
par: Zhang, Ankang, et autres
Publié: (2026)
Traversing Pareto Optimal Policies: Provably Efficient Multi-Objective Reinforcement Learning
par: Qiu, Shuang, et autres
Publié: (2024)
par: Qiu, Shuang, et autres
Publié: (2024)
Gauss-Newton Natural Gradient Descent for Shape Learning
par: King, James, et autres
Publié: (2026)
par: King, James, et autres
Publié: (2026)
Policy Gradient Methods for Discrete Time Linear Quadratic Regulator With Random Parameters
par: Li, Deyue
Publié: (2023)
par: Li, Deyue
Publié: (2023)
Documents similaires
-
Finite-Time Complexity of Online Primal-Dual Natural Actor-Critic Algorithm for Constrained Markov Decision Processes
par: Zeng, Sihan, et autres
Publié: (2021) -
A Two-Time-Scale Stochastic Optimization Framework with Applications in Control and Reinforcement Learning
par: Zeng, Sihan, et autres
Publié: (2021) -
Fast Two-Time-Scale Stochastic Gradient Method with Applications in Reinforcement Learning
par: Zeng, Sihan, et autres
Publié: (2024) -
Accelerating Multi-Task Temporal Difference Learning under Low-Rank Representation
par: Bai, Yitao, et autres
Publié: (2025) -
Accelerated Multi-Time-Scale Stochastic Approximation: Optimal Complexity and Applications in Reinforcement Learning and Multi-Agent Games
par: Zeng, Sihan, et autres
Publié: (2024)