Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence
Fuente:
arXiv
Salvato in:
| Autori principali: | Xiao, Minheng, Yu, Xian, Ying, Lei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the Global Convergence of Risk-Averse Natural Policy Gradient Methods with Expected Conditional Risk Measures
di: Yu, Xian, et al.
Pubblicazione: (2023)
di: Yu, Xian, et al.
Pubblicazione: (2023)
Global Convergence Guarantees for Federated Policy Gradient Methods with Adversaries
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
Towards Efficient Risk-Sensitive Policy Gradient: An Iteration Complexity Analysis
di: Liu, Rui, et al.
Pubblicazione: (2024)
di: Liu, Rui, et al.
Pubblicazione: (2024)
Agentic Transformers Provably Learn to Search via Reinforcement Learning
di: Yang, Tong, et al.
Pubblicazione: (2026)
di: Yang, Tong, et al.
Pubblicazione: (2026)
Performative Policy Gradient: Optimality in Performative Reinforcement Learning
di: Basu, Debabrota, et al.
Pubblicazione: (2025)
di: Basu, Debabrota, et al.
Pubblicazione: (2025)
Delightful Distributed Policy Gradient
di: Osband, Ian
Pubblicazione: (2026)
di: Osband, Ian
Pubblicazione: (2026)
Deterministic Policy Gradient for Reinforcement Learning with Continuous Time and State
di: Cheng, Ziheng, et al.
Pubblicazione: (2025)
di: Cheng, Ziheng, et al.
Pubblicazione: (2025)
Provable Acceleration of Nesterov's Accelerated Gradient Method over Heavy Ball Method in Training Over-Parameterized Neural Networks
di: Liu, Xin, et al.
Pubblicazione: (2022)
di: Liu, Xin, et al.
Pubblicazione: (2022)
Provable Offline Reinforcement Learning for Structured Cyclic MDPs
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
A Methodology Establishing Linear Convergence of Adaptive Gradient Methods under PL Inequality
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2024)
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2024)
Accelerating Convergence of Score-Based Diffusion Models, Provably
di: Li, Gen, et al.
Pubblicazione: (2024)
di: Li, Gen, et al.
Pubblicazione: (2024)
Enhancing Stochastic Gradient Descent: A Unified Framework and Novel Acceleration Methods for Faster Convergence
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
Transformers Provably Learn Chain-of-Thought Reasoning with Length Generalization
di: Huang, Yu, et al.
Pubblicazione: (2025)
di: Huang, Yu, et al.
Pubblicazione: (2025)
Delightful Policy Gradient
di: Osband, Ian
Pubblicazione: (2026)
di: Osband, Ian
Pubblicazione: (2026)
Multi-head Transformers Provably Learn Symbolic Multi-step Reasoning via Gradient Descent
di: Yang, Tong, et al.
Pubblicazione: (2025)
di: Yang, Tong, et al.
Pubblicazione: (2025)
On the Convergence of (Stochastic) Gradient Descent for Kolmogorov--Arnold Networks
di: Gao, Yihang, et al.
Pubblicazione: (2024)
di: Gao, Yihang, et al.
Pubblicazione: (2024)
Learning Provably Improves the Convergence of Gradient Descent
di: Song, Qingyu, et al.
Pubblicazione: (2025)
di: Song, Qingyu, et al.
Pubblicazione: (2025)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
di: Carmona, René, et al.
Pubblicazione: (2019)
di: Carmona, René, et al.
Pubblicazione: (2019)
R2L: Reliable Reinforcement Learning: Guaranteed Return & Reliable Policies in Reinforcement Learning
di: Farhi, Nadir
Pubblicazione: (2025)
di: Farhi, Nadir
Pubblicazione: (2025)
Adaptive Primal-Dual Method for Safe Reinforcement Learning
di: Chen, Weiqin, et al.
Pubblicazione: (2024)
di: Chen, Weiqin, et al.
Pubblicazione: (2024)
One-Layer Transformer Provably Learns One-Nearest Neighbor In Context
di: Li, Zihao, et al.
Pubblicazione: (2024)
di: Li, Zihao, et al.
Pubblicazione: (2024)
CORL: Reinforcement Learning of MILP Policies Solved via Branch and Bound
di: Anand, Akhil S, et al.
Pubblicazione: (2025)
di: Anand, Akhil S, et al.
Pubblicazione: (2025)
Policy Optimization in Hybrid Discrete-Continuous Action Spaces via Mixed Gradients
di: Alvo, Matias, et al.
Pubblicazione: (2026)
di: Alvo, Matias, et al.
Pubblicazione: (2026)
DR-SAC: Distributionally Robust Soft Actor-Critic for Reinforcement Learning under Uncertainty
di: Cui, Mingxuan, et al.
Pubblicazione: (2025)
di: Cui, Mingxuan, et al.
Pubblicazione: (2025)
Provable Acceleration for Diffusion Models under Minimal Assumptions
di: Li, Gen, et al.
Pubblicazione: (2024)
di: Li, Gen, et al.
Pubblicazione: (2024)
Classical and Deep Reinforcement Learning Inventory Control Policies for Pharmaceutical Supply Chains with Perishability and Non-Stationarity
di: Stranieri, Francesco, et al.
Pubblicazione: (2025)
di: Stranieri, Francesco, et al.
Pubblicazione: (2025)
Closing the Loop: Coordinating Inventory and Recommendation via Deep Reinforcement Learning on Multiple Timescales
di: Jiang, Jinyang, et al.
Pubblicazione: (2025)
di: Jiang, Jinyang, et al.
Pubblicazione: (2025)
Revisiting LQR Control from the Perspective of Receding-Horizon Policy Gradient
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2023)
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2023)
Benchmarking Reinforcement Learning via Stochastic Converse Optimality: Generating Systems with Known Optimal Policies
di: Ibrahim, Sinan, et al.
Pubblicazione: (2026)
di: Ibrahim, Sinan, et al.
Pubblicazione: (2026)
Provably Safe Generative Sampling with Constricting Barrier Functions
di: Gadginmath, Darshan, et al.
Pubblicazione: (2026)
di: Gadginmath, Darshan, et al.
Pubblicazione: (2026)
Learning Branching Policies for MILPs with Proximal Policy Optimization
di: Mhamed, Abdelouahed Ben, et al.
Pubblicazione: (2025)
di: Mhamed, Abdelouahed Ben, et al.
Pubblicazione: (2025)
SMiLE: Provably Enforcing Global Relational Properties in Neural Networks
di: Francobaldi, Matteo, et al.
Pubblicazione: (2025)
di: Francobaldi, Matteo, et al.
Pubblicazione: (2025)
Asynchronous Distributed Reinforcement Learning for LQR Control via Zeroth-Order Block Coordinate Descent
di: Jing, Gangshan, et al.
Pubblicazione: (2021)
di: Jing, Gangshan, et al.
Pubblicazione: (2021)
New Hybrid Fine-Tuning Paradigm for LLMs: Algorithm Design and Convergence Analysis Framework
di: Ma, Shaocong, et al.
Pubblicazione: (2026)
di: Ma, Shaocong, et al.
Pubblicazione: (2026)
A Unified Framework for Gradient Aggregation in Multi-Objective Optimization
di: Hu, Zeou, et al.
Pubblicazione: (2026)
di: Hu, Zeou, et al.
Pubblicazione: (2026)
Mitigating Gradient Bias in Multi-objective Learning: A Provably Convergent Stochastic Approach
di: Fernando, Heshan, et al.
Pubblicazione: (2022)
di: Fernando, Heshan, et al.
Pubblicazione: (2022)
On a Gradient Approach to Chebyshev Center Problems with Applications to Function Learning
di: Raghuvanshi, Abhinav, et al.
Pubblicazione: (2026)
di: Raghuvanshi, Abhinav, et al.
Pubblicazione: (2026)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Examining Policy Entropy of Reinforcement Learning Agents for Personalization Tasks
di: Dereventsov, Anton, et al.
Pubblicazione: (2022)
di: Dereventsov, Anton, et al.
Pubblicazione: (2022)
When and How Unlabeled Data Provably Improve In-Context Learning
di: Li, Yingcong, et al.
Pubblicazione: (2025)
di: Li, Yingcong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
On the Global Convergence of Risk-Averse Natural Policy Gradient Methods with Expected Conditional Risk Measures
di: Yu, Xian, et al.
Pubblicazione: (2023) -
Global Convergence Guarantees for Federated Policy Gradient Methods with Adversaries
di: Ganesh, Swetha, et al.
Pubblicazione: (2024) -
Towards Efficient Risk-Sensitive Policy Gradient: An Iteration Complexity Analysis
di: Liu, Rui, et al.
Pubblicazione: (2024) -
Agentic Transformers Provably Learn to Search via Reinforcement Learning
di: Yang, Tong, et al.
Pubblicazione: (2026) -
Performative Policy Gradient: Optimality in Performative Reinforcement Learning
di: Basu, Debabrota, et al.
Pubblicazione: (2025)