Fast Two-Time-Scale Stochastic Gradient Method with Applications in Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zeng, Sihan, Doan, Thinh T. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Two-Time-Scale Stochastic Optimization Framework with Applications in Control and Reinforcement Learning
di: Zeng, Sihan, et al.
Pubblicazione: (2021)
di: Zeng, Sihan, et al.
Pubblicazione: (2021)
Natural Policy Gradient and Actor Critic Methods for Constrained Multi-Task Reinforcement Learning
di: Zeng, Sihan, et al.
Pubblicazione: (2024)
di: Zeng, Sihan, et al.
Pubblicazione: (2024)
Fast Nonlinear Two-Time-Scale Stochastic Approximation: Achieving $O(1/k)$ Finite-Sample Complexity
di: Doan, Thinh T.
Pubblicazione: (2024)
di: Doan, Thinh T.
Pubblicazione: (2024)
Accelerated Multi-Time-Scale Stochastic Approximation: Optimal Complexity and Applications in Reinforcement Learning and Multi-Agent Games
di: Zeng, Sihan, et al.
Pubblicazione: (2024)
di: Zeng, Sihan, et al.
Pubblicazione: (2024)
Finite-Time Complexity of Online Primal-Dual Natural Actor-Critic Algorithm for Constrained Markov Decision Processes
di: Zeng, Sihan, et al.
Pubblicazione: (2021)
di: Zeng, Sihan, et al.
Pubblicazione: (2021)
Resilient Two-Time-Scale Local Stochastic Gradient Descent for Byzantine Federated Learning
di: Dutta, Amit, et al.
Pubblicazione: (2024)
di: Dutta, Amit, et al.
Pubblicazione: (2024)
A Hessian-Free Actor-Critic Algorithm for Bi-Level Reinforcement Learning with Applications to LLM Fine-Tuning
di: Zeng, Sihan, et al.
Pubblicazione: (2026)
di: Zeng, Sihan, et al.
Pubblicazione: (2026)
Stochastic Auto-conditioned Fast Gradient Methods with Optimal Rates
di: Ji, Yao, et al.
Pubblicazione: (2026)
di: Ji, Yao, et al.
Pubblicazione: (2026)
Nonconvex Stochastic Bregman Proximal Gradient Method with Application to Deep Learning
di: Ding, Kuangyu, et al.
Pubblicazione: (2023)
di: Ding, Kuangyu, et al.
Pubblicazione: (2023)
Finite-Time Decoupled Convergence in Nonlinear Two-Time-Scale Stochastic Approximation
di: Han, Yuze, et al.
Pubblicazione: (2024)
di: Han, Yuze, et al.
Pubblicazione: (2024)
Stochastic Gradient Methods with Preconditioned Updates
di: Sadiev, Abdurakhmon, et al.
Pubblicazione: (2022)
di: Sadiev, Abdurakhmon, et al.
Pubblicazione: (2022)
Convergence Rate in Nonlinear Two-Time-Scale Stochastic Approximation with State (Time)-Dependence
di: Chen, Zixi, et al.
Pubblicazione: (2025)
di: Chen, Zixi, et al.
Pubblicazione: (2025)
Gradient Methods with Online Scaling
di: Gao, Wenzhi, et al.
Pubblicazione: (2024)
di: Gao, Wenzhi, et al.
Pubblicazione: (2024)
Tight Finite Time Bounds of Two-Time-Scale Linear Stochastic Approximation with Markovian Noise
di: Haque, Shaan Ul, et al.
Pubblicazione: (2023)
di: Haque, Shaan Ul, et al.
Pubblicazione: (2023)
On the Role of Batch Size in Stochastic Conditional Gradient Methods
di: Islamov, Rustem, et al.
Pubblicazione: (2026)
di: Islamov, Rustem, et al.
Pubblicazione: (2026)
Riemannian Stochastic Gradient Method for Nested Composition Optimization
di: Zhang, Dewei, et al.
Pubblicazione: (2022)
di: Zhang, Dewei, et al.
Pubblicazione: (2022)
Revisiting the Last-Iterate Convergence of Stochastic Gradient Methods
di: Liu, Zijian, et al.
Pubblicazione: (2023)
di: Liu, Zijian, et al.
Pubblicazione: (2023)
Fast and Large-Scale Unbalanced Optimal Transport via its Semi-Dual and Adaptive Gradient Methods
di: Genans, Ferdinand
Pubblicazione: (2026)
di: Genans, Ferdinand
Pubblicazione: (2026)
Biased Stochastic First-Order Methods for Conditional Stochastic Optimization and Applications in Meta Learning
di: Hu, Yifan, et al.
Pubblicazione: (2020)
di: Hu, Yifan, et al.
Pubblicazione: (2020)
$O(1/k)$ Finite-Time Bound for Non-Linear Two-Time-Scale Stochastic Approximation
di: Chandak, Siddharth
Pubblicazione: (2025)
di: Chandak, Siddharth
Pubblicazione: (2025)
Finite-Time Bounds for Two-Time-Scale Stochastic Approximation with Arbitrary Norm Contractions and Markovian Noise
di: Chandak, Siddharth, et al.
Pubblicazione: (2025)
di: Chandak, Siddharth, et al.
Pubblicazione: (2025)
Bilevel Learning with Inexact Stochastic Gradients
di: Salehi, Mohammad Sadegh, et al.
Pubblicazione: (2024)
di: Salehi, Mohammad Sadegh, et al.
Pubblicazione: (2024)
FastPart: Over-Parameterized Stochastic Gradient Descent for Sparse optimisation on Measures
di: De Castro, Yohann, et al.
Pubblicazione: (2023)
di: De Castro, Yohann, et al.
Pubblicazione: (2023)
Faster Gradient Methods for Highly-Smooth Stochastic Bilevel Optimization
di: Chen, Lesi, et al.
Pubblicazione: (2025)
di: Chen, Lesi, et al.
Pubblicazione: (2025)
Compressed Decentralized Momentum Stochastic Gradient Methods for Nonconvex Optimization
di: Liu, Wei, et al.
Pubblicazione: (2025)
di: Liu, Wei, et al.
Pubblicazione: (2025)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
di: Carmona, René, et al.
Pubblicazione: (2019)
di: Carmona, René, et al.
Pubblicazione: (2019)
Finite-Time Analysis of Projected Two-Time-Scale Stochastic Approximation
di: Bai, Yitao, et al.
Pubblicazione: (2026)
di: Bai, Yitao, et al.
Pubblicazione: (2026)
Interpreting Adaptive Gradient Methods by Parameter Scaling for Learning-Rate-Free Optimization
di: Suh, Min-Kook, et al.
Pubblicazione: (2024)
di: Suh, Min-Kook, et al.
Pubblicazione: (2024)
Accelerating Multi-Task Temporal Difference Learning under Low-Rank Representation
di: Bai, Yitao, et al.
Pubblicazione: (2025)
di: Bai, Yitao, et al.
Pubblicazione: (2025)
Safe Reinforcement Learning for Constrained Markov Decision Processes with Stochastic Stopping Time
di: Mazumdar, Abhijit, et al.
Pubblicazione: (2024)
di: Mazumdar, Abhijit, et al.
Pubblicazione: (2024)
An Adaptive Stochastic Gradient Method with Non-negative Gauss-Newton Stepsizes
di: Orvieto, Antonio, et al.
Pubblicazione: (2024)
di: Orvieto, Antonio, et al.
Pubblicazione: (2024)
In-Expectation Convergence of Stochastic Gradient Methods under Heavy-Tailed Noise
di: Liu, Zijian
Pubblicazione: (2026)
di: Liu, Zijian
Pubblicazione: (2026)
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
di: Klein, Sara, et al.
Pubblicazione: (2023)
di: Klein, Sara, et al.
Pubblicazione: (2023)
Almost Sure Convergence Analysis of Differentially Private Stochastic Gradient Methods
di: Mukherjee, Amartya, et al.
Pubblicazione: (2025)
di: Mukherjee, Amartya, et al.
Pubblicazione: (2025)
Decoupled Functional Central Limit Theorems for Two-Time-Scale Stochastic Approximation
di: Han, Yuze, et al.
Pubblicazione: (2024)
di: Han, Yuze, et al.
Pubblicazione: (2024)
QCQP-Net: Reliably Learning Feasible Alternating Current Optimal Power Flow Solutions Under Constraints
di: Zeng, Sihan, et al.
Pubblicazione: (2024)
di: Zeng, Sihan, et al.
Pubblicazione: (2024)
Nonasymptotic CLT and Error Bounds for Two-Time-Scale Stochastic Approximation
di: Kong, Seo Taek, et al.
Pubblicazione: (2025)
di: Kong, Seo Taek, et al.
Pubblicazione: (2025)
Fill-and-Spill: Deep Reinforcement Learning Policy Gradient Methods for Reservoir Operation Decision and Control
di: Tabas, Sadegh Sadeghi, et al.
Pubblicazione: (2024)
di: Tabas, Sadegh Sadeghi, et al.
Pubblicazione: (2024)
On the Stochastic (Variance-Reduced) Proximal Gradient Method for Regularized Expected Reward Optimization
di: Liang, Ling, et al.
Pubblicazione: (2024)
di: Liang, Ling, et al.
Pubblicazione: (2024)
Multi-level Monte-Carlo Gradient Methods for Stochastic Optimization with Biased Oracles
di: Hu, Yifan, et al.
Pubblicazione: (2024)
di: Hu, Yifan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Two-Time-Scale Stochastic Optimization Framework with Applications in Control and Reinforcement Learning
di: Zeng, Sihan, et al.
Pubblicazione: (2021) -
Natural Policy Gradient and Actor Critic Methods for Constrained Multi-Task Reinforcement Learning
di: Zeng, Sihan, et al.
Pubblicazione: (2024) -
Fast Nonlinear Two-Time-Scale Stochastic Approximation: Achieving $O(1/k)$ Finite-Sample Complexity
di: Doan, Thinh T.
Pubblicazione: (2024) -
Accelerated Multi-Time-Scale Stochastic Approximation: Optimal Complexity and Applications in Reinforcement Learning and Multi-Agent Games
di: Zeng, Sihan, et al.
Pubblicazione: (2024) -
Finite-Time Complexity of Online Primal-Dual Natural Actor-Critic Algorithm for Constrained Markov Decision Processes
di: Zeng, Sihan, et al.
Pubblicazione: (2021)