Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
Fuente:
arXiv
Salvato in:
| Autori principali: | Klein, Sara, Weissmann, Simon, Döring, Leif |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Controlling the Flow: Stability and Convergence for Stochastic Gradient Descent with Decaying Regularization
di: Kassing, Sebastian, et al.
Pubblicazione: (2025)
di: Kassing, Sebastian, et al.
Pubblicazione: (2025)
Structure Matters: Dynamic Policy Gradient
di: Klein, Sara, et al.
Pubblicazione: (2024)
di: Klein, Sara, et al.
Pubblicazione: (2024)
Almost sure convergence rates of stochastic gradient methods under gradient domination
di: Weissmann, Simon, et al.
Pubblicazione: (2024)
di: Weissmann, Simon, et al.
Pubblicazione: (2024)
The Role of Target Update Frequencies in Q-Learning
di: Weissmann, Simon, et al.
Pubblicazione: (2026)
di: Weissmann, Simon, et al.
Pubblicazione: (2026)
Random Function Descent
di: Benning, Felix, et al.
Pubblicazione: (2023)
di: Benning, Felix, et al.
Pubblicazione: (2023)
Almost Sure Convergence Analysis of Differentially Private Stochastic Gradient Methods
di: Mukherjee, Amartya, et al.
Pubblicazione: (2025)
di: Mukherjee, Amartya, et al.
Pubblicazione: (2025)
Revisiting the Last-Iterate Convergence of Stochastic Gradient Methods
di: Liu, Zijian, et al.
Pubblicazione: (2023)
di: Liu, Zijian, et al.
Pubblicazione: (2023)
An Approximate Ascent Approach To Prove Convergence of PPO
di: Doering, Leif, et al.
Pubblicazione: (2026)
di: Doering, Leif, et al.
Pubblicazione: (2026)
Convergence Analysis of Stochastic Gradient Descent with MCMC Estimators
di: Li, Tianyou, et al.
Pubblicazione: (2023)
di: Li, Tianyou, et al.
Pubblicazione: (2023)
In-Expectation Convergence of Stochastic Gradient Methods under Heavy-Tailed Noise
di: Liu, Zijian
Pubblicazione: (2026)
di: Liu, Zijian
Pubblicazione: (2026)
Learning to Adapt: In-Context Learning Beyond Stationarity
di: Qin, Zhen, et al.
Pubblicazione: (2026)
di: Qin, Zhen, et al.
Pubblicazione: (2026)
Accelerated Convergence of Stochastic Heavy Ball Method under Anisotropic Gradient Noise
di: Pan, Rui, et al.
Pubblicazione: (2023)
di: Pan, Rui, et al.
Pubblicazione: (2023)
Elementary Analysis of Policy Gradient Methods
di: Liu, Jiacai, et al.
Pubblicazione: (2024)
di: Liu, Jiacai, et al.
Pubblicazione: (2024)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
di: Carmona, René, et al.
Pubblicazione: (2019)
di: Carmona, René, et al.
Pubblicazione: (2019)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Gradient Span Algorithms Make Predictable Progress in High Dimension
di: Benning, Felix, et al.
Pubblicazione: (2024)
di: Benning, Felix, et al.
Pubblicazione: (2024)
On the Global Convergence of Risk-Averse Natural Policy Gradient Methods with Expected Conditional Risk Measures
di: Yu, Xian, et al.
Pubblicazione: (2023)
di: Yu, Xian, et al.
Pubblicazione: (2023)
Exponential Convergence of (Stochastic) Gradient Descent for Separable Logistic Regression
di: Kale, Sacchit, et al.
Pubblicazione: (2026)
di: Kale, Sacchit, et al.
Pubblicazione: (2026)
Faster Convergence of Stochastic Accelerated Gradient Descent under Interpolation
di: Mishkin, Aaron, et al.
Pubblicazione: (2024)
di: Mishkin, Aaron, et al.
Pubblicazione: (2024)
Convergence of Stochastic Gradient Langevin Dynamics in the Lazy Training Regime
di: Oberweis, Noah, et al.
Pubblicazione: (2025)
di: Oberweis, Noah, et al.
Pubblicazione: (2025)
On the Convergence of Stochastic Gradient Descent with Perturbed Forward-Backward Passes
di: Kong, Boao, et al.
Pubblicazione: (2026)
di: Kong, Boao, et al.
Pubblicazione: (2026)
Global Convergence Guarantees for Federated Policy Gradient Methods with Adversaries
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
Gradient Flow Polarizes Softmax Outputs towards Low-Entropy Solutions
di: Varre, Aditya, et al.
Pubblicazione: (2026)
di: Varre, Aditya, et al.
Pubblicazione: (2026)
On the Last-Iterate Convergence of Shuffling Gradient Methods
di: Liu, Zijian, et al.
Pubblicazione: (2024)
di: Liu, Zijian, et al.
Pubblicazione: (2024)
On the Convergence of Adaptive Gradient Methods for Nonconvex Optimization
di: Zhou, Dongruo, et al.
Pubblicazione: (2018)
di: Zhou, Dongruo, et al.
Pubblicazione: (2018)
Directional Smoothness and Gradient Methods: Convergence and Adaptivity
di: Mishkin, Aaron, et al.
Pubblicazione: (2024)
di: Mishkin, Aaron, et al.
Pubblicazione: (2024)
Stochastic Gradient Methods with Preconditioned Updates
di: Sadiev, Abdurakhmon, et al.
Pubblicazione: (2022)
di: Sadiev, Abdurakhmon, et al.
Pubblicazione: (2022)
ADDQ: Adaptive Distributional Double Q-Learning
di: Döring, Leif, et al.
Pubblicazione: (2025)
di: Döring, Leif, et al.
Pubblicazione: (2025)
Analysis of On-policy Policy Gradient Methods under the Distribution Mismatch
di: Wang, Weizhen, et al.
Pubblicazione: (2025)
di: Wang, Weizhen, et al.
Pubblicazione: (2025)
Policy Gradient Converges to the Globally Optimal Policy for Nearly Linear-Quadratic Regulators
di: Han, Yinbin, et al.
Pubblicazione: (2023)
di: Han, Yinbin, et al.
Pubblicazione: (2023)
Quantitative Convergence Analysis of Projected Stochastic Gradient Descent for Non-Convex Losses via the Goldstein Subdifferential
di: Zheng, Yuping, et al.
Pubblicazione: (2025)
di: Zheng, Yuping, et al.
Pubblicazione: (2025)
Faster Convergence of Riemannian Stochastic Gradient Descent with Increasing Batch Size
di: Oowada, Kanata, et al.
Pubblicazione: (2025)
di: Oowada, Kanata, et al.
Pubblicazione: (2025)
Coupling-based Convergence Diagnostic and Stepsize Scheme for Stochastic Gradient Descent
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
Reusing Historical Trajectories in Natural Policy Gradient via Importance Sampling: Convergence and Convergence Rate
di: Lin, Yifan, et al.
Pubblicazione: (2024)
di: Lin, Yifan, et al.
Pubblicazione: (2024)
Convergence of Policy Mirror Descent Beyond Compatible Function Approximation
di: Sherman, Uri, et al.
Pubblicazione: (2025)
di: Sherman, Uri, et al.
Pubblicazione: (2025)
Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence
di: Xiao, Minheng, et al.
Pubblicazione: (2024)
di: Xiao, Minheng, et al.
Pubblicazione: (2024)
On the Role of Batch Size in Stochastic Conditional Gradient Methods
di: Islamov, Rustem, et al.
Pubblicazione: (2026)
di: Islamov, Rustem, et al.
Pubblicazione: (2026)
Riemannian Stochastic Gradient Method for Nested Composition Optimization
di: Zhang, Dewei, et al.
Pubblicazione: (2022)
di: Zhang, Dewei, et al.
Pubblicazione: (2022)
Mitigating Gradient Bias in Multi-objective Learning: A Provably Convergent Stochastic Approach
di: Fernando, Heshan, et al.
Pubblicazione: (2022)
di: Fernando, Heshan, et al.
Pubblicazione: (2022)
Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
di: Cayci, Semih, et al.
Pubblicazione: (2021)
di: Cayci, Semih, et al.
Pubblicazione: (2021)
Documenti analoghi
-
Controlling the Flow: Stability and Convergence for Stochastic Gradient Descent with Decaying Regularization
di: Kassing, Sebastian, et al.
Pubblicazione: (2025) -
Structure Matters: Dynamic Policy Gradient
di: Klein, Sara, et al.
Pubblicazione: (2024) -
Almost sure convergence rates of stochastic gradient methods under gradient domination
di: Weissmann, Simon, et al.
Pubblicazione: (2024) -
The Role of Target Update Frequencies in Q-Learning
di: Weissmann, Simon, et al.
Pubblicazione: (2026) -
Random Function Descent
di: Benning, Felix, et al.
Pubblicazione: (2023)