Reusing Historical Trajectories in Natural Policy Gradient via Importance Sampling: Convergence and Convergence Rate
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Yifan, Wang, Yuhao, Zhou, Enlu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ranking and Selection with Simultaneous Input Data Collection
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
Global Convergence of Natural Policy Gradient with Hessian-aided Momentum Variance Reduction
di: Feng, Jie, et al.
Pubblicazione: (2024)
di: Feng, Jie, et al.
Pubblicazione: (2024)
Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
di: Cayci, Semih, et al.
Pubblicazione: (2021)
di: Cayci, Semih, et al.
Pubblicazione: (2021)
Open Problem: Anytime Convergence Rate of Gradient Descent
di: Kornowski, Guy, et al.
Pubblicazione: (2024)
di: Kornowski, Guy, et al.
Pubblicazione: (2024)
Convergence Rate Analysis of LION
di: Dong, Yiming, et al.
Pubblicazione: (2024)
di: Dong, Yiming, et al.
Pubblicazione: (2024)
On the Global Convergence of Risk-Averse Natural Policy Gradient Methods with Expected Conditional Risk Measures
di: Yu, Xian, et al.
Pubblicazione: (2023)
di: Yu, Xian, et al.
Pubblicazione: (2023)
Linear Convergence of Independent Natural Policy Gradient in Games with Entropy Regularization
di: Sun, Youbang, et al.
Pubblicazione: (2024)
di: Sun, Youbang, et al.
Pubblicazione: (2024)
On the Convergence of Policy in Unregularized Policy Mirror Descent
di: Lin, Dachao, et al.
Pubblicazione: (2022)
di: Lin, Dachao, et al.
Pubblicazione: (2022)
Convergence Properties of Natural Gradient Descent for Minimizing KL Divergence
di: Datar, Adwait, et al.
Pubblicazione: (2025)
di: Datar, Adwait, et al.
Pubblicazione: (2025)
Policy Gradient Converges to the Globally Optimal Policy for Nearly Linear-Quadratic Regulators
di: Han, Yinbin, et al.
Pubblicazione: (2023)
di: Han, Yinbin, et al.
Pubblicazione: (2023)
Convergence Rates for Gradient Descent on the Edge of Stability in Overparametrised Least Squares
di: MacDonald, Lachlan Ewen, et al.
Pubblicazione: (2025)
di: MacDonald, Lachlan Ewen, et al.
Pubblicazione: (2025)
On the Last-Iterate Convergence of Shuffling Gradient Methods
di: Liu, Zijian, et al.
Pubblicazione: (2024)
di: Liu, Zijian, et al.
Pubblicazione: (2024)
Learning Provably Improves the Convergence of Gradient Descent
di: Song, Qingyu, et al.
Pubblicazione: (2025)
di: Song, Qingyu, et al.
Pubblicazione: (2025)
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
di: Klein, Sara, et al.
Pubblicazione: (2023)
di: Klein, Sara, et al.
Pubblicazione: (2023)
On the Convergence of Adaptive Gradient Methods for Nonconvex Optimization
di: Zhou, Dongruo, et al.
Pubblicazione: (2018)
di: Zhou, Dongruo, et al.
Pubblicazione: (2018)
Revisiting the Last-Iterate Convergence of Stochastic Gradient Methods
di: Liu, Zijian, et al.
Pubblicazione: (2023)
di: Liu, Zijian, et al.
Pubblicazione: (2023)
GANs as Gradient Flows that Converge
di: Huang, Yu-Jui, et al.
Pubblicazione: (2022)
di: Huang, Yu-Jui, et al.
Pubblicazione: (2022)
On the Convergence of Gradient Descent on Learning Transformers with Residual Connections
di: Qin, Zhen, et al.
Pubblicazione: (2025)
di: Qin, Zhen, et al.
Pubblicazione: (2025)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
di: Carmona, René, et al.
Pubblicazione: (2019)
di: Carmona, René, et al.
Pubblicazione: (2019)
Incremental Gauss--Newton Methods with Superlinear Convergence Rates
di: Zhou, Zhiling, et al.
Pubblicazione: (2024)
di: Zhou, Zhiling, et al.
Pubblicazione: (2024)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Directional Smoothness and Gradient Methods: Convergence and Adaptivity
di: Mishkin, Aaron, et al.
Pubblicazione: (2024)
di: Mishkin, Aaron, et al.
Pubblicazione: (2024)
Learning Over-Relaxation Policies for ADMM with Convergence Guarantees
di: Lin, Junan, et al.
Pubblicazione: (2026)
di: Lin, Junan, et al.
Pubblicazione: (2026)
Sharper Convergence Rates for Nonconvex Optimisation via Reduction Mappings
di: Markou, Evan, et al.
Pubblicazione: (2025)
di: Markou, Evan, et al.
Pubblicazione: (2025)
Convergence of Alternating Gradient Descent for Matrix Factorization
di: Ward, Rachel, et al.
Pubblicazione: (2023)
di: Ward, Rachel, et al.
Pubblicazione: (2023)
Sobolev Gradient Ascent for Optimal Transport: Barycenter Optimization and Convergence Analysis
di: Kim, Kaheon, et al.
Pubblicazione: (2025)
di: Kim, Kaheon, et al.
Pubblicazione: (2025)
Global Convergence Guarantees for Federated Policy Gradient Methods with Adversaries
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
Improved Last-Iterate Convergence of Shuffling Gradient Methods for Nonsmooth Convex Optimization
di: Liu, Zijian, et al.
Pubblicazione: (2025)
di: Liu, Zijian, et al.
Pubblicazione: (2025)
MAP Estimation with Denoisers: Convergence Rates and Guarantees
di: Pesme, Scott, et al.
Pubblicazione: (2025)
di: Pesme, Scott, et al.
Pubblicazione: (2025)
Convergence Analysis of Stochastic Gradient Descent with MCMC Estimators
di: Li, Tianyou, et al.
Pubblicazione: (2023)
di: Li, Tianyou, et al.
Pubblicazione: (2023)
On Convergence of Incremental Gradient for Non-Convex Smooth Functions
di: Koloskova, Anastasia, et al.
Pubblicazione: (2023)
di: Koloskova, Anastasia, et al.
Pubblicazione: (2023)
Gradient Regularized Newton Boosting Trees with Global Convergence
di: Zozoulenko, Nikita, et al.
Pubblicazione: (2026)
di: Zozoulenko, Nikita, et al.
Pubblicazione: (2026)
Implicit Bias and Fast Convergence Rates for Self-attention
di: Vasudeva, Bhavya, et al.
Pubblicazione: (2024)
di: Vasudeva, Bhavya, et al.
Pubblicazione: (2024)
Nonsmooth Implicit Differentiation: Deterministic and Stochastic Convergence Rates
di: Grazzi, Riccardo, et al.
Pubblicazione: (2024)
di: Grazzi, Riccardo, et al.
Pubblicazione: (2024)
Robust Sublinear Convergence Rates for Iterative Bregman Projections
di: Peyré, Gabriel
Pubblicazione: (2026)
di: Peyré, Gabriel
Pubblicazione: (2026)
Limits of Convergence-Rate Control for Open-Weight Safety
di: Rosati, Domenic, et al.
Pubblicazione: (2026)
di: Rosati, Domenic, et al.
Pubblicazione: (2026)
Improved Convergence Rates of Muon Optimizer for Nonconvex Optimization
di: Nagashima, Shuntaro, et al.
Pubblicazione: (2026)
di: Nagashima, Shuntaro, et al.
Pubblicazione: (2026)
Convergence Rate of the Last Iterate of Stochastic Proximal Algorithms
di: Vaidyan, Kevin Kurian Thomas, et al.
Pubblicazione: (2026)
di: Vaidyan, Kevin Kurian Thomas, et al.
Pubblicazione: (2026)
Episodic Bayesian Optimal Control with Unknown Randomness Distributions
di: Shapiro, Alexander, et al.
Pubblicazione: (2023)
di: Shapiro, Alexander, et al.
Pubblicazione: (2023)
Nonconvex Stochastic Optimization under Heavy-Tailed Noises: Optimal Convergence without Gradient Clipping
di: Liu, Zijian, et al.
Pubblicazione: (2024)
di: Liu, Zijian, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Ranking and Selection with Simultaneous Input Data Collection
di: Wang, Yuhao, et al.
Pubblicazione: (2025) -
Global Convergence of Natural Policy Gradient with Hessian-aided Momentum Variance Reduction
di: Feng, Jie, et al.
Pubblicazione: (2024) -
Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
di: Cayci, Semih, et al.
Pubblicazione: (2021) -
Open Problem: Anytime Convergence Rate of Gradient Descent
di: Kornowski, Guy, et al.
Pubblicazione: (2024) -
Convergence Rate Analysis of LION
di: Dong, Yiming, et al.
Pubblicazione: (2024)