Salvato in:
| Autori principali: | Ding, Yuhao, Zhang, Junzi, Lee, Hyunin, Lavaei, Javad |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2021
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2110.10117 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pausing Policy Learning in Non-stationary Reinforcement Learning
di: Lee, Hyunin, et al.
Pubblicazione: (2024)
di: Lee, Hyunin, et al.
Pubblicazione: (2024)
Policy-based Primal-Dual Methods for Concave CMDP with Variance Reduction
di: Ying, Donghao, et al.
Pubblicazione: (2022)
di: Ying, Donghao, et al.
Pubblicazione: (2022)
Beyond Softmax and Entropy: Convergence Rates of Policy Gradients with f-SoftArgmax Parameterization & Coupled Regularization
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
di: Klein, Sara, et al.
Pubblicazione: (2023)
di: Klein, Sara, et al.
Pubblicazione: (2023)
Global Convergence of Wasserstein Policy Gradient for Entropy-Regularized Reinforcement Learning
di: Zhu, Zhaoyu, et al.
Pubblicazione: (2026)
di: Zhu, Zhaoyu, et al.
Pubblicazione: (2026)
TRSVR: An Adaptive Stochastic Trust-Region Method with Variance Reduction
di: Fang, Yuchen, et al.
Pubblicazione: (2026)
di: Fang, Yuchen, et al.
Pubblicazione: (2026)
Linear Convergence of Independent Natural Policy Gradient in Games with Entropy Regularization
di: Sun, Youbang, et al.
Pubblicazione: (2024)
di: Sun, Youbang, et al.
Pubblicazione: (2024)
Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
di: Cayci, Semih, et al.
Pubblicazione: (2021)
di: Cayci, Semih, et al.
Pubblicazione: (2021)
Matryoshka Policy Gradient for Entropy-Regularized RL: Convergence and Global Optimality
di: Ged, François, et al.
Pubblicazione: (2023)
di: Ged, François, et al.
Pubblicazione: (2023)
A CMDP-within-online framework for Meta-Safe Reinforcement Learning
di: Khattar, Vanshaj, et al.
Pubblicazione: (2024)
di: Khattar, Vanshaj, et al.
Pubblicazione: (2024)
Reusing Historical Trajectories in Natural Policy Gradient via Importance Sampling: Convergence and Convergence Rate
di: Lin, Yifan, et al.
Pubblicazione: (2024)
di: Lin, Yifan, et al.
Pubblicazione: (2024)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Revisiting the Last-Iterate Convergence of Stochastic Gradient Methods
di: Liu, Zijian, et al.
Pubblicazione: (2023)
di: Liu, Zijian, et al.
Pubblicazione: (2023)
Soft Deterministic Policy Gradient with Gaussian Smoothing
di: Na, Hyunjun, et al.
Pubblicazione: (2026)
di: Na, Hyunjun, et al.
Pubblicazione: (2026)
Exact Recovery for System Identification with More Corrupt Data than Clean Data
di: Yalcin, Baturalp, et al.
Pubblicazione: (2023)
di: Yalcin, Baturalp, et al.
Pubblicazione: (2023)
Controlling the Flow: Stability and Convergence for Stochastic Gradient Descent with Decaying Regularization
di: Kassing, Sebastian, et al.
Pubblicazione: (2025)
di: Kassing, Sebastian, et al.
Pubblicazione: (2025)
Ordering-based Conditions for Global Convergence of Policy Gradient Methods
di: Mei, Jincheng, et al.
Pubblicazione: (2025)
di: Mei, Jincheng, et al.
Pubblicazione: (2025)
A Trust-Region Interior-Point Stochastic Sequential Quadratic Programming Method
di: Fang, Yuchen, et al.
Pubblicazione: (2026)
di: Fang, Yuchen, et al.
Pubblicazione: (2026)
Why is Normalization Preferred? A Worst-Case Complexity Theory for Stochastically Preconditioned SGD under Heavy-Tailed Noise
di: Fang, Yuchen, et al.
Pubblicazione: (2026)
di: Fang, Yuchen, et al.
Pubblicazione: (2026)
High Probability Complexity Bounds of Trust-Region Stochastic Sequential Quadratic Programming with Heavy-Tailed Noise
di: Fang, Yuchen, et al.
Pubblicazione: (2025)
di: Fang, Yuchen, et al.
Pubblicazione: (2025)
Accelerated Convergence of Stochastic Heavy Ball Method under Anisotropic Gradient Noise
di: Pan, Rui, et al.
Pubblicazione: (2023)
di: Pan, Rui, et al.
Pubblicazione: (2023)
In-Expectation Convergence of Stochastic Gradient Methods under Heavy-Tailed Noise
di: Liu, Zijian
Pubblicazione: (2026)
di: Liu, Zijian
Pubblicazione: (2026)
Almost Sure Convergence Analysis of Differentially Private Stochastic Gradient Methods
di: Mukherjee, Amartya, et al.
Pubblicazione: (2025)
di: Mukherjee, Amartya, et al.
Pubblicazione: (2025)
Personalized Federated Learning with Exact Stochastic Gradient Descent
di: Nikoloutsopoulos, Sotirios, et al.
Pubblicazione: (2022)
di: Nikoloutsopoulos, Sotirios, et al.
Pubblicazione: (2022)
Global Convergence Guarantees for Federated Policy Gradient Methods with Adversaries
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
Learning Optimal Deterministic Policies with Stochastic Policy Gradients
di: Montenegro, Alessandro, et al.
Pubblicazione: (2024)
di: Montenegro, Alessandro, et al.
Pubblicazione: (2024)
Subgradient Method for System Identification with Non-Smooth Objectives
di: Yalcin, Baturalp, et al.
Pubblicazione: (2025)
di: Yalcin, Baturalp, et al.
Pubblicazione: (2025)
Gradient Regularized Newton Boosting Trees with Global Convergence
di: Zozoulenko, Nikita, et al.
Pubblicazione: (2026)
di: Zozoulenko, Nikita, et al.
Pubblicazione: (2026)
Accelerated Policy Gradient: On the Convergence Rates of the Nesterov Momentum for Reinforcement Learning
di: Chen, Yen-Ju, et al.
Pubblicazione: (2023)
di: Chen, Yen-Ju, et al.
Pubblicazione: (2023)
On the Stochastic (Variance-Reduced) Proximal Gradient Method for Regularized Expected Reward Optimization
di: Liang, Ling, et al.
Pubblicazione: (2024)
di: Liang, Ling, et al.
Pubblicazione: (2024)
On the Convergence of Stochastic Gradient Descent with Perturbed Forward-Backward Passes
di: Kong, Boao, et al.
Pubblicazione: (2026)
di: Kong, Boao, et al.
Pubblicazione: (2026)
Exact Recovery Guarantees for Parameterized Nonlinear System Identification Problem under Sparse Disturbances or Semi-Oblivious Attacks
di: Zhang, Haixiang, et al.
Pubblicazione: (2024)
di: Zhang, Haixiang, et al.
Pubblicazione: (2024)
Reusing Trajectories in Policy Gradients Enables Fast Convergence
di: Montenegro, Alessandro, et al.
Pubblicazione: (2025)
di: Montenegro, Alessandro, et al.
Pubblicazione: (2025)
Policy Gradient in Robust MDPs with Global Convergence Guarantee
di: Wang, Qiuhao, et al.
Pubblicazione: (2022)
di: Wang, Qiuhao, et al.
Pubblicazione: (2022)
On the Second-Order Convergence of Biased Policy Gradient Algorithms
di: Mu, Siqiao, et al.
Pubblicazione: (2023)
di: Mu, Siqiao, et al.
Pubblicazione: (2023)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
di: Carmona, René, et al.
Pubblicazione: (2019)
di: Carmona, René, et al.
Pubblicazione: (2019)
Fast Stochastic Policy Gradient: Negative Momentum for Reinforcement Learning
di: Zhang, Haobin, et al.
Pubblicazione: (2024)
di: Zhang, Haobin, et al.
Pubblicazione: (2024)
Convergence Analysis of Stochastic Gradient Descent with MCMC Estimators
di: Li, Tianyou, et al.
Pubblicazione: (2023)
di: Li, Tianyou, et al.
Pubblicazione: (2023)
Gradient Regularized Natural Gradients
di: Dash, Satya Prakash, et al.
Pubblicazione: (2026)
di: Dash, Satya Prakash, et al.
Pubblicazione: (2026)
Convergence of Stochastic Gradient Methods for Wide Two-Layer Physics-Informed Neural Networks
di: Jin, Bangti, et al.
Pubblicazione: (2025)
di: Jin, Bangti, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Pausing Policy Learning in Non-stationary Reinforcement Learning
di: Lee, Hyunin, et al.
Pubblicazione: (2024) -
Policy-based Primal-Dual Methods for Concave CMDP with Variance Reduction
di: Ying, Donghao, et al.
Pubblicazione: (2022) -
Beyond Softmax and Entropy: Convergence Rates of Policy Gradients with f-SoftArgmax Parameterization & Coupled Regularization
di: Labbi, Safwan, et al.
Pubblicazione: (2026) -
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
di: Klein, Sara, et al.
Pubblicazione: (2023) -
Global Convergence of Wasserstein Policy Gradient for Entropy-Regularized Reinforcement Learning
di: Zhu, Zhaoyu, et al.
Pubblicazione: (2026)