Enregistré dans:
| Auteurs principaux: | Han, Haoyu, Yang, Heng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.01460 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Riemannian Zeroth-Order Gradient Estimation with Structure-Preserving Metrics for Geodesically Incomplete Manifolds
par: Ma, Shaocong, et autres
Publié: (2026)
par: Ma, Shaocong, et autres
Publié: (2026)
Policy Gradient Converges to the Globally Optimal Policy for Nearly Linear-Quadratic Regulators
par: Han, Yinbin, et autres
Publié: (2023)
par: Han, Yinbin, et autres
Publié: (2023)
On the Optimal Construction of Unbiased Gradient Estimators for Zeroth-Order Optimization
par: Ma, Shaocong, et autres
Publié: (2025)
par: Ma, Shaocong, et autres
Publié: (2025)
Parameter Symmetry and Noise Equilibrium of Stochastic Gradient Descent
par: Ziyin, Liu, et autres
Publié: (2024)
par: Ziyin, Liu, et autres
Publié: (2024)
Recurrent Natural Policy Gradient for POMDPs
par: Cayci, Semih, et autres
Publié: (2024)
par: Cayci, Semih, et autres
Publié: (2024)
Elementary Analysis of Policy Gradient Methods
par: Liu, Jiacai, et autres
Publié: (2024)
par: Liu, Jiacai, et autres
Publié: (2024)
Momentum Does Not Reduce Stochastic Noise in Stochastic Gradient Descent
par: Sato, Naoki, et autres
Publié: (2024)
par: Sato, Naoki, et autres
Publié: (2024)
Convergence of Steepest Descent and Adam under Non-Uniform Smoothness
par: Vaswani, Sharan, et autres
Publié: (2026)
par: Vaswani, Sharan, et autres
Publié: (2026)
Achieve Performatively Optimal Policy for Performative Reinforcement Learning
par: Chen, Ziyi, et autres
Publié: (2025)
par: Chen, Ziyi, et autres
Publié: (2025)
Meta-Learning Linear Quadratic Regulators: A Policy Gradient MAML Approach for Model-free LQR
par: Toso, Leonardo F., et autres
Publié: (2024)
par: Toso, Leonardo F., et autres
Publié: (2024)
In-Expectation Convergence of Stochastic Gradient Methods under Heavy-Tailed Noise
par: Liu, Zijian
Publié: (2026)
par: Liu, Zijian
Publié: (2026)
Towards Noise-adaptive, Problem-adaptive (Accelerated) Stochastic Gradient Descent
par: Vaswani, Sharan, et autres
Publié: (2021)
par: Vaswani, Sharan, et autres
Publié: (2021)
Soft Robust MDPs and Risk-Sensitive MDPs: Equivalence, Policy Gradient, and Sample Complexity
par: Zhang, Runyu, et autres
Publié: (2023)
par: Zhang, Runyu, et autres
Publié: (2023)
Efficient Low-Tubal-Rank Tensor Estimation via Alternating Preconditioned Gradient Descent
par: Liu, Zhiyu, et autres
Publié: (2025)
par: Liu, Zhiyu, et autres
Publié: (2025)
Convergence Analysis of Gradient-Based Learning with Non-Uniform Learning Rates in Non-Cooperative Multi-Agent Settings
par: Chasnov, Benjamin, et autres
Publié: (2019)
par: Chasnov, Benjamin, et autres
Publié: (2019)
Accelerated Convergence of Stochastic Heavy Ball Method under Anisotropic Gradient Noise
par: Pan, Rui, et autres
Publié: (2023)
par: Pan, Rui, et autres
Publié: (2023)
Natural Policy Gradient as Doubly Smoothed Policy Iteration: A Bellman-Operator Framework
par: Nanda, Phalguni, et autres
Publié: (2026)
par: Nanda, Phalguni, et autres
Publié: (2026)
Structure Matters: Dynamic Policy Gradient
par: Klein, Sara, et autres
Publié: (2024)
par: Klein, Sara, et autres
Publié: (2024)
Fast and Accurate Estimation of Low-Rank Matrices from Noisy Measurements via Preconditioned Non-Convex Gradient Descent
par: Zhang, Gavin, et autres
Publié: (2023)
par: Zhang, Gavin, et autres
Publié: (2023)
Delightful Policy Gradient
par: Osband, Ian
Publié: (2026)
par: Osband, Ian
Publié: (2026)
Analysis of On-policy Policy Gradient Methods under the Distribution Mismatch
par: Wang, Weizhen, et autres
Publié: (2025)
par: Wang, Weizhen, et autres
Publié: (2025)
More Optimal Fractional-Order Stochastic Gradient Descent for Non-Convex Optimization Problems
par: Partohaghighi, Mohammad, et autres
Publié: (2025)
par: Partohaghighi, Mohammad, et autres
Publié: (2025)
Gradient Estimation and Variance Reduction in Stochastic and Deterministic Models
par: Keane, Ronan
Publié: (2024)
par: Keane, Ronan
Publié: (2024)
Model-Free Output Feedback Stabilization via Policy Gradient Methods
par: Zhang, Ankang, et autres
Publié: (2026)
par: Zhang, Ankang, et autres
Publié: (2026)
Nonconvex Stochastic Optimization under Heavy-Tailed Noises: Optimal Convergence without Gradient Clipping
par: Liu, Zijian, et autres
Publié: (2024)
par: Liu, Zijian, et autres
Publié: (2024)
Convergence Analysis of Stochastic Gradient Descent with MCMC Estimators
par: Li, Tianyou, et autres
Publié: (2023)
par: Li, Tianyou, et autres
Publié: (2023)
Non-Euclidean Gradient Descent Operates at the Edge of Stability
par: Islamov, Rustem, et autres
Publié: (2026)
par: Islamov, Rustem, et autres
Publié: (2026)
Stochastic Non-Smooth Convex Optimization with Unbounded Gradients
par: Kovalev, Dmitry
Publié: (2026)
par: Kovalev, Dmitry
Publié: (2026)
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
par: Klein, Sara, et autres
Publié: (2023)
par: Klein, Sara, et autres
Publié: (2023)
On Convergence of Incremental Gradient for Non-Convex Smooth Functions
par: Koloskova, Anastasia, et autres
Publié: (2023)
par: Koloskova, Anastasia, et autres
Publié: (2023)
Trade-off in Estimating the Number of Byzantine Clients in Federated Learning
par: Chen, Ziyi, et autres
Publié: (2025)
par: Chen, Ziyi, et autres
Publié: (2025)
Delightful Distributed Policy Gradient
par: Osband, Ian
Publié: (2026)
par: Osband, Ian
Publié: (2026)
Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
par: Ding, Dongsheng, et autres
Publié: (2023)
par: Ding, Dongsheng, et autres
Publié: (2023)
Obtaining Lower Query Complexities through Lightweight Zeroth-Order Proximal Gradient Algorithms
par: Gu, Bin, et autres
Publié: (2024)
par: Gu, Bin, et autres
Publié: (2024)
Nonlinear Stochastic Gradient Descent and Heavy-tailed Noise: A Unified Framework and High-probability Guarantees
par: Armacki, Aleksandar, et autres
Publié: (2024)
par: Armacki, Aleksandar, et autres
Publié: (2024)
Clipped Gradient Methods for Nonsmooth Convex Optimization under Heavy-Tailed Noise: A Refined Analysis
par: Liu, Zijian
Publié: (2025)
par: Liu, Zijian
Publié: (2025)
Revisiting Gradient Normalization and Clipping for Nonconvex SGD under Heavy-Tailed Noise: Necessity, Sufficiency, and Acceleration
par: Sun, Tao, et autres
Publié: (2024)
par: Sun, Tao, et autres
Publié: (2024)
Scalable Bi-causal Optimal Transport via KL Relaxation and Policy Gradients
par: Cao, Haoyang, et autres
Publié: (2026)
par: Cao, Haoyang, et autres
Publié: (2026)
Accelerated Gradient Methods with Biased Gradient Estimates: Risk Sensitivity, High-Probability Guarantees, and Large Deviation Bounds
par: Gürbüzbalaban, Mert, et autres
Publié: (2025)
par: Gürbüzbalaban, Mert, et autres
Publié: (2025)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
par: Carmona, René, et autres
Publié: (2019)
par: Carmona, René, et autres
Publié: (2019)
Documents similaires
-
Riemannian Zeroth-Order Gradient Estimation with Structure-Preserving Metrics for Geodesically Incomplete Manifolds
par: Ma, Shaocong, et autres
Publié: (2026) -
Policy Gradient Converges to the Globally Optimal Policy for Nearly Linear-Quadratic Regulators
par: Han, Yinbin, et autres
Publié: (2023) -
On the Optimal Construction of Unbiased Gradient Estimators for Zeroth-Order Optimization
par: Ma, Shaocong, et autres
Publié: (2025) -
Parameter Symmetry and Noise Equilibrium of Stochastic Gradient Descent
par: Ziyin, Liu, et autres
Publié: (2024) -
Recurrent Natural Policy Gradient for POMDPs
par: Cayci, Semih, et autres
Publié: (2024)