Dimension-Independent Convergence of Underdamped Langevin Monte Carlo in KL Divergence
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Shiyuan, Di, Qiwei, Li, Xuheng, Gu, Quanquan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Unified Convergence Analysis for Score-Based Diffusion Models with Deterministic Samplers
von: Li, Runjia, et al.
Veröffentlicht: (2024)
von: Li, Runjia, et al.
Veröffentlicht: (2024)
Variance-Aware Feel-Good Thompson Sampling for Contextual Bandits
von: Li, Xuheng, et al.
Veröffentlicht: (2025)
von: Li, Xuheng, et al.
Veröffentlicht: (2025)
Understanding SGD with Exponential Moving Average: A Case Study in Linear Regression
von: Li, Xuheng, et al.
Veröffentlicht: (2025)
von: Li, Xuheng, et al.
Veröffentlicht: (2025)
Feel-Good Thompson Sampling for Contextual Dueling Bandits
von: Li, Xuheng, et al.
Veröffentlicht: (2024)
von: Li, Xuheng, et al.
Veröffentlicht: (2024)
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning
von: Di, Qiwei, et al.
Veröffentlicht: (2023)
von: Di, Qiwei, et al.
Veröffentlicht: (2023)
Convergence Properties of Natural Gradient Descent for Minimizing KL Divergence
von: Datar, Adwait, et al.
Veröffentlicht: (2025)
von: Datar, Adwait, et al.
Veröffentlicht: (2025)
Variance-Aware Regret Bounds for Stochastic Contextual Dueling Bandits
von: Di, Qiwei, et al.
Veröffentlicht: (2023)
von: Di, Qiwei, et al.
Veröffentlicht: (2023)
Constrained Sampling with Primal-Dual Langevin Monte Carlo
von: Chamon, Luiz F. O., et al.
Veröffentlicht: (2024)
von: Chamon, Luiz F. O., et al.
Veröffentlicht: (2024)
On the Convergence of Adaptive Gradient Methods for Nonconvex Optimization
von: Zhou, Dongruo, et al.
Veröffentlicht: (2018)
von: Zhou, Dongruo, et al.
Veröffentlicht: (2018)
Optimal Horizon-Free Reward-Free Exploration for Linear Mixture MDPs
von: Zhang, Junkai, et al.
Veröffentlicht: (2023)
von: Zhang, Junkai, et al.
Veröffentlicht: (2023)
Nearly Dimension-Independent Convergence of Mean-Field Black-Box Variational Inference
von: Kim, Kyurae, et al.
Veröffentlicht: (2025)
von: Kim, Kyurae, et al.
Veröffentlicht: (2025)
MARS-M: When Variance Reduction Meets Matrices
von: Liu, Yifeng, et al.
Veröffentlicht: (2025)
von: Liu, Yifeng, et al.
Veröffentlicht: (2025)
A Nearly Optimal and Low-Switching Algorithm for Reinforcement Learning with General Function Approximation
von: Zhao, Heyang, et al.
Veröffentlicht: (2023)
von: Zhao, Heyang, et al.
Veröffentlicht: (2023)
Global Convergence and Rich Feature Learning in $L$-Layer Infinite-Width Neural Networks under $μ$P Parametrization
von: Chen, Zixiang, et al.
Veröffentlicht: (2025)
von: Chen, Zixiang, et al.
Veröffentlicht: (2025)
Convergence of Stochastic Gradient Langevin Dynamics in the Lazy Training Regime
von: Oberweis, Noah, et al.
Veröffentlicht: (2025)
von: Oberweis, Noah, et al.
Veröffentlicht: (2025)
Mirror Mean-Field Langevin Dynamics
von: Gu, Anming, et al.
Veröffentlicht: (2025)
von: Gu, Anming, et al.
Veröffentlicht: (2025)
Enhancing Convergence of Decentralized Gradient Tracking under the KL Property
von: Chen, Xiaokai, et al.
Veröffentlicht: (2024)
von: Chen, Xiaokai, et al.
Veröffentlicht: (2024)
Provably Efficient Representation Selection in Low-rank Markov Decision Processes: From Online to Offline RL
von: Zhang, Weitong, et al.
Veröffentlicht: (2021)
von: Zhang, Weitong, et al.
Veröffentlicht: (2021)
Reverse Diffusion Monte Carlo
von: Huang, Xunpeng, et al.
Veröffentlicht: (2023)
von: Huang, Xunpeng, et al.
Veröffentlicht: (2023)
Divergence Results and Convergence of a Variance Reduced Version of ADAM
von: Wang, Ruiqi, et al.
Veröffentlicht: (2022)
von: Wang, Ruiqi, et al.
Veröffentlicht: (2022)
Matching the Statistical Query Lower Bound for $k$-Sparse Parity Problems with Sign Stochastic Gradient Descent
von: Kou, Yiwen, et al.
Veröffentlicht: (2024)
von: Kou, Yiwen, et al.
Veröffentlicht: (2024)
MARS: Unleashing the Power of Variance Reduction for Training Large Models
von: Yuan, Huizhuo, et al.
Veröffentlicht: (2024)
von: Yuan, Huizhuo, et al.
Veröffentlicht: (2024)
Projective Proximal Gradient Descent for A Class of Nonconvex Nonsmooth Optimization Problems: Fast Convergence Without Kurdyka-Lojasiewicz (KL) Property
von: Yang, Yingzhen, et al.
Veröffentlicht: (2023)
von: Yang, Yingzhen, et al.
Veröffentlicht: (2023)
A Neural Network Algorithm for KL Divergence Estimation with Quantitative Error Bounds
von: Foss, Mikil, et al.
Veröffentlicht: (2025)
von: Foss, Mikil, et al.
Veröffentlicht: (2025)
Towards Simple and Provable Parameter-Free Adaptive Gradient Methods
von: Tao, Yuanzhe, et al.
Veröffentlicht: (2024)
von: Tao, Yuanzhe, et al.
Veröffentlicht: (2024)
Convergence Error Analysis of Reflected Gradient Langevin Dynamics for Globally Optimizing Non-Convex Constrained Problems
von: Sato, Kanji, et al.
Veröffentlicht: (2022)
von: Sato, Kanji, et al.
Veröffentlicht: (2022)
On the Convergence of Min-Max Langevin Dynamics and Algorithm
von: Cai, Yang, et al.
Veröffentlicht: (2024)
von: Cai, Yang, et al.
Veröffentlicht: (2024)
Krylov Cubic Regularized Newton: A Subspace Second-Order Method with Dimension-Free Convergence Rate
von: Jiang, Ruichen, et al.
Veröffentlicht: (2024)
von: Jiang, Ruichen, et al.
Veröffentlicht: (2024)
Stochastic Gradient Langevin Dynamics with Variance Reduction
von: Huang, Zhishen, et al.
Veröffentlicht: (2021)
von: Huang, Zhishen, et al.
Veröffentlicht: (2021)
Generalized EXTRA stochastic gradient Langevin dynamics
von: Gurbuzbalaban, Mert, et al.
Veröffentlicht: (2024)
von: Gurbuzbalaban, Mert, et al.
Veröffentlicht: (2024)
Multi-level Monte-Carlo Gradient Methods for Stochastic Optimization with Biased Oracles
von: Hu, Yifan, et al.
Veröffentlicht: (2024)
von: Hu, Yifan, et al.
Veröffentlicht: (2024)
Faster Sampling without Isoperimetry via Diffusion-based Monte Carlo
von: Huang, Xunpeng, et al.
Veröffentlicht: (2024)
von: Huang, Xunpeng, et al.
Veröffentlicht: (2024)
Reinforcement Learning from Human Feedback with Active Queries
von: Ji, Kaixuan, et al.
Veröffentlicht: (2024)
von: Ji, Kaixuan, et al.
Veröffentlicht: (2024)
Symmetric Mean-field Langevin Dynamics for Distributional Minimax Problems
von: Kim, Juno, et al.
Veröffentlicht: (2023)
von: Kim, Juno, et al.
Veröffentlicht: (2023)
Linear Convergence of Independent Natural Policy Gradient in Games with Entropy Regularization
von: Sun, Youbang, et al.
Veröffentlicht: (2024)
von: Sun, Youbang, et al.
Veröffentlicht: (2024)
Scalable Bi-causal Optimal Transport via KL Relaxation and Policy Gradients
von: Cao, Haoyang, et al.
Veröffentlicht: (2026)
von: Cao, Haoyang, et al.
Veröffentlicht: (2026)
Towards An Unsupervised Learning Scheme for Efficiently Solving Parameterized Mixed-Integer Programs
von: Qu, Shiyuan, et al.
Veröffentlicht: (2024)
von: Qu, Shiyuan, et al.
Veröffentlicht: (2024)
Proximal Interacting Particle Langevin Algorithms
von: Encinar, Paula Cordero, et al.
Veröffentlicht: (2024)
von: Encinar, Paula Cordero, et al.
Veröffentlicht: (2024)
Gradient-Informed Monte Carlo Fine-Tuning of Diffusion Models for Low-Thrust Trajectory Design
von: Graebner, Jannik, et al.
Veröffentlicht: (2025)
von: Graebner, Jannik, et al.
Veröffentlicht: (2025)
Langevin Dynamics: A Unified Perspective on Optimization via Lyapunov Potentials
von: Chen, August Y., et al.
Veröffentlicht: (2024)
von: Chen, August Y., et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Unified Convergence Analysis for Score-Based Diffusion Models with Deterministic Samplers
von: Li, Runjia, et al.
Veröffentlicht: (2024) -
Variance-Aware Feel-Good Thompson Sampling for Contextual Bandits
von: Li, Xuheng, et al.
Veröffentlicht: (2025) -
Understanding SGD with Exponential Moving Average: A Case Study in Linear Regression
von: Li, Xuheng, et al.
Veröffentlicht: (2025) -
Feel-Good Thompson Sampling for Contextual Dueling Bandits
von: Li, Xuheng, et al.
Veröffentlicht: (2024) -
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning
von: Di, Qiwei, et al.
Veröffentlicht: (2023)