A Universal Banach--Bregman Framework for Stochastic Iterations: Unifying Stochastic Mirror Descent, Learning and LLM Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Johnny R., Mi, Xiaomei, Du, Gaoyuan, Sun, Qianyi, Wang, Shiqi, Li, Jiaxuan, Zhou, Wenhua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Carbon-Aware Compute--Power Scheduling for AI Data Centers with Microgrid Prosumer Operations
di: Zhang, Johnny R., et al.
Pubblicazione: (2026)
di: Zhang, Johnny R., et al.
Pubblicazione: (2026)
Taming Nonconvex Stochastic Mirror Descent with General Bregman Divergence
di: Fatkhullin, Ilyas, et al.
Pubblicazione: (2024)
di: Fatkhullin, Ilyas, et al.
Pubblicazione: (2024)
Stochastic Krasnosel skii-Mann Iterations in Banach Spaces with Bregman Distances
di: Sababe, Saeed Hashemi, et al.
Pubblicazione: (2025)
di: Sababe, Saeed Hashemi, et al.
Pubblicazione: (2025)
Stochastic MeanFlow Policies: One-Step Generative Control with Entropic Mirror Descent
di: Wang, Zeyuan, et al.
Pubblicazione: (2026)
di: Wang, Zeyuan, et al.
Pubblicazione: (2026)
Enhancing Stochastic Gradient Descent: A Unified Framework and Novel Acceleration Methods for Faster Convergence
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
Improving LLM General Preference Alignment via Optimistic Online Mirror Descent
di: Zhang, Yuheng, et al.
Pubblicazione: (2025)
di: Zhang, Yuheng, et al.
Pubblicazione: (2025)
Trustworthiness of Stochastic Gradient Descent in Distributed Learning
di: Li, Hongyang, et al.
Pubblicazione: (2024)
di: Li, Hongyang, et al.
Pubblicazione: (2024)
Learning in Log-Domain: Subthreshold Analog AI Accelerator Based on Stochastic Gradient Descent
di: Tageldeen, Momen K, et al.
Pubblicazione: (2025)
di: Tageldeen, Momen K, et al.
Pubblicazione: (2025)
Adaptive Heavy-Tailed Stochastic Gradient Descent
di: Gong, Bodu, et al.
Pubblicazione: (2025)
di: Gong, Bodu, et al.
Pubblicazione: (2025)
Stochastic Gradient Descent with Momentum is Algorithmically Stable
di: Lei, Yunwen, et al.
Pubblicazione: (2026)
di: Lei, Yunwen, et al.
Pubblicazione: (2026)
Efficient Online Mirror Descent Stochastic Approximation for Multi-Stage Stochastic Programming
di: Zhang, Junhui, et al.
Pubblicazione: (2025)
di: Zhang, Junhui, et al.
Pubblicazione: (2025)
Why Does Stochastic Gradient Descent Slow Down in Low-Precision Training?
di: Yun, Vincent-Daniel
Pubblicazione: (2025)
di: Yun, Vincent-Daniel
Pubblicazione: (2025)
Implicit Bias and Convergence of Matrix Stochastic Mirror Descent
di: Akhtiamov, Danil, et al.
Pubblicazione: (2026)
di: Akhtiamov, Danil, et al.
Pubblicazione: (2026)
Stochastic Mirror Descent for Convex Optimization with Consensus Constraints
di: Borovykh, Anastasia, et al.
Pubblicazione: (2022)
di: Borovykh, Anastasia, et al.
Pubblicazione: (2022)
Mirror Learning: A Unifying Framework of Policy Optimisation
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2022)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2022)
Policy Mirror Descent with Lookahead
di: Protopapas, Kimon, et al.
Pubblicazione: (2024)
di: Protopapas, Kimon, et al.
Pubblicazione: (2024)
Stochastic Mirror Descent under Iterate-Dependent Markov Noise: Analysis in the Asymptotic and Finite Time Regimes
di: Paul, Anik Kumar, et al.
Pubblicazione: (2026)
di: Paul, Anik Kumar, et al.
Pubblicazione: (2026)
Noise Balance and Stationary Distribution of Stochastic Gradient Descent
di: Ziyin, Liu, et al.
Pubblicazione: (2023)
di: Ziyin, Liu, et al.
Pubblicazione: (2023)
Can LLMs predict the convergence of Stochastic Gradient Descent?
di: Zekri, Oussama, et al.
Pubblicazione: (2024)
di: Zekri, Oussama, et al.
Pubblicazione: (2024)
Mirror Descent on Reproducing Kernel Banach Spaces
di: Kumar, Akash, et al.
Pubblicazione: (2024)
di: Kumar, Akash, et al.
Pubblicazione: (2024)
A Unified Variational Design of Predictive Mirror Descent in Convex Games under Stochastic Feedback
di: Pan, Yunian, et al.
Pubblicazione: (2026)
di: Pan, Yunian, et al.
Pubblicazione: (2026)
The Stochastic Steepest Descent Method for Robust Optimization in Banach Spaces
di: Chada, Neil K., et al.
Pubblicazione: (2023)
di: Chada, Neil K., et al.
Pubblicazione: (2023)
Stochastic Gradient Descent for Nonlinear Inverse Problems in Banach Spaces
di: Jin, Bangti, et al.
Pubblicazione: (2026)
di: Jin, Bangti, et al.
Pubblicazione: (2026)
The AI in the Mirror: LLM Self-Recognition in an Iterated Public Goods Game
di: Long, Olivia, et al.
Pubblicazione: (2025)
di: Long, Olivia, et al.
Pubblicazione: (2025)
Functional Acceleration for Policy Mirror Descent
di: Chelu, Veronica, et al.
Pubblicazione: (2024)
di: Chelu, Veronica, et al.
Pubblicazione: (2024)
Almost Bayesian: The Fractal Dynamics of Stochastic Gradient Descent
di: Hennick, Max, et al.
Pubblicazione: (2025)
di: Hennick, Max, et al.
Pubblicazione: (2025)
On the Convergence of (Stochastic) Gradient Descent for Kolmogorov--Arnold Networks
di: Gao, Yihang, et al.
Pubblicazione: (2024)
di: Gao, Yihang, et al.
Pubblicazione: (2024)
Mirror Descent for Stochastic Control Problems with Measure-valued Controls
di: Kerimkulov, Bekzhan, et al.
Pubblicazione: (2024)
di: Kerimkulov, Bekzhan, et al.
Pubblicazione: (2024)
Clarifying Shampoo: Adapting Spectral Descent to Stochasticity and the Parameter Trajectory
di: Eschenhagen, Runa, et al.
Pubblicazione: (2026)
di: Eschenhagen, Runa, et al.
Pubblicazione: (2026)
Connecting NTK and NNGP: A Unified Theoretical Framework for Wide Neural Network Learning Dynamics
di: Avidan, Yehonatan, et al.
Pubblicazione: (2023)
di: Avidan, Yehonatan, et al.
Pubblicazione: (2023)
Stochastic Quantum Hamiltonian Descent
di: Peng, Sirui, et al.
Pubblicazione: (2025)
di: Peng, Sirui, et al.
Pubblicazione: (2025)
Hybrid Approach to Parallel Stochastic Gradient Descent
di: Vora, Aakash Sudhirbhai, et al.
Pubblicazione: (2024)
di: Vora, Aakash Sudhirbhai, et al.
Pubblicazione: (2024)
Adaptive Online Mirror Descent for Tchebycheff Scalarization in Multi-Objective Learning
di: Liu, Meitong, et al.
Pubblicazione: (2024)
di: Liu, Meitong, et al.
Pubblicazione: (2024)
Stochastic Re-weighted Gradient Descent via Distributionally Robust Optimization
di: Kumar, Ramnath, et al.
Pubblicazione: (2023)
di: Kumar, Ramnath, et al.
Pubblicazione: (2023)
Unconstrained Stochastic CCA: Unifying Multiview and Self-Supervised Learning
di: Chapman, James, et al.
Pubblicazione: (2023)
di: Chapman, James, et al.
Pubblicazione: (2023)
Weighted Low-rank Approximation via Stochastic Gradient Descent on Manifolds
di: Xu, Conglong, et al.
Pubblicazione: (2025)
di: Xu, Conglong, et al.
Pubblicazione: (2025)
Convergence Rate Bounds for the Mirror Descent Method: IQCs, Popov Criterion and Bregman Divergence
di: Li, Mengmou, et al.
Pubblicazione: (2023)
di: Li, Mengmou, et al.
Pubblicazione: (2023)
PSMGD: Periodic Stochastic Multi-Gradient Descent for Fast Multi-Objective Optimization
di: Xu, Mingjing, et al.
Pubblicazione: (2024)
di: Xu, Mingjing, et al.
Pubblicazione: (2024)
Generation Properties of Stochastic Interpolation under Finite Training Set
di: Li, Yunchen, et al.
Pubblicazione: (2025)
di: Li, Yunchen, et al.
Pubblicazione: (2025)
Iteration and Stochastic First-order Oracle Complexities of Stochastic Gradient Descent using Constant and Decaying Learning Rates
di: Imaizumi, Kento, et al.
Pubblicazione: (2024)
di: Imaizumi, Kento, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Carbon-Aware Compute--Power Scheduling for AI Data Centers with Microgrid Prosumer Operations
di: Zhang, Johnny R., et al.
Pubblicazione: (2026) -
Taming Nonconvex Stochastic Mirror Descent with General Bregman Divergence
di: Fatkhullin, Ilyas, et al.
Pubblicazione: (2024) -
Stochastic Krasnosel skii-Mann Iterations in Banach Spaces with Bregman Distances
di: Sababe, Saeed Hashemi, et al.
Pubblicazione: (2025) -
Stochastic MeanFlow Policies: One-Step Generative Control with Entropic Mirror Descent
di: Wang, Zeyuan, et al.
Pubblicazione: (2026) -
Enhancing Stochastic Gradient Descent: A Unified Framework and Novel Acceleration Methods for Faster Convergence
di: Deng, Yichuan, et al.
Pubblicazione: (2024)