Almost Bayesian: The Fractal Dynamics of Stochastic Gradient Descent
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hennick, Max, De Baerdemacker, Stijn |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the Convergence of (Stochastic) Gradient Descent for Kolmogorov--Arnold Networks
par: Gao, Yihang, et autres
Publié: (2024)
par: Gao, Yihang, et autres
Publié: (2024)
Weighted Low-rank Approximation via Stochastic Gradient Descent on Manifolds
par: Xu, Conglong, et autres
Publié: (2025)
par: Xu, Conglong, et autres
Publié: (2025)
Enhancing Stochastic Gradient Descent: A Unified Framework and Novel Acceleration Methods for Faster Convergence
par: Deng, Yichuan, et autres
Publié: (2024)
par: Deng, Yichuan, et autres
Publié: (2024)
Gradient Descent Efficiency Index
par: Dhingra, Aviral
Publié: (2024)
par: Dhingra, Aviral
Publié: (2024)
Finite-Time Analysis of Gradient Descent for Shallow Transformers
par: Arda, Enes, et autres
Publié: (2026)
par: Arda, Enes, et autres
Publié: (2026)
Rod Flow: A Continuous-Time Model for Gradient Descent at the Edge of Stability
par: Regis, Eric, et autres
Publié: (2026)
par: Regis, Eric, et autres
Publié: (2026)
A Minimalist Bayesian Framework for Stochastic Optimization
par: Wang, Kaizheng
Publié: (2025)
par: Wang, Kaizheng
Publié: (2025)
Stochastic Adaptive Gradient Descent Without Descent
par: Aujol, Jean-François, et autres
Publié: (2025)
par: Aujol, Jean-François, et autres
Publié: (2025)
Grams: Gradient Descent with Adaptive Momentum Scaling
par: Cao, Yang, et autres
Publié: (2024)
par: Cao, Yang, et autres
Publié: (2024)
Jacobian Descent for Multi-Objective Optimization
par: Quinton, Pierre, et autres
Publié: (2024)
par: Quinton, Pierre, et autres
Publié: (2024)
Stochastic Gradient Descent with Strategic Querying
par: Jiang, Nanfei, et autres
Publié: (2025)
par: Jiang, Nanfei, et autres
Publié: (2025)
Stochastic Gradient Descent with Adaptive Data
par: Che, Ethan, et autres
Publié: (2024)
par: Che, Ethan, et autres
Publié: (2024)
Momentum Does Not Reduce Stochastic Noise in Stochastic Gradient Descent
par: Sato, Naoki, et autres
Publié: (2024)
par: Sato, Naoki, et autres
Publié: (2024)
Multi-head Transformers Provably Learn Symbolic Multi-step Reasoning via Gradient Descent
par: Yang, Tong, et autres
Publié: (2025)
par: Yang, Tong, et autres
Publié: (2025)
Derivatives of Stochastic Gradient Descent in parametric optimization
par: Iutzeler, Franck, et autres
Publié: (2024)
par: Iutzeler, Franck, et autres
Publié: (2024)
A Single-Loop Gradient Descent and Perturbed Ascent Algorithm for Nonconvex Functional Constrained Optimization
par: Lu, Songtao
Publié: (2022)
par: Lu, Songtao
Publié: (2022)
FastPart: Over-Parameterized Stochastic Gradient Descent for Sparse optimisation on Measures
par: De Castro, Yohann, et autres
Publié: (2023)
par: De Castro, Yohann, et autres
Publié: (2023)
Convergence Analysis of Stochastic Gradient Descent with MCMC Estimators
par: Li, Tianyou, et autres
Publié: (2023)
par: Li, Tianyou, et autres
Publié: (2023)
The Sample Complexity of Gradient Descent in Stochastic Convex Optimization
par: Livni, Roi
Publié: (2024)
par: Livni, Roi
Publié: (2024)
Adaptive Step Sizes for Preconditioned Stochastic Gradient Descent
par: Köhne, Frederik, et autres
Publié: (2023)
par: Köhne, Frederik, et autres
Publié: (2023)
Functional Central Limit Theorem for Stochastic Gradient Descent
par: Flamand, Kessang, et autres
Publié: (2026)
par: Flamand, Kessang, et autres
Publié: (2026)
Parameter Symmetry and Noise Equilibrium of Stochastic Gradient Descent
par: Ziyin, Liu, et autres
Publié: (2024)
par: Ziyin, Liu, et autres
Publié: (2024)
Stability of Primal-Dual Gradient Flow Dynamics for Multi-Block Convex Optimization Problems
par: Ozaslan, Ibrahim K., et autres
Publié: (2024)
par: Ozaslan, Ibrahim K., et autres
Publié: (2024)
Delightful Policy Gradient
par: Osband, Ian
Publié: (2026)
par: Osband, Ian
Publié: (2026)
Rapid Overfitting of Multi-Pass Stochastic Gradient Descent in Stochastic Convex Optimization
par: Vansover-Hager, Shira, et autres
Publié: (2025)
par: Vansover-Hager, Shira, et autres
Publié: (2025)
Robust Control with Gradient Uncertainty
par: Qi, Qian
Publié: (2025)
par: Qi, Qian
Publié: (2025)
Delightful Distributed Policy Gradient
par: Osband, Ian
Publié: (2026)
par: Osband, Ian
Publié: (2026)
Unraveling the Gradient Descent Dynamics of Transformers
par: Song, Bingqing, et autres
Publié: (2024)
par: Song, Bingqing, et autres
Publié: (2024)
Almost Sure Convergence Analysis of Differentially Private Stochastic Gradient Methods
par: Mukherjee, Amartya, et autres
Publié: (2025)
par: Mukherjee, Amartya, et autres
Publié: (2025)
Asynchronous Distributed Reinforcement Learning for LQR Control via Zeroth-Order Block Coordinate Descent
par: Jing, Gangshan, et autres
Publié: (2021)
par: Jing, Gangshan, et autres
Publié: (2021)
Exponential Convergence of (Stochastic) Gradient Descent for Separable Logistic Regression
par: Kale, Sacchit, et autres
Publié: (2026)
par: Kale, Sacchit, et autres
Publié: (2026)
Faster Convergence of Stochastic Accelerated Gradient Descent under Interpolation
par: Mishkin, Aaron, et autres
Publié: (2024)
par: Mishkin, Aaron, et autres
Publié: (2024)
On the Convergence of Stochastic Gradient Descent with Perturbed Forward-Backward Passes
par: Kong, Boao, et autres
Publié: (2026)
par: Kong, Boao, et autres
Publié: (2026)
Unbiased Gradient Low-Rank Projection
par: Pan, Rui, et autres
Publié: (2025)
par: Pan, Rui, et autres
Publié: (2025)
SGD at the Edge of Stability: The Stochastic Sharpness Gap
par: Liao, Fangshuo, et autres
Publié: (2026)
par: Liao, Fangshuo, et autres
Publié: (2026)
Performative Policy Gradient: Optimality in Performative Reinforcement Learning
par: Basu, Debabrota, et autres
Publié: (2025)
par: Basu, Debabrota, et autres
Publié: (2025)
Boosting Gradient Ascent for Continuous DR-submodular Maximization
par: Zhang, Qixin, et autres
Publié: (2024)
par: Zhang, Qixin, et autres
Publié: (2024)
Riemann Sum Optimization for Accurate Integrated Gradients Computation
par: Swain, Swadesh, et autres
Publié: (2024)
par: Swain, Swadesh, et autres
Publié: (2024)
Understanding Sampler Stochasticity in Training Diffusion Models for RLHF
par: Sheng, Jiayuan, et autres
Publié: (2025)
par: Sheng, Jiayuan, et autres
Publié: (2025)
Stochastic Optimization of Inventory at Large-scale Supply Chains
par: Jin, Zhaoyang Larry, et autres
Publié: (2025)
par: Jin, Zhaoyang Larry, et autres
Publié: (2025)
Documents similaires
-
On the Convergence of (Stochastic) Gradient Descent for Kolmogorov--Arnold Networks
par: Gao, Yihang, et autres
Publié: (2024) -
Weighted Low-rank Approximation via Stochastic Gradient Descent on Manifolds
par: Xu, Conglong, et autres
Publié: (2025) -
Enhancing Stochastic Gradient Descent: A Unified Framework and Novel Acceleration Methods for Faster Convergence
par: Deng, Yichuan, et autres
Publié: (2024) -
Gradient Descent Efficiency Index
par: Dhingra, Aviral
Publié: (2024) -
Finite-Time Analysis of Gradient Descent for Shallow Transformers
par: Arda, Enes, et autres
Publié: (2026)