Robust Gradient Descent via Heavy-Ball Momentum with Predictive Extrapolation
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Ali, Sarwan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the Generalization of Stochastic Gradient Descent with Momentum
par: Ramezani-Kebrya, Ali, et autres
Publié: (2018)
par: Ramezani-Kebrya, Ali, et autres
Publié: (2018)
DPSR: Differentially Private Sparse Reconstruction via Multi-Stage Denoising for Recommender Systems
par: Ali, Sarwan
Publié: (2025)
par: Ali, Sarwan
Publié: (2025)
Algorithmic Stability of Stochastic Gradient Descent with Momentum under Heavy-Tailed Noise
par: Dang, Thanh, et autres
Publié: (2025)
par: Dang, Thanh, et autres
Publié: (2025)
(Accelerated) Noise-adaptive Stochastic Heavy-Ball Momentum
par: Dang, Anh, et autres
Publié: (2024)
par: Dang, Anh, et autres
Publié: (2024)
Heavy-Ball Momentum Method in Continuous Time and Discretization Error Analysis
par: Lyu, Bochen, et autres
Publié: (2025)
par: Lyu, Bochen, et autres
Publié: (2025)
Explicit Path CGR: Maintaining Sequence Fidelity in Geometric Representations
par: Ali, Sarwan
Publié: (2025)
par: Ali, Sarwan
Publié: (2025)
Critical Windows of Complexity Control: When Transformers Decide to Reason or Memorize
par: Ali, Sarwan
Publié: (2026)
par: Ali, Sarwan
Publié: (2026)
Heavy-Ball Momentum Accelerated Actor-Critic With Function Approximation
par: Dong, Yanjie, et autres
Publié: (2024)
par: Dong, Yanjie, et autres
Publié: (2024)
Stochastic Gradient Descent with Momentum is Algorithmically Stable
par: Lei, Yunwen, et autres
Publié: (2026)
par: Lei, Yunwen, et autres
Publié: (2026)
Stochastic Normalized Gradient Descent with Momentum for Large-Batch Training
par: Zhao, Shen-Yi, et autres
Publié: (2020)
par: Zhao, Shen-Yi, et autres
Publié: (2020)
Continuous-Time Analysis of Heavy Ball Momentum in Min-Max Games
par: Feng, Yi, et autres
Publié: (2025)
par: Feng, Yi, et autres
Publié: (2025)
Multi-Scale Reversible Chaos Game Representation: A Unified Framework for Sequence Classification
par: Ali, Sarwan, et autres
Publié: (2026)
par: Ali, Sarwan, et autres
Publié: (2026)
Gradient Descent with Polyak's Momentum Finds Flatter Minima via Large Catapults
par: Phunyaphibarn, Prin, et autres
Publié: (2023)
par: Phunyaphibarn, Prin, et autres
Publié: (2023)
Improving Energy Natural Gradient Descent through Woodbury, Momentum, and Randomization
par: Guzmán-Cordero, Andrés, et autres
Publié: (2025)
par: Guzmán-Cordero, Andrés, et autres
Publié: (2025)
Increasing Batch Size Improves Convergence of Stochastic Gradient Descent with Momentum
par: Kamo, Keisuke, et autres
Publié: (2025)
par: Kamo, Keisuke, et autres
Publié: (2025)
Nonasymptotic Analysis of Stochastic Gradient Descent with the Richardson-Romberg Extrapolation
par: Sheshukova, Marina, et autres
Publié: (2024)
par: Sheshukova, Marina, et autres
Publié: (2024)
Adaptive Heavy-Tailed Stochastic Gradient Descent
par: Gong, Bodu, et autres
Publié: (2025)
par: Gong, Bodu, et autres
Publié: (2025)
Murmur2Vec: A Hashing Based Solution For Embedding Generation Of COVID-19 Spike Sequences
par: Ali, Sarwan, et autres
Publié: (2025)
par: Ali, Sarwan, et autres
Publié: (2025)
Momentum Does Not Reduce Stochastic Noise in Stochastic Gradient Descent
par: Sato, Naoki, et autres
Publié: (2024)
par: Sato, Naoki, et autres
Publié: (2024)
Communication-Efficient Heterogeneous Federated Learning with Generalized Heavy-Ball Momentum
par: Zaccone, Riccardo, et autres
Publié: (2023)
par: Zaccone, Riccardo, et autres
Publié: (2023)
Grams: Gradient Descent with Adaptive Momentum Scaling
par: Cao, Yang, et autres
Publié: (2024)
par: Cao, Yang, et autres
Publié: (2024)
Robust Gradient Descent for Phase Retrieval
par: Buna, Alex, et autres
Publié: (2024)
par: Buna, Alex, et autres
Publié: (2024)
Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis
par: Cattaneo, Matias D., et autres
Publié: (2025)
par: Cattaneo, Matias D., et autres
Publié: (2025)
Accelerated Convergence of Stochastic Heavy Ball Method under Anisotropic Gradient Noise
par: Pan, Rui, et autres
Publié: (2023)
par: Pan, Rui, et autres
Publié: (2023)
First and Second Order Approximations to Stochastic Gradient Descent Methods with Momentum Terms
par: Lu, Eric
Publié: (2025)
par: Lu, Eric
Publié: (2025)
Sequence-to-Image Transformation for Sequence Classification Using Rips Complex Construction and Chaos Game Representation
par: Ali, Sarwan, et autres
Publié: (2025)
par: Ali, Sarwan, et autres
Publié: (2025)
Breaking the Euclidean Barrier: Hyperboloid-Based Biological Sequence Analysis
par: Ali, Sarwan, et autres
Publié: (2025)
par: Ali, Sarwan, et autres
Publié: (2025)
Stochastic Re-weighted Gradient Descent via Distributionally Robust Optimization
par: Kumar, Ramnath, et autres
Publié: (2023)
par: Kumar, Ramnath, et autres
Publié: (2023)
Parallel Momentum Methods Under Biased Gradient Estimations
par: Beikmohammadi, Ali, et autres
Publié: (2024)
par: Beikmohammadi, Ali, et autres
Publié: (2024)
Sequence Analysis Using the Bezier Curve
par: Murad, Taslim, et autres
Publié: (2025)
par: Murad, Taslim, et autres
Publié: (2025)
Egalitarian Gradient Descent: A Simple Approach to Accelerated Grokking
par: Pasand, Ali Saheb, et autres
Publié: (2025)
par: Pasand, Ali Saheb, et autres
Publié: (2025)
DWFL: Enhancing Federated Learning through Dynamic Weighted Averaging
par: Chourasia, Prakash, et autres
Publié: (2024)
par: Chourasia, Prakash, et autres
Publié: (2024)
Occam Gradient Descent
par: Kausik, B. N.
Publié: (2024)
par: Kausik, B. N.
Publié: (2024)
Expanding Chemical Representation with k-mers and Fragment-based Fingerprints for Molecular Fingerprinting
par: Ali, Sarwan, et autres
Publié: (2024)
par: Ali, Sarwan, et autres
Publié: (2024)
Measuring Learning Progress via Gradient-Momentum Coupling
par: Blad, Samuel, et autres
Publié: (2026)
par: Blad, Samuel, et autres
Publié: (2026)
Boosting t-SNE Efficiency for Sequencing Data: Insights from Kernel Selection
par: Jan, Avais, et autres
Publié: (2025)
par: Jan, Avais, et autres
Publié: (2025)
Gradient Extrapolation-Based Policy Optimization
par: Swapnil, Ismam Nur, et autres
Publié: (2026)
par: Swapnil, Ismam Nur, et autres
Publié: (2026)
Converting Time Series Data to Numeric Representations Using Alphabetic Mapping and k-mer strategy
par: Ali, Sarwan, et autres
Publié: (2024)
par: Ali, Sarwan, et autres
Publié: (2024)
Stacking as Accelerated Gradient Descent
par: Agarwal, Naman, et autres
Publié: (2024)
par: Agarwal, Naman, et autres
Publié: (2024)
Stochastic Adaptive Gradient Descent Without Descent
par: Aujol, Jean-François, et autres
Publié: (2025)
par: Aujol, Jean-François, et autres
Publié: (2025)
Documents similaires
-
On the Generalization of Stochastic Gradient Descent with Momentum
par: Ramezani-Kebrya, Ali, et autres
Publié: (2018) -
DPSR: Differentially Private Sparse Reconstruction via Multi-Stage Denoising for Recommender Systems
par: Ali, Sarwan
Publié: (2025) -
Algorithmic Stability of Stochastic Gradient Descent with Momentum under Heavy-Tailed Noise
par: Dang, Thanh, et autres
Publié: (2025) -
(Accelerated) Noise-adaptive Stochastic Heavy-Ball Momentum
par: Dang, Anh, et autres
Publié: (2024) -
Heavy-Ball Momentum Method in Continuous Time and Discretization Error Analysis
par: Lyu, Bochen, et autres
Publié: (2025)