Robust Gradient Descent via Heavy-Ball Momentum with Predictive Extrapolation
Fuente:
arXiv
Guardado en:
| Autor principal: | Ali, Sarwan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
On the Generalization of Stochastic Gradient Descent with Momentum
por: Ramezani-Kebrya, Ali, et al.
Publicado: (2018)
por: Ramezani-Kebrya, Ali, et al.
Publicado: (2018)
DPSR: Differentially Private Sparse Reconstruction via Multi-Stage Denoising for Recommender Systems
por: Ali, Sarwan
Publicado: (2025)
por: Ali, Sarwan
Publicado: (2025)
Algorithmic Stability of Stochastic Gradient Descent with Momentum under Heavy-Tailed Noise
por: Dang, Thanh, et al.
Publicado: (2025)
por: Dang, Thanh, et al.
Publicado: (2025)
(Accelerated) Noise-adaptive Stochastic Heavy-Ball Momentum
por: Dang, Anh, et al.
Publicado: (2024)
por: Dang, Anh, et al.
Publicado: (2024)
Heavy-Ball Momentum Method in Continuous Time and Discretization Error Analysis
por: Lyu, Bochen, et al.
Publicado: (2025)
por: Lyu, Bochen, et al.
Publicado: (2025)
Explicit Path CGR: Maintaining Sequence Fidelity in Geometric Representations
por: Ali, Sarwan
Publicado: (2025)
por: Ali, Sarwan
Publicado: (2025)
Critical Windows of Complexity Control: When Transformers Decide to Reason or Memorize
por: Ali, Sarwan
Publicado: (2026)
por: Ali, Sarwan
Publicado: (2026)
Heavy-Ball Momentum Accelerated Actor-Critic With Function Approximation
por: Dong, Yanjie, et al.
Publicado: (2024)
por: Dong, Yanjie, et al.
Publicado: (2024)
Stochastic Gradient Descent with Momentum is Algorithmically Stable
por: Lei, Yunwen, et al.
Publicado: (2026)
por: Lei, Yunwen, et al.
Publicado: (2026)
Stochastic Normalized Gradient Descent with Momentum for Large-Batch Training
por: Zhao, Shen-Yi, et al.
Publicado: (2020)
por: Zhao, Shen-Yi, et al.
Publicado: (2020)
Continuous-Time Analysis of Heavy Ball Momentum in Min-Max Games
por: Feng, Yi, et al.
Publicado: (2025)
por: Feng, Yi, et al.
Publicado: (2025)
Multi-Scale Reversible Chaos Game Representation: A Unified Framework for Sequence Classification
por: Ali, Sarwan, et al.
Publicado: (2026)
por: Ali, Sarwan, et al.
Publicado: (2026)
Gradient Descent with Polyak's Momentum Finds Flatter Minima via Large Catapults
por: Phunyaphibarn, Prin, et al.
Publicado: (2023)
por: Phunyaphibarn, Prin, et al.
Publicado: (2023)
Improving Energy Natural Gradient Descent through Woodbury, Momentum, and Randomization
por: Guzmán-Cordero, Andrés, et al.
Publicado: (2025)
por: Guzmán-Cordero, Andrés, et al.
Publicado: (2025)
Increasing Batch Size Improves Convergence of Stochastic Gradient Descent with Momentum
por: Kamo, Keisuke, et al.
Publicado: (2025)
por: Kamo, Keisuke, et al.
Publicado: (2025)
Nonasymptotic Analysis of Stochastic Gradient Descent with the Richardson-Romberg Extrapolation
por: Sheshukova, Marina, et al.
Publicado: (2024)
por: Sheshukova, Marina, et al.
Publicado: (2024)
Adaptive Heavy-Tailed Stochastic Gradient Descent
por: Gong, Bodu, et al.
Publicado: (2025)
por: Gong, Bodu, et al.
Publicado: (2025)
Murmur2Vec: A Hashing Based Solution For Embedding Generation Of COVID-19 Spike Sequences
por: Ali, Sarwan, et al.
Publicado: (2025)
por: Ali, Sarwan, et al.
Publicado: (2025)
Momentum Does Not Reduce Stochastic Noise in Stochastic Gradient Descent
por: Sato, Naoki, et al.
Publicado: (2024)
por: Sato, Naoki, et al.
Publicado: (2024)
Communication-Efficient Heterogeneous Federated Learning with Generalized Heavy-Ball Momentum
por: Zaccone, Riccardo, et al.
Publicado: (2023)
por: Zaccone, Riccardo, et al.
Publicado: (2023)
Grams: Gradient Descent with Adaptive Momentum Scaling
por: Cao, Yang, et al.
Publicado: (2024)
por: Cao, Yang, et al.
Publicado: (2024)
Robust Gradient Descent for Phase Retrieval
por: Buna, Alex, et al.
Publicado: (2024)
por: Buna, Alex, et al.
Publicado: (2024)
Modified Loss of Momentum Gradient Descent: Fine-Grained Analysis
por: Cattaneo, Matias D., et al.
Publicado: (2025)
por: Cattaneo, Matias D., et al.
Publicado: (2025)
Accelerated Convergence of Stochastic Heavy Ball Method under Anisotropic Gradient Noise
por: Pan, Rui, et al.
Publicado: (2023)
por: Pan, Rui, et al.
Publicado: (2023)
First and Second Order Approximations to Stochastic Gradient Descent Methods with Momentum Terms
por: Lu, Eric
Publicado: (2025)
por: Lu, Eric
Publicado: (2025)
Sequence-to-Image Transformation for Sequence Classification Using Rips Complex Construction and Chaos Game Representation
por: Ali, Sarwan, et al.
Publicado: (2025)
por: Ali, Sarwan, et al.
Publicado: (2025)
Breaking the Euclidean Barrier: Hyperboloid-Based Biological Sequence Analysis
por: Ali, Sarwan, et al.
Publicado: (2025)
por: Ali, Sarwan, et al.
Publicado: (2025)
Stochastic Re-weighted Gradient Descent via Distributionally Robust Optimization
por: Kumar, Ramnath, et al.
Publicado: (2023)
por: Kumar, Ramnath, et al.
Publicado: (2023)
Parallel Momentum Methods Under Biased Gradient Estimations
por: Beikmohammadi, Ali, et al.
Publicado: (2024)
por: Beikmohammadi, Ali, et al.
Publicado: (2024)
Sequence Analysis Using the Bezier Curve
por: Murad, Taslim, et al.
Publicado: (2025)
por: Murad, Taslim, et al.
Publicado: (2025)
Egalitarian Gradient Descent: A Simple Approach to Accelerated Grokking
por: Pasand, Ali Saheb, et al.
Publicado: (2025)
por: Pasand, Ali Saheb, et al.
Publicado: (2025)
DWFL: Enhancing Federated Learning through Dynamic Weighted Averaging
por: Chourasia, Prakash, et al.
Publicado: (2024)
por: Chourasia, Prakash, et al.
Publicado: (2024)
Occam Gradient Descent
por: Kausik, B. N.
Publicado: (2024)
por: Kausik, B. N.
Publicado: (2024)
Expanding Chemical Representation with k-mers and Fragment-based Fingerprints for Molecular Fingerprinting
por: Ali, Sarwan, et al.
Publicado: (2024)
por: Ali, Sarwan, et al.
Publicado: (2024)
Measuring Learning Progress via Gradient-Momentum Coupling
por: Blad, Samuel, et al.
Publicado: (2026)
por: Blad, Samuel, et al.
Publicado: (2026)
Boosting t-SNE Efficiency for Sequencing Data: Insights from Kernel Selection
por: Jan, Avais, et al.
Publicado: (2025)
por: Jan, Avais, et al.
Publicado: (2025)
Gradient Extrapolation-Based Policy Optimization
por: Swapnil, Ismam Nur, et al.
Publicado: (2026)
por: Swapnil, Ismam Nur, et al.
Publicado: (2026)
Converting Time Series Data to Numeric Representations Using Alphabetic Mapping and k-mer strategy
por: Ali, Sarwan, et al.
Publicado: (2024)
por: Ali, Sarwan, et al.
Publicado: (2024)
Stacking as Accelerated Gradient Descent
por: Agarwal, Naman, et al.
Publicado: (2024)
por: Agarwal, Naman, et al.
Publicado: (2024)
Stochastic Adaptive Gradient Descent Without Descent
por: Aujol, Jean-François, et al.
Publicado: (2025)
por: Aujol, Jean-François, et al.
Publicado: (2025)
Ejemplares similares
-
On the Generalization of Stochastic Gradient Descent with Momentum
por: Ramezani-Kebrya, Ali, et al.
Publicado: (2018) -
DPSR: Differentially Private Sparse Reconstruction via Multi-Stage Denoising for Recommender Systems
por: Ali, Sarwan
Publicado: (2025) -
Algorithmic Stability of Stochastic Gradient Descent with Momentum under Heavy-Tailed Noise
por: Dang, Thanh, et al.
Publicado: (2025) -
(Accelerated) Noise-adaptive Stochastic Heavy-Ball Momentum
por: Dang, Anh, et al.
Publicado: (2024) -
Heavy-Ball Momentum Method in Continuous Time and Discretization Error Analysis
por: Lyu, Bochen, et al.
Publicado: (2025)