Nesterov acceleration in benignly non-convex landscapes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gupta, Kanan, Wojtowytsch, Stephan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Nesterov acceleration despite very noisy gradients
par: Gupta, Kanan, et autres
Publié: (2023)
par: Gupta, Kanan, et autres
Publié: (2023)
EMA-Nesterov: Stabilizing Nesterov's Lookahead for Accelerated Deep Learning Optimization
par: Yau, Chung-Yiu, et autres
Publié: (2026)
par: Yau, Chung-Yiu, et autres
Publié: (2026)
Generalized Continuous-Time Models for Nesterov's Accelerated Gradient Methods
par: Park, Chanwoong, et autres
Publié: (2024)
par: Park, Chanwoong, et autres
Publié: (2024)
A Concise Lyapunov Analysis of Nesterov's Accelerated Gradient Method
par: Liu, Jun
Publié: (2025)
par: Liu, Jun
Publié: (2025)
Nesterov Acceleration for Ensemble Kalman Inversion and Variants
par: Vernon, Sydney, et autres
Publié: (2025)
par: Vernon, Sydney, et autres
Publié: (2025)
Adan: Adaptive Nesterov Momentum Algorithm for Faster Optimizing Deep Models
par: Xie, Xingyu, et autres
Publié: (2022)
par: Xie, Xingyu, et autres
Publié: (2022)
Nesterov Finds GRAAL: Optimal and Adaptive Gradient Method for Convex Optimization
par: Borodich, Ekaterina, et autres
Publié: (2025)
par: Borodich, Ekaterina, et autres
Publié: (2025)
Inference of Online Newton Methods with Nesterov's Accelerated Sketching
par: Wang, Haoxuan, et autres
Publié: (2026)
par: Wang, Haoxuan, et autres
Publié: (2026)
Provable Accelerated Convergence of Nesterov's Momentum for Deep ReLU Neural Networks
par: Liao, Fangshuo, et autres
Publié: (2023)
par: Liao, Fangshuo, et autres
Publié: (2023)
Muon with Nesterov Momentum: Heavy-Tailed Noise and (Randomized) Inexact Polar Decomposition
par: Choudhury, Sayantan, et autres
Publié: (2026)
par: Choudhury, Sayantan, et autres
Publié: (2026)
Provable Acceleration of Nesterov's Accelerated Gradient for Rectangular Matrix Factorization and Linear Neural Networks
par: Xu, Zhenghao, et autres
Publié: (2024)
par: Xu, Zhenghao, et autres
Publié: (2024)
Empirical and computer-aided robustness analysis of long-step and accelerated methods in smooth convex optimization
par: Vernimmen, Pierre, et autres
Publié: (2025)
par: Vernimmen, Pierre, et autres
Publié: (2025)
Nesterov acceleration for the Wasserstein minimization of displacement-convex free energies
par: Monmarché, Pierre
Publié: (2026)
par: Monmarché, Pierre
Publié: (2026)
YuriiFormer: A Suite of Nesterov-Accelerated Transformers
par: Zimin, Aleksandr, et autres
Publié: (2026)
par: Zimin, Aleksandr, et autres
Publié: (2026)
Study of the behaviour of Nesterov Accelerated Gradient in a non convex setting: the strongly quasar convex case
par: Hermant, Julien, et autres
Publié: (2024)
par: Hermant, Julien, et autres
Publié: (2024)
Linear convergence of forward-backward accelerated algorithms without knowledge of the modulus of strong convexity
par: Li, Bowen, et autres
Publié: (2023)
par: Li, Bowen, et autres
Publié: (2023)
Online Non-convex Optimization with Long-term Non-convex Constraints
par: Pan, Shijie, et autres
Publié: (2023)
par: Pan, Shijie, et autres
Publié: (2023)
A block-coordinate descent framework for non-convex composite optimization. Application to sparse precision matrix estimation
par: Lauga, Guillaume
Publié: (2026)
par: Lauga, Guillaume
Publié: (2026)
Cubic regularized subspace Newton for non-convex optimization
par: Zhao, Jim, et autres
Publié: (2024)
par: Zhao, Jim, et autres
Publié: (2024)
Tightening convex relaxations of trained neural networks: a unified approach for convex and S-shaped activations
par: Carrasco, Pablo, et autres
Publié: (2024)
par: Carrasco, Pablo, et autres
Publié: (2024)
Optimal Stochastic Non-smooth Non-convex Optimization through Online-to-Non-convex Conversion
par: Cutkosky, Ashok, et autres
Publié: (2023)
par: Cutkosky, Ashok, et autres
Publié: (2023)
A theoretical and empirical study of new adaptive algorithms with additional momentum steps and shifted updates for stochastic non-convex optimization
par: Alecsa, Cristian Daniel
Publié: (2021)
par: Alecsa, Cristian Daniel
Publié: (2021)
Non-geodesically-convex optimization in the Wasserstein space
par: Luu, Hoang Phuc Hau, et autres
Publié: (2024)
par: Luu, Hoang Phuc Hau, et autres
Publié: (2024)
Perceptrons and localization of attention's mean-field landscape
par: Álvarez-López, Antonio, et autres
Publié: (2026)
par: Álvarez-López, Antonio, et autres
Publié: (2026)
Provable Acceleration of Nesterov's Accelerated Gradient Method over Heavy Ball Method in Training Over-Parameterized Neural Networks
par: Liu, Xin, et autres
Publié: (2022)
par: Liu, Xin, et autres
Publié: (2022)
Non-convex Stochastic Composite Optimization with Polyak Momentum
par: Gao, Yuan, et autres
Publié: (2024)
par: Gao, Yuan, et autres
Publié: (2024)
Decentralized Non-convex Stochastic Optimization with Heterogeneous Variance
par: Chen, Hongxu, et autres
Publié: (2026)
par: Chen, Hongxu, et autres
Publié: (2026)
Learning based convex approximation for constrained parametric optimization
par: Liu, Kang, et autres
Publié: (2025)
par: Liu, Kang, et autres
Publié: (2025)
SGD with memory: fundamental properties and stochastic acceleration
par: Yarotsky, Dmitry, et autres
Publié: (2024)
par: Yarotsky, Dmitry, et autres
Publié: (2024)
Random Scaling and Momentum for Non-smooth Non-convex Optimization
par: Zhang, Qinzi, et autres
Publié: (2024)
par: Zhang, Qinzi, et autres
Publié: (2024)
Retraction-Free Decentralized Non-convex Optimization with Orthogonal Constraints
par: Sun, Youbang, et autres
Publié: (2024)
par: Sun, Youbang, et autres
Publié: (2024)
A simple and improved algorithm for noisy, convex, zeroth-order optimisation
par: Carpentier, Alexandra
Publié: (2024)
par: Carpentier, Alexandra
Publié: (2024)
Reinforcement learning for adaptive interior point methods in convex quadratic programming
par: Bertoncini, Jeremy, et autres
Publié: (2025)
par: Bertoncini, Jeremy, et autres
Publié: (2025)
Learning to accelerate distributed ADMM using graph neural networks
par: Doerks, Henri, et autres
Publié: (2025)
par: Doerks, Henri, et autres
Publié: (2025)
Riemannian Optimization for Non-convex Euclidean Distance Geometry with Global Recovery Guarantees
par: Smith, Chandler, et autres
Publié: (2024)
par: Smith, Chandler, et autres
Publié: (2024)
A simple uniformly optimal method without line search for convex optimization
par: Li, Tianjiao, et autres
Publié: (2023)
par: Li, Tianjiao, et autres
Publié: (2023)
A Stochastic Quasi-Newton Method for Non-convex Optimization with Non-uniform Smoothness
par: Sun, Zhenyu, et autres
Publié: (2024)
par: Sun, Zhenyu, et autres
Publié: (2024)
Learning to accelerate Krasnosel'skii-Mann fixed-point iterations with guarantees
par: Martin, Andrea, et autres
Publié: (2026)
par: Martin, Andrea, et autres
Publié: (2026)
Convergence Guarantees for RMSProp and Adam in Generalized-smooth Non-convex Optimization with Affine Noise Variance
par: Zhang, Qi, et autres
Publié: (2024)
par: Zhang, Qi, et autres
Publié: (2024)
An inexact Bregman proximal point method and its acceleration version for unbalanced optimal transport
par: Chen, Xiang, et autres
Publié: (2024)
par: Chen, Xiang, et autres
Publié: (2024)
Documents similaires
-
Nesterov acceleration despite very noisy gradients
par: Gupta, Kanan, et autres
Publié: (2023) -
EMA-Nesterov: Stabilizing Nesterov's Lookahead for Accelerated Deep Learning Optimization
par: Yau, Chung-Yiu, et autres
Publié: (2026) -
Generalized Continuous-Time Models for Nesterov's Accelerated Gradient Methods
par: Park, Chanwoong, et autres
Publié: (2024) -
A Concise Lyapunov Analysis of Nesterov's Accelerated Gradient Method
par: Liu, Jun
Publié: (2025) -
Nesterov Acceleration for Ensemble Kalman Inversion and Variants
par: Vernon, Sydney, et autres
Publié: (2025)