Composing Optimized Stepsize Schedules for Gradient Descent
Fuente:
arXiv
Salvato in:
| Autori principali: | Grimmer, Benjamin, Shu, Kevin, Wang, Alex L. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Strengthened Conjecture on the Minimax Optimal Constant Stepsize for Gradient Descent
di: Grimmer, Benjamin, et al.
Pubblicazione: (2024)
di: Grimmer, Benjamin, et al.
Pubblicazione: (2024)
Accelerated Objective Gap and Gradient Norm Convergence for Gradient Descent via Long Steps
di: Grimmer, Benjamin, et al.
Pubblicazione: (2024)
di: Grimmer, Benjamin, et al.
Pubblicazione: (2024)
Accelerated Gradient Descent by Concatenation of Stepsize Schedules
di: Zhang, Zehao, et al.
Pubblicazione: (2024)
di: Zhang, Zehao, et al.
Pubblicazione: (2024)
Beyond Minimax Optimality: A Subgame Perfect Gradient Method
di: Grimmer, Benjamin, et al.
Pubblicazione: (2024)
di: Grimmer, Benjamin, et al.
Pubblicazione: (2024)
Provably Faster Gradient Descent via Long Steps
di: Grimmer, Benjamin
Pubblicazione: (2023)
di: Grimmer, Benjamin
Pubblicazione: (2023)
Subgame Perfect Methods in Nonsmooth Convex Optimization
di: Grimmer, Benjamin, et al.
Pubblicazione: (2025)
di: Grimmer, Benjamin, et al.
Pubblicazione: (2025)
Inexactly Smooth Performance Estimation and New Optimized Gradient Methods
di: Zoll, Aaron, et al.
Pubblicazione: (2026)
di: Zoll, Aaron, et al.
Pubblicazione: (2026)
Acceleration by Stepsize Hedging I: Multi-Step Descent and the Silver Stepsize Schedule
di: Altschuler, Jason M., et al.
Pubblicazione: (2023)
di: Altschuler, Jason M., et al.
Pubblicazione: (2023)
On Averaging and Extrapolation for Gradient Descent
di: Luner, Alan, et al.
Pubblicazione: (2024)
di: Luner, Alan, et al.
Pubblicazione: (2024)
Acceleration by Stepsize Hedging II: Silver Stepsize Schedule for Smooth Convex Optimization
di: Altschuler, Jason M., et al.
Pubblicazione: (2023)
di: Altschuler, Jason M., et al.
Pubblicazione: (2023)
Generalization of Silver Stepsize Schedule to Stochastic Optimization
di: Bai, Luwei, et al.
Pubblicazione: (2025)
di: Bai, Luwei, et al.
Pubblicazione: (2025)
A Practical Adaptive Subgame Perfect Gradient Method
di: Luner, Alan, et al.
Pubblicazione: (2025)
di: Luner, Alan, et al.
Pubblicazione: (2025)
Accelerating Proximal Gradient Descent via Silver Stepsizes
di: Bok, Jinho, et al.
Pubblicazione: (2024)
di: Bok, Jinho, et al.
Pubblicazione: (2024)
Stepsize Hedging: an Alternative Mechanism for Accelerating Gradient Descent
di: Altschuler, Jason M., et al.
Pubblicazione: (2026)
di: Altschuler, Jason M., et al.
Pubblicazione: (2026)
Det-CGD: Compressed Gradient Descent with Matrix Stepsizes for Non-Convex Optimization
di: Li, Hanmin, et al.
Pubblicazione: (2023)
di: Li, Hanmin, et al.
Pubblicazione: (2023)
Large Stepsize Gradient Descent for Non-Homogeneous Two-Layer Networks: Margin Improvement and Fast Optimization
di: Cai, Yuhang, et al.
Pubblicazione: (2024)
di: Cai, Yuhang, et al.
Pubblicazione: (2024)
Coupling-based Convergence Diagnostic and Stepsize Scheme for Stochastic Gradient Descent
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
Goldstein Stationarity in Lipschitz Constrained Optimization
di: Grimmer, Benjamin, et al.
Pubblicazione: (2023)
di: Grimmer, Benjamin, et al.
Pubblicazione: (2023)
Negative Stepsizes Make Gradient-Descent-Ascent Converge
di: Shugart, Henry, et al.
Pubblicazione: (2025)
di: Shugart, Henry, et al.
Pubblicazione: (2025)
Scalable Projection-Free Optimization Methods via MultiRadial Duality Theory
di: Samakhoana, Thabo, et al.
Pubblicazione: (2024)
di: Samakhoana, Thabo, et al.
Pubblicazione: (2024)
Lower Bounds for Linear Minimization Oracle Methods Optimizing over Strongly Convex Sets
di: Grimmer, Benjamin, et al.
Pubblicazione: (2026)
di: Grimmer, Benjamin, et al.
Pubblicazione: (2026)
First-Order Methods for Nonsmooth Nonconvex Functional Constrained Optimization with or without Slater Points
di: Jia, Zhichao, et al.
Pubblicazione: (2022)
di: Jia, Zhichao, et al.
Pubblicazione: (2022)
Block Acceleration Without Momentum: On Optimal Stepsizes of Block Gradient Descent for Least-Squares
di: Peng, Liangzu, et al.
Pubblicazione: (2024)
di: Peng, Liangzu, et al.
Pubblicazione: (2024)
Acceleration by Random Stepsizes: Hedging, Equalization, and the Arcsine Stepsize Schedule
di: Altschuler, Jason M., et al.
Pubblicazione: (2024)
di: Altschuler, Jason M., et al.
Pubblicazione: (2024)
Some Primal-Dual Theory for Subgradient Methods for Strongly Convex Optimization
di: Grimmer, Benjamin, et al.
Pubblicazione: (2023)
di: Grimmer, Benjamin, et al.
Pubblicazione: (2023)
Some Unified Theory for Variance Reduced Prox-Linear Methods
di: Wu, Yue, et al.
Pubblicazione: (2024)
di: Wu, Yue, et al.
Pubblicazione: (2024)
A Universally Optimal Primal-Dual Method for Minimizing Heterogeneous Compositions
di: Zoll, Aaron, et al.
Pubblicazione: (2025)
di: Zoll, Aaron, et al.
Pubblicazione: (2025)
The Optimal Smoothings of Sublinear Functions and Convex Cones
di: Samakhoana, Thabo, et al.
Pubblicazione: (2025)
di: Samakhoana, Thabo, et al.
Pubblicazione: (2025)
A Parameter-Free Restart Scheme with Only a Parallelizable $\log\log(1/ε)$ Overhead
di: Wu, Yue, et al.
Pubblicazione: (2026)
di: Wu, Yue, et al.
Pubblicazione: (2026)
Adaptive Stepsize Selection in Decentralized Convex Optimization
di: Kuruzov, Ilya, et al.
Pubblicazione: (2025)
di: Kuruzov, Ilya, et al.
Pubblicazione: (2025)
Projected Gradient Descent for Constrained Decision-Dependent Optimization
di: Wang, Zifan, et al.
Pubblicazione: (2025)
di: Wang, Zifan, et al.
Pubblicazione: (2025)
Generalized Stochastic Gradient Descent with Momentum Methods for Smooth Optimization
di: Wang, Zimeng, et al.
Pubblicazione: (2026)
di: Wang, Zimeng, et al.
Pubblicazione: (2026)
Gradient Descent for Convex and Smooth Noisy Optimization
di: Hu, Feifei, et al.
Pubblicazione: (2024)
di: Hu, Feifei, et al.
Pubblicazione: (2024)
AdGT: Decentralized Gradient Tracking with Tuning-free Per-Agent Stepsize
di: Ghaderyan, Diyako, et al.
Pubblicazione: (2025)
di: Ghaderyan, Diyako, et al.
Pubblicazione: (2025)
Adaptive Accelerated Gradient Descent Methods for Convex Optimization
di: Xu, Zeyi, et al.
Pubblicazione: (2026)
di: Xu, Zeyi, et al.
Pubblicazione: (2026)
Decentralized Relaxed Smooth Optimization with Gradient Descent Methods
di: Jiang, Zhanhong, et al.
Pubblicazione: (2025)
di: Jiang, Zhanhong, et al.
Pubblicazione: (2025)
Adaptive Polyak Stepsize with Level-value Adjustment for Distributed Optimization
di: Ouyang, Chen, et al.
Pubblicazione: (2026)
di: Ouyang, Chen, et al.
Pubblicazione: (2026)
Distributed Optimization and Learning for Automated Stepsize Selection with Finite Time Coordination
di: Rikos, Apostolos I., et al.
Pubblicazione: (2025)
di: Rikos, Apostolos I., et al.
Pubblicazione: (2025)
A Communication-Efficient Stochastic Gradient Descent Algorithm for Distributed Nonconvex Optimization
di: Xie, Antai, et al.
Pubblicazione: (2024)
di: Xie, Antai, et al.
Pubblicazione: (2024)
Natural Gradient Descent for Control
di: Esmzad, Ramin, et al.
Pubblicazione: (2025)
di: Esmzad, Ramin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Strengthened Conjecture on the Minimax Optimal Constant Stepsize for Gradient Descent
di: Grimmer, Benjamin, et al.
Pubblicazione: (2024) -
Accelerated Objective Gap and Gradient Norm Convergence for Gradient Descent via Long Steps
di: Grimmer, Benjamin, et al.
Pubblicazione: (2024) -
Accelerated Gradient Descent by Concatenation of Stepsize Schedules
di: Zhang, Zehao, et al.
Pubblicazione: (2024) -
Beyond Minimax Optimality: A Subgame Perfect Gradient Method
di: Grimmer, Benjamin, et al.
Pubblicazione: (2024) -
Provably Faster Gradient Descent via Long Steps
di: Grimmer, Benjamin
Pubblicazione: (2023)