Gradient Descent with Provably Tuned Learning-rate Schedules
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Sharma, Dravyansh |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Tuning Algorithmic and Architectural Hyperparameters in Graph-Based Semi-Supervised Learning with Provable Guarantees
par: Du, Ally Yalei, et autres
Publié: (2025)
par: Du, Ally Yalei, et autres
Publié: (2025)
Provably tuning the ElasticNet across instances
par: Balcan, Maria-Florina, et autres
Publié: (2022)
par: Balcan, Maria-Florina, et autres
Publié: (2022)
Learning Provably Improves the Convergence of Gradient Descent
par: Song, Qingyu, et autres
Publié: (2025)
par: Song, Qingyu, et autres
Publié: (2025)
Distribution-dependent Generalization Bounds for Tuning Linear Regression Across Tasks
par: Balcan, Maria-Florina, et autres
Publié: (2025)
par: Balcan, Maria-Florina, et autres
Publié: (2025)
Learning accurate and interpretable tree-based models
par: Balcan, Maria-Florina, et autres
Publié: (2024)
par: Balcan, Maria-Florina, et autres
Publié: (2024)
Offline-to-online hyperparameter transfer for stochastic bandits
par: Sharma, Dravyansh, et autres
Publié: (2025)
par: Sharma, Dravyansh, et autres
Publié: (2025)
Product-Stability: Provable Convergence for Gradient Descent on the Edge of Stability
par: Gan, Eric
Publié: (2026)
par: Gan, Eric
Publié: (2026)
Conservative classifiers do consistently well with improving agents: characterizing statistical and online learning
par: Sharma, Dravyansh, et autres
Publié: (2025)
par: Sharma, Dravyansh, et autres
Publié: (2025)
Transformers Trained via Gradient Descent Can Provably Learn a Class of Teacher Models
par: Zhang, Chenyang, et autres
Publié: (2026)
par: Zhang, Chenyang, et autres
Publié: (2026)
Provably Faster Gradient Descent via Long Steps
par: Grimmer, Benjamin
Publié: (2023)
par: Grimmer, Benjamin
Publié: (2023)
On Learning Verifiers and Implications to Chain-of-Thought Reasoning
par: Balcan, Maria-Florina, et autres
Publié: (2025)
par: Balcan, Maria-Florina, et autres
Publié: (2025)
Provable Failure of Language Models in Learning Majority Boolean Logic via Gradient Descent
par: Chen, Bo, et autres
Publié: (2025)
par: Chen, Bo, et autres
Publié: (2025)
Armijo Line-search Can Make (Stochastic) Gradient Descent Provably Faster
par: Vaswani, Sharan, et autres
Publié: (2025)
par: Vaswani, Sharan, et autres
Publié: (2025)
Sample complexity of data-driven tuning of model hyperparameters in neural networks with structured parameter-dependent dual function
par: Balcan, Maria-Florina, et autres
Publié: (2025)
par: Balcan, Maria-Florina, et autres
Publié: (2025)
Algorithm Design and Stronger Guarantees for the Improving Multi-Armed Bandits Problem
par: Blum, Avrim, et autres
Publié: (2025)
par: Blum, Avrim, et autres
Publié: (2025)
Dynamic Scaled Gradient Descent for Stable Fine-Tuning for Classifications
par: Bui, Nghia, et autres
Publié: (2026)
par: Bui, Nghia, et autres
Publié: (2026)
Accelerating ERM for data-driven algorithm design using output-sensitive techniques
par: Balcan, Maria-Florina, et autres
Publié: (2022)
par: Balcan, Maria-Florina, et autres
Publié: (2022)
Generalization Guarantees on Data-Driven Tuning of Gradient Descent with Langevin Updates
par: Goyal, Saumya, et autres
Publié: (2026)
par: Goyal, Saumya, et autres
Publié: (2026)
Subsidy design for better social outcomes
par: Balcan, Maria-Florina, et autres
Publié: (2024)
par: Balcan, Maria-Florina, et autres
Publié: (2024)
Algorithm Configuration for Structured Pfaffian Settings
par: Balcan, Maria-Florina, et autres
Publié: (2024)
par: Balcan, Maria-Florina, et autres
Publié: (2024)
Distributed Gradient Descent for Functional Learning
par: Yu, Zhan, et autres
Publié: (2023)
par: Yu, Zhan, et autres
Publié: (2023)
Provable and Practical Online Learning Rate Adaptation with Hypergradient Descent
par: Chu, Ya-Chi, et autres
Publié: (2025)
par: Chu, Ya-Chi, et autres
Publié: (2025)
Multi-head Transformers Provably Learn Symbolic Multi-step Reasoning via Gradient Descent
par: Yang, Tong, et autres
Publié: (2025)
par: Yang, Tong, et autres
Publié: (2025)
Learning Tree-Based Models with Gradient Descent
par: Marton, Sascha
Publié: (2026)
par: Marton, Sascha
Publié: (2026)
Occam Gradient Descent
par: Kausik, B. N.
Publié: (2024)
par: Kausik, B. N.
Publié: (2024)
Fast and Provable Tensor-Train Format Tensor Completion via Precondtioned Riemannian Gradient Descent
par: Bian, Fengmiao, et autres
Publié: (2025)
par: Bian, Fengmiao, et autres
Publié: (2025)
Scrap Your Schedules with PopDescent
par: Pomalapally, Abhinav, et autres
Publié: (2023)
par: Pomalapally, Abhinav, et autres
Publié: (2023)
Learning Associative Memories with Gradient Descent
par: Cabannes, Vivien, et autres
Publié: (2024)
par: Cabannes, Vivien, et autres
Publié: (2024)
In-context Learning and Gradient Descent Revisited
par: Deutch, Gilad, et autres
Publié: (2023)
par: Deutch, Gilad, et autres
Publié: (2023)
Online Learnability of Chain-of-Thought Verifiers: Soundness and Completeness Trade-offs
par: Balcan, Maria-Florina, et autres
Publié: (2026)
par: Balcan, Maria-Florina, et autres
Publié: (2026)
Learning Curves of Stochastic Gradient Descent in Kernel Regression
par: Zhang, Haihan, et autres
Publié: (2025)
par: Zhang, Haihan, et autres
Publié: (2025)
Personalized Federated Learning with Exact Stochastic Gradient Descent
par: Nikoloutsopoulos, Sotirios, et autres
Publié: (2022)
par: Nikoloutsopoulos, Sotirios, et autres
Publié: (2022)
Towards Learning Stochastic Population Models by Gradient Descent
par: Kreikemeyer, Justin N., et autres
Publié: (2024)
par: Kreikemeyer, Justin N., et autres
Publié: (2024)
Partially Lazy Gradient Descent for Smoothed Online Learning
par: Mhaisen, Naram, et autres
Publié: (2026)
par: Mhaisen, Naram, et autres
Publié: (2026)
PAC Learning with Improvements
par: Attias, Idan, et autres
Publié: (2025)
par: Attias, Idan, et autres
Publié: (2025)
Block Coordinate Descent for Neural Networks Provably Finds Global Minima
par: Akiyama, Shunta
Publié: (2025)
par: Akiyama, Shunta
Publié: (2025)
Hybrid Coordinate Descent for Efficient Neural Network Learning Using Line Search and Gradient Descent
par: Hsiao, Yen-Che, et autres
Publié: (2024)
par: Hsiao, Yen-Che, et autres
Publié: (2024)
Stacking as Accelerated Gradient Descent
par: Agarwal, Naman, et autres
Publié: (2024)
par: Agarwal, Naman, et autres
Publié: (2024)
Stochastic Adaptive Gradient Descent Without Descent
par: Aujol, Jean-François, et autres
Publié: (2025)
par: Aujol, Jean-François, et autres
Publié: (2025)
Enhancing Fractional Gradient Descent with Learned Optimizers
par: Sobotka, Jan, et autres
Publié: (2025)
par: Sobotka, Jan, et autres
Publié: (2025)
Documents similaires
-
Tuning Algorithmic and Architectural Hyperparameters in Graph-Based Semi-Supervised Learning with Provable Guarantees
par: Du, Ally Yalei, et autres
Publié: (2025) -
Provably tuning the ElasticNet across instances
par: Balcan, Maria-Florina, et autres
Publié: (2022) -
Learning Provably Improves the Convergence of Gradient Descent
par: Song, Qingyu, et autres
Publié: (2025) -
Distribution-dependent Generalization Bounds for Tuning Linear Regression Across Tasks
par: Balcan, Maria-Florina, et autres
Publié: (2025) -
Learning accurate and interpretable tree-based models
par: Balcan, Maria-Florina, et autres
Publié: (2024)