Randomness Helps Rigor: A Probabilistic Learning Rate Scheduler Bridging Theory and Deep Learning Practice
Fuente:
arXiv
Salvato in:
| Autori principali: | Devapriya, Dahlia, Tholeti, Thulasi, Suresh, Janani, Kalyani, Sheetal |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Online waveform selection for cognitive radar
di: Tholeti, Thulasi, et al.
Pubblicazione: (2024)
di: Tholeti, Thulasi, et al.
Pubblicazione: (2024)
Geometry Aware Meta-Learning Neural Network for Joint Phase and Precoder Optimization in RIS
di: Devapriya, Dahlia, et al.
Pubblicazione: (2024)
di: Devapriya, Dahlia, et al.
Pubblicazione: (2024)
Structured Sparsity and Weight-adaptive Pruning for Memory and Compute efficient Whisper models
di: Mudi, Prasenjit K, et al.
Pubblicazione: (2025)
di: Mudi, Prasenjit K, et al.
Pubblicazione: (2025)
First line of defense: A robust first layer mitigates adversarial attacks
di: Suresh, Janani, et al.
Pubblicazione: (2024)
di: Suresh, Janani, et al.
Pubblicazione: (2024)
Learning Rate Optimization for Deep Neural Networks Using Lipschitz Bandits
di: Priyanka, Padma, et al.
Pubblicazione: (2024)
di: Priyanka, Padma, et al.
Pubblicazione: (2024)
Breaking the Script Barrier: Enabling Automatic Alignment for PoS-based ASR Error Analysis in Non-Latin Scripts
di: Mudi, Prasenjit K, et al.
Pubblicazione: (2026)
di: Mudi, Prasenjit K, et al.
Pubblicazione: (2026)
Golden Ratio Search: A Low-Power Adversarial Attack for Deep Learning based Modulation Classification
di: Sadhukhan, Deepsayan, et al.
Pubblicazione: (2024)
di: Sadhukhan, Deepsayan, et al.
Pubblicazione: (2024)
Tuning-Free Structured Sparse Recovery of Multiple Measurement Vectors using Implicit Regularization
di: Jayalal, Lakshmi, et al.
Pubblicazione: (2025)
di: Jayalal, Lakshmi, et al.
Pubblicazione: (2025)
Federated Learning of Binary Neural Networks: Enabling Low-Cost Inference
di: Shankar, Nitin Priyadarshini, et al.
Pubblicazione: (2026)
di: Shankar, Nitin Priyadarshini, et al.
Pubblicazione: (2026)
Tuning-Free Online Robust Principal Component Analysis through Implicit Regularization
di: Jayalal, Lakshmi, et al.
Pubblicazione: (2024)
di: Jayalal, Lakshmi, et al.
Pubblicazione: (2024)
Theory of Optimal Learning Rate Schedules and Scaling Laws for a Random Feature Model
di: Bordelon, Blake, et al.
Pubblicazione: (2026)
di: Bordelon, Blake, et al.
Pubblicazione: (2026)
Decoupled Relative Learning Rate Schedules
di: Ludziejewski, Jan, et al.
Pubblicazione: (2025)
di: Ludziejewski, Jan, et al.
Pubblicazione: (2025)
LoRanPAC: Low-rank Random Features and Pre-trained Models for Bridging Theory and Practice in Continual Learning
di: Peng, Liangzu, et al.
Pubblicazione: (2024)
di: Peng, Liangzu, et al.
Pubblicazione: (2024)
An Adaptive Volatility-based Learning Rate Scheduler
di: Ren, Kieran Chai Kai
Pubblicazione: (2025)
di: Ren, Kieran Chai Kai
Pubblicazione: (2025)
DRL-AdaPart: DRL-Driven Adaptive STAR-RIS Partitioning for Fair and Frugal Resource Utilization
di: Kumar, Ashok S., et al.
Pubblicazione: (2024)
di: Kumar, Ashok S., et al.
Pubblicazione: (2024)
Learning Rate Scheduling with Matrix Factorization for Private Training
di: Kalinin, Nikita P., et al.
Pubblicazione: (2025)
di: Kalinin, Nikita P., et al.
Pubblicazione: (2025)
Rigorous Probabilistic Guarantees for Robust Counterfactual Explanations
di: Marzari, Luca, et al.
Pubblicazione: (2024)
di: Marzari, Luca, et al.
Pubblicazione: (2024)
Learning Rate Schedules in the Presence of Distribution Shift
di: Fahrbach, Matthew, et al.
Pubblicazione: (2023)
di: Fahrbach, Matthew, et al.
Pubblicazione: (2023)
Random Matrix Theory for Deep Learning: Beyond Eigenvalues of Linear Models
di: Liao, Zhenyu, et al.
Pubblicazione: (2025)
di: Liao, Zhenyu, et al.
Pubblicazione: (2025)
ScheduleFree+: Scaling Learning-Rate-Free & Schedule-Free Learning to Large Language Models
di: Defazio, Aaron
Pubblicazione: (2026)
di: Defazio, Aaron
Pubblicazione: (2026)
The Surprising Agreement Between Convex Optimization Theory and Learning-Rate Scheduling for Large Model Training
di: Schaipp, Fabian, et al.
Pubblicazione: (2025)
di: Schaipp, Fabian, et al.
Pubblicazione: (2025)
Rigor with Machine Learning from Field Theory to the Poincaré Conjecture
di: Gukov, Sergei, et al.
Pubblicazione: (2024)
di: Gukov, Sergei, et al.
Pubblicazione: (2024)
Probabilistic Learning and Generation in Deep Sequence Models
di: Chen, Wenlong
Pubblicazione: (2026)
di: Chen, Wenlong
Pubblicazione: (2026)
Enhancing Accuracy in Deep Learning Using Random Matrix Theory
di: Berlyand, Leonid, et al.
Pubblicazione: (2023)
di: Berlyand, Leonid, et al.
Pubblicazione: (2023)
Textless NLP -- Zero Resource Challenge with Low Resource Compute
di: Ramadass, Krithiga, et al.
Pubblicazione: (2024)
di: Ramadass, Krithiga, et al.
Pubblicazione: (2024)
Cyclical Log Annealing as a Learning Rate Scheduler
di: Naveen, Philip
Pubblicazione: (2024)
di: Naveen, Philip
Pubblicazione: (2024)
Tractable Sharpness-Aware Learning of Probabilistic Circuits
di: Suresh, Hrithik, et al.
Pubblicazione: (2025)
di: Suresh, Hrithik, et al.
Pubblicazione: (2025)
Deep Nonlinear Hyperspectral Unmixing Using Multi-task Learning
di: Mehrdad, Saeid, et al.
Pubblicazione: (2024)
di: Mehrdad, Saeid, et al.
Pubblicazione: (2024)
Bridging RL Theory and Practice with the Effective Horizon
di: Laidlaw, Cassidy, et al.
Pubblicazione: (2023)
di: Laidlaw, Cassidy, et al.
Pubblicazione: (2023)
Bridging Theory and Practice: A Stochastic Learning-Optimization Model for Resilient Automotive Supply Chains
di: Shahnawaz, Muhammad, et al.
Pubblicazione: (2025)
di: Shahnawaz, Muhammad, et al.
Pubblicazione: (2025)
A Comprehensive Assessment Benchmark for Rigorously Evaluating Deep Learning Image Classifiers
di: Spratling, Michael W.
Pubblicazione: (2023)
di: Spratling, Michael W.
Pubblicazione: (2023)
Mapping Methane -- The Impact of Dairy Farm Practices on Emissions Through Satellite Data and Machine Learning
di: Bi, Hanqing, et al.
Pubblicazione: (2024)
di: Bi, Hanqing, et al.
Pubblicazione: (2024)
Power Scheduler: A Batch Size and Token Number Agnostic Learning Rate Scheduler
di: Shen, Yikang, et al.
Pubblicazione: (2024)
di: Shen, Yikang, et al.
Pubblicazione: (2024)
Dynamic Learning Rate for Deep Reinforcement Learning: A Bandit Approach
di: Donâncio, Henrique, et al.
Pubblicazione: (2024)
di: Donâncio, Henrique, et al.
Pubblicazione: (2024)
A Theory of Generalization in Deep Learning
di: Litman, Elon, et al.
Pubblicazione: (2026)
di: Litman, Elon, et al.
Pubblicazione: (2026)
Optimal Linear Decay Learning Rate Schedules and Further Refinements
di: Defazio, Aaron, et al.
Pubblicazione: (2023)
di: Defazio, Aaron, et al.
Pubblicazione: (2023)
Functional Scaling Laws in Kernel Regression: Loss Dynamics and Learning Rate Schedules
di: Li, Binghui, et al.
Pubblicazione: (2025)
di: Li, Binghui, et al.
Pubblicazione: (2025)
Cumulative Learning Rate Adaptation: Revisiting Path-Based Schedules for SGD and Adam
di: Atamna, Asma, et al.
Pubblicazione: (2025)
di: Atamna, Asma, et al.
Pubblicazione: (2025)
Probabilistic Robustness in Deep Learning: A Concise yet Comprehensive Guide
di: Zhao, Xingyu
Pubblicazione: (2025)
di: Zhao, Xingyu
Pubblicazione: (2025)
Synthesising Activity Participations and Scheduling with Deep Generative Machine Learning
di: Shone, Fred, et al.
Pubblicazione: (2025)
di: Shone, Fred, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Online waveform selection for cognitive radar
di: Tholeti, Thulasi, et al.
Pubblicazione: (2024) -
Geometry Aware Meta-Learning Neural Network for Joint Phase and Precoder Optimization in RIS
di: Devapriya, Dahlia, et al.
Pubblicazione: (2024) -
Structured Sparsity and Weight-adaptive Pruning for Memory and Compute efficient Whisper models
di: Mudi, Prasenjit K, et al.
Pubblicazione: (2025) -
First line of defense: A robust first layer mitigates adversarial attacks
di: Suresh, Janani, et al.
Pubblicazione: (2024) -
Learning Rate Optimization for Deep Neural Networks Using Lipschitz Bandits
di: Priyanka, Padma, et al.
Pubblicazione: (2024)