Improving Infinitely Deep Bayesian Neural Networks with Nesterov's Accelerated Gradient Method
Fuente:
arXiv
Salvato in:
| Autori principali: | Yu, Chenxu, Fang, Wenqi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Provable Acceleration of Nesterov's Accelerated Gradient for Rectangular Matrix Factorization and Linear Neural Networks
di: Xu, Zhenghao, et al.
Pubblicazione: (2024)
di: Xu, Zhenghao, et al.
Pubblicazione: (2024)
Provable Acceleration of Nesterov's Accelerated Gradient Method over Heavy Ball Method in Training Over-Parameterized Neural Networks
di: Liu, Xin, et al.
Pubblicazione: (2022)
di: Liu, Xin, et al.
Pubblicazione: (2022)
Generalized Continuous-Time Models for Nesterov's Accelerated Gradient Methods
di: Park, Chanwoong, et al.
Pubblicazione: (2024)
di: Park, Chanwoong, et al.
Pubblicazione: (2024)
A Concise Lyapunov Analysis of Nesterov's Accelerated Gradient Method
di: Liu, Jun
Pubblicazione: (2025)
di: Liu, Jun
Pubblicazione: (2025)
Provable Accelerated Convergence of Nesterov's Momentum for Deep ReLU Neural Networks
di: Liao, Fangshuo, et al.
Pubblicazione: (2023)
di: Liao, Fangshuo, et al.
Pubblicazione: (2023)
EMA-Nesterov: Stabilizing Nesterov's Lookahead for Accelerated Deep Learning Optimization
di: Yau, Chung-Yiu, et al.
Pubblicazione: (2026)
di: Yau, Chung-Yiu, et al.
Pubblicazione: (2026)
Accelerated Policy Gradient: On the Convergence Rates of the Nesterov Momentum for Reinforcement Learning
di: Chen, Yen-Ju, et al.
Pubblicazione: (2023)
di: Chen, Yen-Ju, et al.
Pubblicazione: (2023)
Partially Stochastic Infinitely Deep Bayesian Neural Networks
di: Calvo-Ordonez, Sergio, et al.
Pubblicazione: (2024)
di: Calvo-Ordonez, Sergio, et al.
Pubblicazione: (2024)
Inference of Online Newton Methods with Nesterov's Accelerated Sketching
di: Wang, Haoxuan, et al.
Pubblicazione: (2026)
di: Wang, Haoxuan, et al.
Pubblicazione: (2026)
Randomized Subspace Nesterov Accelerated Gradient
di: Omiya, Gaku, et al.
Pubblicazione: (2026)
di: Omiya, Gaku, et al.
Pubblicazione: (2026)
Nesterov Finds GRAAL: Optimal and Adaptive Gradient Method for Convex Optimization
di: Borodich, Ekaterina, et al.
Pubblicazione: (2025)
di: Borodich, Ekaterina, et al.
Pubblicazione: (2025)
Adaptive Nesterov Accelerated Distributional Deep Hedging for Efficient Volatility Risk Management
di: Zhao, Lei, et al.
Pubblicazione: (2025)
di: Zhao, Lei, et al.
Pubblicazione: (2025)
SNOO: Step-K Nesterov Outer Optimizer - The Surprising Effectiveness of Nesterov Momentum Applied to Pseudo-Gradients
di: Kallusky, Dominik, et al.
Pubblicazione: (2025)
di: Kallusky, Dominik, et al.
Pubblicazione: (2025)
Nesterov-Accelerated Robust Federated Learning Over Byzantine Adversaries
di: Xu, Lihan, et al.
Pubblicazione: (2025)
di: Xu, Lihan, et al.
Pubblicazione: (2025)
Nesterov Acceleration for Ensemble Kalman Inversion and Variants
di: Vernon, Sydney, et al.
Pubblicazione: (2025)
di: Vernon, Sydney, et al.
Pubblicazione: (2025)
Scaled Conjugate Gradient Method for Nonconvex Optimization in Deep Neural Networks
di: Sato, Naoki, et al.
Pubblicazione: (2024)
di: Sato, Naoki, et al.
Pubblicazione: (2024)
Functional Stochastic Gradient MCMC for Bayesian Neural Networks
di: Wu, Mengjing, et al.
Pubblicazione: (2024)
di: Wu, Mengjing, et al.
Pubblicazione: (2024)
YuriiFormer: A Suite of Nesterov-Accelerated Transformers
di: Zimin, Aleksandr, et al.
Pubblicazione: (2026)
di: Zimin, Aleksandr, et al.
Pubblicazione: (2026)
Towards Scalable Bayesian Optimization via Gradient-Informed Bayesian Neural Networks
di: Makrygiorgos, Georgios, et al.
Pubblicazione: (2025)
di: Makrygiorgos, Georgios, et al.
Pubblicazione: (2025)
MONA: Muon Optimizer with Nesterov Acceleration for Scalable Language Model Training
di: Li, Jiacheng, et al.
Pubblicazione: (2026)
di: Li, Jiacheng, et al.
Pubblicazione: (2026)
Nesterov Method for Asynchronous Pipeline Parallel Optimization
di: Ajanthan, Thalaiyasingam, et al.
Pubblicazione: (2025)
di: Ajanthan, Thalaiyasingam, et al.
Pubblicazione: (2025)
Improved Depth Estimation of Bayesian Neural Networks
di: van Erp, Bart, et al.
Pubblicazione: (2024)
di: van Erp, Bart, et al.
Pubblicazione: (2024)
DCP: Learning Accelerator Dataflow for Neural Network via Propagation
di: Xu, Peng, et al.
Pubblicazione: (2024)
di: Xu, Peng, et al.
Pubblicazione: (2024)
LION-DG: Layer-Informed Initialization with Deep Gradient Protocols for Accelerated Neural Network Training
di: Kim, Hyunjun
Pubblicazione: (2026)
di: Kim, Hyunjun
Pubblicazione: (2026)
Posterior Inference on Shallow Infinitely Wide Bayesian Neural Networks under Weights with Unbounded Variance
di: Loría, Jorge, et al.
Pubblicazione: (2023)
di: Loría, Jorge, et al.
Pubblicazione: (2023)
Variational Stochastic Gradient Descent for Deep Neural Networks
di: Chen, Haotian, et al.
Pubblicazione: (2024)
di: Chen, Haotian, et al.
Pubblicazione: (2024)
Adaptive Stepsizing for Stochastic Gradient Langevin Dynamics in Bayesian Neural Networks
di: Rajpal, Rajit, et al.
Pubblicazione: (2025)
di: Rajpal, Rajit, et al.
Pubblicazione: (2025)
Adan: Adaptive Nesterov Momentum Algorithm for Faster Optimizing Deep Models
di: Xie, Xingyu, et al.
Pubblicazione: (2022)
di: Xie, Xingyu, et al.
Pubblicazione: (2022)
On the Convergence of Locally Adaptive and Scalable Diffusion-Based Sampling Methods for Deep Bayesian Neural Network Posteriors
di: Rensmeyer, Tim, et al.
Pubblicazione: (2024)
di: Rensmeyer, Tim, et al.
Pubblicazione: (2024)
Adaptive Gradient Regularization: A Faster and Generalizable Optimization Technique for Deep Neural Networks
di: Jiang, Huixiu, et al.
Pubblicazione: (2024)
di: Jiang, Huixiu, et al.
Pubblicazione: (2024)
AdaDPIGU: Differentially Private SGD with Adaptive Clipping and Importance-Based Gradient Updates for Deep Neural Networks
di: Zhang, Huiqi, et al.
Pubblicazione: (2025)
di: Zhang, Huiqi, et al.
Pubblicazione: (2025)
Enhancing Deep Learning with Optimized Gradient Descent: Bridging Numerical Methods and Neural Network Training
di: Ma, Yuhan, et al.
Pubblicazione: (2024)
di: Ma, Yuhan, et al.
Pubblicazione: (2024)
TreeLUT: An Efficient Alternative to Deep Neural Networks for Inference Acceleration Using Gradient Boosted Decision Trees
di: Khataei, Alireza, et al.
Pubblicazione: (2025)
di: Khataei, Alireza, et al.
Pubblicazione: (2025)
Flexible Infinite-Width Graph Convolutional Neural Networks
di: Anson, Ben, et al.
Pubblicazione: (2024)
di: Anson, Ben, et al.
Pubblicazione: (2024)
Infinite Width Limits of Self Supervised Neural Networks
di: Fleissner, Maximilian, et al.
Pubblicazione: (2024)
di: Fleissner, Maximilian, et al.
Pubblicazione: (2024)
Improving Generalization of Deep Neural Networks by Optimum Shifting
di: Zhou, Yuyan, et al.
Pubblicazione: (2024)
di: Zhou, Yuyan, et al.
Pubblicazione: (2024)
NeuralGrok: Accelerate Grokking by Neural Gradient Transformation
di: Zhou, Xinyu, et al.
Pubblicazione: (2025)
di: Zhou, Xinyu, et al.
Pubblicazione: (2025)
Explaining Deep Neural Networks by Leveraging Intrinsic Methods
di: La Rosa, Biagio
Pubblicazione: (2024)
di: La Rosa, Biagio
Pubblicazione: (2024)
Sequential Bayesian Optimal Experimental Design in Infinite Dimensions via Policy Gradient Reinforcement Learning
di: Shen, Kaichen, et al.
Pubblicazione: (2026)
di: Shen, Kaichen, et al.
Pubblicazione: (2026)
Sharper Guarantees for Learning Neural Network Classifiers with Gradient Methods
di: Taheri, Hossein, et al.
Pubblicazione: (2024)
di: Taheri, Hossein, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Provable Acceleration of Nesterov's Accelerated Gradient for Rectangular Matrix Factorization and Linear Neural Networks
di: Xu, Zhenghao, et al.
Pubblicazione: (2024) -
Provable Acceleration of Nesterov's Accelerated Gradient Method over Heavy Ball Method in Training Over-Parameterized Neural Networks
di: Liu, Xin, et al.
Pubblicazione: (2022) -
Generalized Continuous-Time Models for Nesterov's Accelerated Gradient Methods
di: Park, Chanwoong, et al.
Pubblicazione: (2024) -
A Concise Lyapunov Analysis of Nesterov's Accelerated Gradient Method
di: Liu, Jun
Pubblicazione: (2025) -
Provable Accelerated Convergence of Nesterov's Momentum for Deep ReLU Neural Networks
di: Liao, Fangshuo, et al.
Pubblicazione: (2023)