Generalization Bounds of Stochastic Gradient Descent in Homogeneous Neural Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Ma, Wenquan, Sui, Yang, Teng, Jiaye, Wang, Bohan, Xu, Jing, Yang, Jingqin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Theoretical Analysis of Sparse Optimization with Reparameterization, Weight Decay, and Adaptive Learning Rate
di: Xu, Huangyu, et al.
Pubblicazione: (2026)
di: Xu, Huangyu, et al.
Pubblicazione: (2026)
Stochastic Gradient Descent for Two-layer Neural Networks
di: Cao, Dinghao, et al.
Pubblicazione: (2024)
di: Cao, Dinghao, et al.
Pubblicazione: (2024)
Variational Stochastic Gradient Descent for Deep Neural Networks
di: Chen, Haotian, et al.
Pubblicazione: (2024)
di: Chen, Haotian, et al.
Pubblicazione: (2024)
Adjacent Leader Decentralized Stochastic Gradient Descent
di: He, Haoze, et al.
Pubblicazione: (2024)
di: He, Haoze, et al.
Pubblicazione: (2024)
Information-Theoretic Generalization Bounds for Stochastic Gradient Descent with Predictable Virtual Noise
di: Partohaghighi, Mohammad
Pubblicazione: (2026)
di: Partohaghighi, Mohammad
Pubblicazione: (2026)
On the Generalization of Stochastic Gradient Descent with Momentum
di: Ramezani-Kebrya, Ali, et al.
Pubblicazione: (2018)
di: Ramezani-Kebrya, Ali, et al.
Pubblicazione: (2018)
Tight Generalization Error Bounds for Stochastic Gradient Descent in Non-convex Learning
di: Xiong, Wenjun, et al.
Pubblicazione: (2025)
di: Xiong, Wenjun, et al.
Pubblicazione: (2025)
Generalization Guarantees of Gradient Descent for Multi-Layer Neural Networks
di: Wang, Puyu, et al.
Pubblicazione: (2023)
di: Wang, Puyu, et al.
Pubblicazione: (2023)
Stochastic Gradient Descent with Adaptive Data
di: Che, Ethan, et al.
Pubblicazione: (2024)
di: Che, Ethan, et al.
Pubblicazione: (2024)
Bias of Stochastic Gradient Descent or the Architecture: Disentangling the Effects of Overparameterization of Neural Networks
di: Peleg, Amit, et al.
Pubblicazione: (2024)
di: Peleg, Amit, et al.
Pubblicazione: (2024)
Gradient Descent Finds Over-Parameterized Neural Networks with Sharp Generalization for Nonparametric Regression
di: Yang, Yingzhen, et al.
Pubblicazione: (2024)
di: Yang, Yingzhen, et al.
Pubblicazione: (2024)
Learning Operators with Stochastic Gradient Descent in General Hilbert Spaces
di: Shi, Lei, et al.
Pubblicazione: (2024)
di: Shi, Lei, et al.
Pubblicazione: (2024)
Implicit Bias of Gradient Descent for Non-Homogeneous Deep Networks
di: Cai, Yuhang, et al.
Pubblicazione: (2025)
di: Cai, Yuhang, et al.
Pubblicazione: (2025)
Limit Theorems for Stochastic Gradient Descent with Infinite Variance
di: Blanchet, Jose, et al.
Pubblicazione: (2024)
di: Blanchet, Jose, et al.
Pubblicazione: (2024)
Optimization, Generalization and Differential Privacy Bounds for Gradient Descent on Kolmogorov-Arnold Networks
di: Wang, Puyu, et al.
Pubblicazione: (2026)
di: Wang, Puyu, et al.
Pubblicazione: (2026)
A Mean-Field Analysis of Neural Stochastic Gradient Descent-Ascent for Functional Minimax Optimization
di: Zhu, Yuchen, et al.
Pubblicazione: (2024)
di: Zhu, Yuchen, et al.
Pubblicazione: (2024)
Weighted Low-rank Approximation via Stochastic Gradient Descent on Manifolds
di: Xu, Conglong, et al.
Pubblicazione: (2025)
di: Xu, Conglong, et al.
Pubblicazione: (2025)
Stochastic Adaptive Gradient Descent Without Descent
di: Aujol, Jean-François, et al.
Pubblicazione: (2025)
di: Aujol, Jean-François, et al.
Pubblicazione: (2025)
Flavors of Margin: Implicit Bias of Steepest Descent in Homogeneous Neural Networks
di: Tsilivis, Nikolaos, et al.
Pubblicazione: (2024)
di: Tsilivis, Nikolaos, et al.
Pubblicazione: (2024)
PSMGD: Periodic Stochastic Multi-Gradient Descent for Fast Multi-Objective Optimization
di: Xu, Mingjing, et al.
Pubblicazione: (2024)
di: Xu, Mingjing, et al.
Pubblicazione: (2024)
Stochastic Gradient Descent in the Saddle-to-Saddle Regime of Deep Linear Networks
di: Corlouer, Guillaume, et al.
Pubblicazione: (2026)
di: Corlouer, Guillaume, et al.
Pubblicazione: (2026)
Do Neural Networks Need Gradient Descent to Generalize? A Theoretical Study
di: Alexander, Yotam, et al.
Pubblicazione: (2025)
di: Alexander, Yotam, et al.
Pubblicazione: (2025)
Stochastic Gradient Descent with Momentum is Algorithmically Stable
di: Lei, Yunwen, et al.
Pubblicazione: (2026)
di: Lei, Yunwen, et al.
Pubblicazione: (2026)
A Bootstrap Perspective on Stochastic Gradient Descent
di: Lan, Hongjian, et al.
Pubblicazione: (2025)
di: Lan, Hongjian, et al.
Pubblicazione: (2025)
Stochastic Gradient Descent for Nonparametric Additive Regression
di: Chen, Xin, et al.
Pubblicazione: (2024)
di: Chen, Xin, et al.
Pubblicazione: (2024)
Bolstering Stochastic Gradient Descent with Model Building
di: Birbil, S. Ilker, et al.
Pubblicazione: (2021)
di: Birbil, S. Ilker, et al.
Pubblicazione: (2021)
Descend or Rewind? Stochastic Gradient Descent Unlearning
di: Mu, Siqiao, et al.
Pubblicazione: (2025)
di: Mu, Siqiao, et al.
Pubblicazione: (2025)
Convergence Analysis of Natural Gradient Descent for Over-parameterized Physics-Informed Neural Networks
di: Xu, Xianliang, et al.
Pubblicazione: (2024)
di: Xu, Xianliang, et al.
Pubblicazione: (2024)
A Theoretical Analysis of Noise Geometry in Stochastic Gradient Descent
di: Wang, Mingze, et al.
Pubblicazione: (2023)
di: Wang, Mingze, et al.
Pubblicazione: (2023)
Cheap Bootstrap for Fast Uncertainty Quantification of Stochastic Gradient Descent
di: Lam, Henry, et al.
Pubblicazione: (2023)
di: Lam, Henry, et al.
Pubblicazione: (2023)
On the Convergence of (Stochastic) Gradient Descent for Kolmogorov--Arnold Networks
di: Gao, Yihang, et al.
Pubblicazione: (2024)
di: Gao, Yihang, et al.
Pubblicazione: (2024)
Stochastic Gradient Descent with Strategic Querying
di: Jiang, Nanfei, et al.
Pubblicazione: (2025)
di: Jiang, Nanfei, et al.
Pubblicazione: (2025)
Sharp Generalization for Nonparametric Regression in Interpolation Space by Over-Parameterized Neural Networks Trained with Preconditioned Gradient Descent and Early Stopping
di: Yang, Yingzhen, et al.
Pubblicazione: (2024)
di: Yang, Yingzhen, et al.
Pubblicazione: (2024)
Hybrid Coordinate Descent for Efficient Neural Network Learning Using Line Search and Gradient Descent
di: Hsiao, Yen-Che, et al.
Pubblicazione: (2024)
di: Hsiao, Yen-Che, et al.
Pubblicazione: (2024)
Learning Operators by Regularized Stochastic Gradient Descent with Operator-valued Kernels
di: Yang, Jia-Qi, et al.
Pubblicazione: (2025)
di: Yang, Jia-Qi, et al.
Pubblicazione: (2025)
Projected Stochastic Gradient Descent with Quantum Annealed Binary Gradients
di: Krahn, Maximilian, et al.
Pubblicazione: (2023)
di: Krahn, Maximilian, et al.
Pubblicazione: (2023)
On the Theory of Continual Learning with Gradient Descent for Neural Networks
di: Taheri, Hossein, et al.
Pubblicazione: (2025)
di: Taheri, Hossein, et al.
Pubblicazione: (2025)
Personalized Federated Learning with Exact Stochastic Gradient Descent
di: Nikoloutsopoulos, Sotirios, et al.
Pubblicazione: (2022)
di: Nikoloutsopoulos, Sotirios, et al.
Pubblicazione: (2022)
Stochastic Gradient Descent for Gaussian Processes Done Right
di: Lin, Jihao Andreas, et al.
Pubblicazione: (2023)
di: Lin, Jihao Andreas, et al.
Pubblicazione: (2023)
Towards Learning Stochastic Population Models by Gradient Descent
di: Kreikemeyer, Justin N., et al.
Pubblicazione: (2024)
di: Kreikemeyer, Justin N., et al.
Pubblicazione: (2024)
Documenti analoghi
-
Theoretical Analysis of Sparse Optimization with Reparameterization, Weight Decay, and Adaptive Learning Rate
di: Xu, Huangyu, et al.
Pubblicazione: (2026) -
Stochastic Gradient Descent for Two-layer Neural Networks
di: Cao, Dinghao, et al.
Pubblicazione: (2024) -
Variational Stochastic Gradient Descent for Deep Neural Networks
di: Chen, Haotian, et al.
Pubblicazione: (2024) -
Adjacent Leader Decentralized Stochastic Gradient Descent
di: He, Haoze, et al.
Pubblicazione: (2024) -
Information-Theoretic Generalization Bounds for Stochastic Gradient Descent with Predictable Virtual Noise
di: Partohaghighi, Mohammad
Pubblicazione: (2026)