Implicit Bias of Gradient Descent for Non-Homogeneous Deep Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Cai, Yuhang, Zhou, Kangjie, Wu, Jingfeng, Mei, Song, Lindsey, Michael, Bartlett, Peter L. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Large Stepsize Gradient Descent for Non-Homogeneous Two-Layer Networks: Margin Improvement and Fast Optimization
di: Cai, Yuhang, et al.
Pubblicazione: (2024)
di: Cai, Yuhang, et al.
Pubblicazione: (2024)
Convergence and Implicit Bias of Gradient Descent on Continual Linear Classification
di: Jung, Hyunji, et al.
Pubblicazione: (2025)
di: Jung, Hyunji, et al.
Pubblicazione: (2025)
How Does the ReLU Activation Affect the Implicit Bias of Gradient Descent on High-dimensional Neural Network Regression?
di: Lai, Kuo-Wei, et al.
Pubblicazione: (2026)
di: Lai, Kuo-Wei, et al.
Pubblicazione: (2026)
Implicit Bias and Convergence of Matrix Stochastic Mirror Descent
di: Akhtiamov, Danil, et al.
Pubblicazione: (2026)
di: Akhtiamov, Danil, et al.
Pubblicazione: (2026)
Implicit Bias of Spectral Descent and Muon on Multiclass Separable Data
di: Fan, Chen, et al.
Pubblicazione: (2025)
di: Fan, Chen, et al.
Pubblicazione: (2025)
Convergence of Implicit Gradient Descent for Training Two-Layer Physics-Informed Neural Networks
di: Xu, Xianliang, et al.
Pubblicazione: (2024)
di: Xu, Xianliang, et al.
Pubblicazione: (2024)
Understanding the Implicit Regularization of Gradient Descent in Over-parameterized Models
di: Ma, Jianhao, et al.
Pubblicazione: (2025)
di: Ma, Jianhao, et al.
Pubblicazione: (2025)
Non-Euclidean Gradient Descent Operates at the Edge of Stability
di: Islamov, Rustem, et al.
Pubblicazione: (2026)
di: Islamov, Rustem, et al.
Pubblicazione: (2026)
Non-Singularity of the Gradient Descent map for Neural Networks with Piecewise Analytic Activations
di: Crăciun, Alexandru, et al.
Pubblicazione: (2025)
di: Crăciun, Alexandru, et al.
Pubblicazione: (2025)
Using Stochastic Gradient Descent to Smooth Nonconvex Functions: Analysis of Implicit Graduated Optimization
di: Sato, Naoki, et al.
Pubblicazione: (2023)
di: Sato, Naoki, et al.
Pubblicazione: (2023)
Unraveling the Gradient Descent Dynamics of Transformers
di: Song, Bingqing, et al.
Pubblicazione: (2024)
di: Song, Bingqing, et al.
Pubblicazione: (2024)
Learning Provably Improves the Convergence of Gradient Descent
di: Song, Qingyu, et al.
Pubblicazione: (2025)
di: Song, Qingyu, et al.
Pubblicazione: (2025)
Implicit Regularization for Tubal Tensor Factorizations via Gradient Descent
di: Karnik, Santhosh, et al.
Pubblicazione: (2024)
di: Karnik, Santhosh, et al.
Pubblicazione: (2024)
Stochastic Adaptive Gradient Descent Without Descent
di: Aujol, Jean-François, et al.
Pubblicazione: (2025)
di: Aujol, Jean-François, et al.
Pubblicazione: (2025)
Corner Gradient Descent
di: Yarotsky, Dmitry
Pubblicazione: (2025)
di: Yarotsky, Dmitry
Pubblicazione: (2025)
Gradient Descent as a Perceptron Algorithm: Understanding Dynamics and Implicit Acceleration
di: Tyurin, Alexander
Pubblicazione: (2025)
di: Tyurin, Alexander
Pubblicazione: (2025)
On the Convergence of Gradient Descent on Learning Transformers with Residual Connections
di: Qin, Zhen, et al.
Pubblicazione: (2025)
di: Qin, Zhen, et al.
Pubblicazione: (2025)
Solving Inverse Problems with Deep Linear Neural Networks: Global Convergence Guarantees for Gradient Descent with Weight Decay
di: Laus, Hannah, et al.
Pubblicazione: (2025)
di: Laus, Hannah, et al.
Pubblicazione: (2025)
Adaptive Conditional Gradient Descent
di: Khademi, Abbas, et al.
Pubblicazione: (2025)
di: Khademi, Abbas, et al.
Pubblicazione: (2025)
$k$-SVD with Gradient Descent
di: Jedra, Yassir, et al.
Pubblicazione: (2025)
di: Jedra, Yassir, et al.
Pubblicazione: (2025)
On Gradient Descent Ascent for Nonconvex-Concave Minimax Problems
di: Lin, Tianyi, et al.
Pubblicazione: (2019)
di: Lin, Tianyi, et al.
Pubblicazione: (2019)
Convergence of Spectral Descent for Non-smooth Optimization
di: Yang, Yixuan, et al.
Pubblicazione: (2026)
di: Yang, Yixuan, et al.
Pubblicazione: (2026)
Parameter Symmetry and Noise Equilibrium of Stochastic Gradient Descent
di: Ziyin, Liu, et al.
Pubblicazione: (2024)
di: Ziyin, Liu, et al.
Pubblicazione: (2024)
Gradient Descent on Logistic Regression with Non-Separable Data and Large Step Sizes
di: Meng, Si Yi, et al.
Pubblicazione: (2024)
di: Meng, Si Yi, et al.
Pubblicazione: (2024)
Anytime Acceleration of Gradient Descent
di: Zhang, Zihan, et al.
Pubblicazione: (2024)
di: Zhang, Zihan, et al.
Pubblicazione: (2024)
Gradient Descent Converges Linearly to Flatter Minima than Gradient Flow in Shallow Linear Networks
di: Beneventano, Pierfrancesco, et al.
Pubblicazione: (2025)
di: Beneventano, Pierfrancesco, et al.
Pubblicazione: (2025)
Convergence of Gradient Descent for Recurrent Neural Networks: A Nonasymptotic Analysis
di: Cayci, Semih, et al.
Pubblicazione: (2024)
di: Cayci, Semih, et al.
Pubblicazione: (2024)
More Optimal Fractional-Order Stochastic Gradient Descent for Non-Convex Optimization Problems
di: Partohaghighi, Mohammad, et al.
Pubblicazione: (2025)
di: Partohaghighi, Mohammad, et al.
Pubblicazione: (2025)
Stochastic Gradient Descent with Adaptive Data
di: Che, Ethan, et al.
Pubblicazione: (2024)
di: Che, Ethan, et al.
Pubblicazione: (2024)
Stochastic Gradient Descent with Strategic Querying
di: Jiang, Nanfei, et al.
Pubblicazione: (2025)
di: Jiang, Nanfei, et al.
Pubblicazione: (2025)
Dual Natural Gradient Descent for Scalable Training of Physics-Informed Neural Networks
di: Jnini, Anas, et al.
Pubblicazione: (2025)
di: Jnini, Anas, et al.
Pubblicazione: (2025)
Two-Timescale Gradient Descent Ascent Algorithms for Nonconvex Minimax Optimization
di: Lin, Tianyi, et al.
Pubblicazione: (2024)
di: Lin, Tianyi, et al.
Pubblicazione: (2024)
The Global Empirical NTK: Self-Referential Bias and Dimensionality of Gradient Descent Learning
di: Hazelden, James, et al.
Pubblicazione: (2026)
di: Hazelden, James, et al.
Pubblicazione: (2026)
Towards Understanding Gradient Flow Dynamics of Homogeneous Neural Networks Beyond the Origin
di: Kumar, Akshay, et al.
Pubblicazione: (2025)
di: Kumar, Akshay, et al.
Pubblicazione: (2025)
Mirror and Preconditioned Gradient Descent in Wasserstein Space
di: Bonet, Clément, et al.
Pubblicazione: (2024)
di: Bonet, Clément, et al.
Pubblicazione: (2024)
Enhancing Fractional Gradient Descent with Learned Optimizers
di: Sobotka, Jan, et al.
Pubblicazione: (2025)
di: Sobotka, Jan, et al.
Pubblicazione: (2025)
Derivatives of Stochastic Gradient Descent in parametric optimization
di: Iutzeler, Franck, et al.
Pubblicazione: (2024)
di: Iutzeler, Franck, et al.
Pubblicazione: (2024)
Convergence of Alternating Gradient Descent for Matrix Factorization
di: Ward, Rachel, et al.
Pubblicazione: (2023)
di: Ward, Rachel, et al.
Pubblicazione: (2023)
On Penalty-based Bilevel Gradient Descent Method
di: Shen, Han, et al.
Pubblicazione: (2023)
di: Shen, Han, et al.
Pubblicazione: (2023)
A Local Polyak-Lojasiewicz and Descent Lemma of Gradient Descent For Overparametrized Linear Models
di: Xu, Ziqing, et al.
Pubblicazione: (2025)
di: Xu, Ziqing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Large Stepsize Gradient Descent for Non-Homogeneous Two-Layer Networks: Margin Improvement and Fast Optimization
di: Cai, Yuhang, et al.
Pubblicazione: (2024) -
Convergence and Implicit Bias of Gradient Descent on Continual Linear Classification
di: Jung, Hyunji, et al.
Pubblicazione: (2025) -
How Does the ReLU Activation Affect the Implicit Bias of Gradient Descent on High-dimensional Neural Network Regression?
di: Lai, Kuo-Wei, et al.
Pubblicazione: (2026) -
Implicit Bias and Convergence of Matrix Stochastic Mirror Descent
di: Akhtiamov, Danil, et al.
Pubblicazione: (2026) -
Implicit Bias of Spectral Descent and Muon on Multiclass Separable Data
di: Fan, Chen, et al.
Pubblicazione: (2025)