Scaling Law for Stochastic Gradient Descent in Quadratically Parameterized Linear Regression
Fuente:
arXiv
Guardado en:
| Autores principales: | Ding, Shihong, Zhang, Haihan, Zhao, Hanzhen, Fang, Cong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Learning Curves of Stochastic Gradient Descent in Kernel Regression
por: Zhang, Haihan, et al.
Publicado: (2025)
por: Zhang, Haihan, et al.
Publicado: (2025)
Mild Over-Parameterization Benefits Asymmetric Tensor PCA
por: Ding, Shihong, et al.
Publicado: (2026)
por: Ding, Shihong, et al.
Publicado: (2026)
Optimal Algorithms in Linear Regression under Covariate Shift: On the Importance of Precondition
por: Liu, Yuanshi, et al.
Publicado: (2025)
por: Liu, Yuanshi, et al.
Publicado: (2025)
What Makes a Strong Model? A Unified Spectral Analysis of Knowledge Transfer over High-dimensional Linear Regression
por: Wu, Wendao, et al.
Publicado: (2026)
por: Wu, Wendao, et al.
Publicado: (2026)
The Optimality of (Accelerated) SGD for High-Dimensional Quadratic Optimization
por: Zhang, Haihan, et al.
Publicado: (2024)
por: Zhang, Haihan, et al.
Publicado: (2024)
Scaling Laws for Gradient Descent and Sign Descent for Linear Bigram Models under Zipf's Law
por: Kunstner, Frederik, et al.
Publicado: (2025)
por: Kunstner, Frederik, et al.
Publicado: (2025)
Accelerating Single-Pass SGD for Generalized Linear Prediction
por: Chen, Qian, et al.
Publicado: (2026)
por: Chen, Qian, et al.
Publicado: (2026)
Stochastic Gradient Descent for Nonparametric Additive Regression
por: Chen, Xin, et al.
Publicado: (2024)
por: Chen, Xin, et al.
Publicado: (2024)
Near-optimal and Efficient First-Order Algorithm for Multi-Task Learning with Shared Linear Representation
por: Ding, Shihong, et al.
Publicado: (2026)
por: Ding, Shihong, et al.
Publicado: (2026)
Trained Mamba Emulates Online Gradient Descent in In-Context Linear Regression
por: Jiang, Jiarui, et al.
Publicado: (2025)
por: Jiang, Jiarui, et al.
Publicado: (2025)
FastPart: Over-Parameterized Stochastic Gradient Descent for Sparse optimisation on Measures
por: De Castro, Yohann, et al.
Publicado: (2023)
por: De Castro, Yohann, et al.
Publicado: (2023)
Gradient Descent Finds Over-Parameterized Neural Networks with Sharp Generalization for Nonparametric Regression
por: Yang, Yingzhen, et al.
Publicado: (2024)
por: Yang, Yingzhen, et al.
Publicado: (2024)
Exponential Convergence of (Stochastic) Gradient Descent for Separable Logistic Regression
por: Kale, Sacchit, et al.
Publicado: (2026)
por: Kale, Sacchit, et al.
Publicado: (2026)
Preconditioned Gradient Descent for Over-Parameterized Nonconvex Matrix Factorization
por: Zhang, Gavin, et al.
Publicado: (2025)
por: Zhang, Gavin, et al.
Publicado: (2025)
Stochastic Gradient Descent in the Saddle-to-Saddle Regime of Deep Linear Networks
por: Corlouer, Guillaume, et al.
Publicado: (2026)
por: Corlouer, Guillaume, et al.
Publicado: (2026)
Stochastic Smoothed Gradient Descent Ascent for Federated Minimax Optimization
por: Shen, Wei, et al.
Publicado: (2023)
por: Shen, Wei, et al.
Publicado: (2023)
Stochastic Adaptive Gradient Descent Without Descent
por: Aujol, Jean-François, et al.
Publicado: (2025)
por: Aujol, Jean-François, et al.
Publicado: (2025)
Scaling Laws for Precision in High-Dimensional Linear Regression
por: Zhang, Dechen, et al.
Publicado: (2026)
por: Zhang, Dechen, et al.
Publicado: (2026)
On the Generalization of Stochastic Gradient Descent with Momentum
por: Ramezani-Kebrya, Ali, et al.
Publicado: (2018)
por: Ramezani-Kebrya, Ali, et al.
Publicado: (2018)
From One-Pass SGD to Data Reuse: Mini-Batch Scaling Laws in Sketched Linear Regression
por: Chen, Ziyan, et al.
Publicado: (2026)
por: Chen, Ziyan, et al.
Publicado: (2026)
Least Squares Regression Can Exhibit Under-Parameterized Double Descent
por: Li, Xinyue, et al.
Publicado: (2023)
por: Li, Xinyue, et al.
Publicado: (2023)
Stochastic Normalized Gradient Descent with Momentum for Large-Batch Training
por: Zhao, Shen-Yi, et al.
Publicado: (2020)
por: Zhao, Shen-Yi, et al.
Publicado: (2020)
A Bootstrap Perspective on Stochastic Gradient Descent
por: Lan, Hongjian, et al.
Publicado: (2025)
por: Lan, Hongjian, et al.
Publicado: (2025)
Descend or Rewind? Stochastic Gradient Descent Unlearning
por: Mu, Siqiao, et al.
Publicado: (2025)
por: Mu, Siqiao, et al.
Publicado: (2025)
Adjacent Leader Decentralized Stochastic Gradient Descent
por: He, Haoze, et al.
Publicado: (2024)
por: He, Haoze, et al.
Publicado: (2024)
Bolstering Stochastic Gradient Descent with Model Building
por: Birbil, S. Ilker, et al.
Publicado: (2021)
por: Birbil, S. Ilker, et al.
Publicado: (2021)
Statistical Inference for Differentially Private Stochastic Gradient Descent
por: Xia, Xintao, et al.
Publicado: (2025)
por: Xia, Xintao, et al.
Publicado: (2025)
Stochastic Gradient Descent with Strategic Querying
por: Jiang, Nanfei, et al.
Publicado: (2025)
por: Jiang, Nanfei, et al.
Publicado: (2025)
Stochastic Gradient Descent with Adaptive Data
por: Che, Ethan, et al.
Publicado: (2024)
por: Che, Ethan, et al.
Publicado: (2024)
Comparing the Moore-Penrose Pseudoinverse and Gradient Descent for Solving Linear Regression Problems: A Performance Analysis
por: Adams, Alex
Publicado: (2025)
por: Adams, Alex
Publicado: (2025)
Tight Generalization Error Bounds for Stochastic Gradient Descent in Non-convex Learning
por: Xiong, Wenjun, et al.
Publicado: (2025)
por: Xiong, Wenjun, et al.
Publicado: (2025)
Sharp Generalization for Nonparametric Regression in Interpolation Space by Over-Parameterized Neural Networks Trained with Preconditioned Gradient Descent and Early Stopping
por: Yang, Yingzhen, et al.
Publicado: (2024)
por: Yang, Yingzhen, et al.
Publicado: (2024)
Private Gradient Descent for Linear Regression: Tighter Error Bounds and Instance-Specific Uncertainty Estimation
por: Brown, Gavin, et al.
Publicado: (2024)
por: Brown, Gavin, et al.
Publicado: (2024)
Transformers Efficiently Perform In-Context Logistic Regression via Normalized Gradient Descent
por: Zhang, Chenyang, et al.
Publicado: (2026)
por: Zhang, Chenyang, et al.
Publicado: (2026)
Statistical Guarantees for High-Dimensional Stochastic Gradient Descent
por: Li, Jiaqi, et al.
Publicado: (2025)
por: Li, Jiaqi, et al.
Publicado: (2025)
Personalized Federated Learning with Exact Stochastic Gradient Descent
por: Nikoloutsopoulos, Sotirios, et al.
Publicado: (2022)
por: Nikoloutsopoulos, Sotirios, et al.
Publicado: (2022)
Stochastic Gradient Descent for Two-layer Neural Networks
por: Cao, Dinghao, et al.
Publicado: (2024)
por: Cao, Dinghao, et al.
Publicado: (2024)
Stochastic Gradient Descent for Gaussian Processes Done Right
por: Lin, Jihao Andreas, et al.
Publicado: (2023)
por: Lin, Jihao Andreas, et al.
Publicado: (2023)
Variational Stochastic Gradient Descent for Deep Neural Networks
por: Chen, Haotian, et al.
Publicado: (2024)
por: Chen, Haotian, et al.
Publicado: (2024)
Towards Learning Stochastic Population Models by Gradient Descent
por: Kreikemeyer, Justin N., et al.
Publicado: (2024)
por: Kreikemeyer, Justin N., et al.
Publicado: (2024)
Ejemplares similares
-
Learning Curves of Stochastic Gradient Descent in Kernel Regression
por: Zhang, Haihan, et al.
Publicado: (2025) -
Mild Over-Parameterization Benefits Asymmetric Tensor PCA
por: Ding, Shihong, et al.
Publicado: (2026) -
Optimal Algorithms in Linear Regression under Covariate Shift: On the Importance of Precondition
por: Liu, Yuanshi, et al.
Publicado: (2025) -
What Makes a Strong Model? A Unified Spectral Analysis of Knowledge Transfer over High-dimensional Linear Regression
por: Wu, Wendao, et al.
Publicado: (2026) -
The Optimality of (Accelerated) SGD for High-Dimensional Quadratic Optimization
por: Zhang, Haihan, et al.
Publicado: (2024)