Scaling Laws in Linear Regression: Compute, Parameters, and Data
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Licong, Wu, Jingfeng, Kakade, Sham M., Bartlett, Peter L., Lee, Jason D. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improved Scaling Laws in Linear Regression via Data Reuse
di: Lin, Licong, et al.
Pubblicazione: (2025)
di: Lin, Licong, et al.
Pubblicazione: (2025)
On the Statistical Properties of Generative Adversarial Models for Low Intrinsic Data Dimension
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2024)
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2024)
A Statistical Analysis of Deep Federated Learning for Intrinsically Low-dimensional Data
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2024)
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2024)
Generalization Properties of Score-matching Diffusion Models for Intrinsically Low-dimensional Data
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2026)
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2026)
Risk Comparisons in Linear Regression: Implicit Regularization Dominates Explicit Regularization
di: Wu, Jingfeng, et al.
Pubblicazione: (2025)
di: Wu, Jingfeng, et al.
Pubblicazione: (2025)
Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining
di: Lin, Licong, et al.
Pubblicazione: (2023)
di: Lin, Licong, et al.
Pubblicazione: (2023)
Generalization and Scaling Laws for Mixture-of-Experts Transformers
di: Mayaki, Mansour Zoubeirou a
Pubblicazione: (2026)
di: Mayaki, Mansour Zoubeirou a
Pubblicazione: (2026)
Transformers Handle Endogeneity in In-Context Linear Regression
di: Liang, Haodong, et al.
Pubblicazione: (2024)
di: Liang, Haodong, et al.
Pubblicazione: (2024)
Benign Overfitting without Linearity: Neural Network Classifiers Trained by Gradient Descent for Noisy Linear Data
di: Frei, Spencer, et al.
Pubblicazione: (2022)
di: Frei, Spencer, et al.
Pubblicazione: (2022)
Provable Reward-Agnostic Preference-Based Reinforcement Learning
di: Zhan, Wenhao, et al.
Pubblicazione: (2023)
di: Zhan, Wenhao, et al.
Pubblicazione: (2023)
Learning Hierarchical Polynomials of Multiple Nonlinear Features with Three-Layer Networks
di: Fu, Hengyu, et al.
Pubblicazione: (2024)
di: Fu, Hengyu, et al.
Pubblicazione: (2024)
Beyond Covariance Matrix: The Statistical Complexity of Private Linear Regression
di: Chen, Fan, et al.
Pubblicazione: (2025)
di: Chen, Fan, et al.
Pubblicazione: (2025)
Neural Networks Learn Generic Multi-Index Models Near Information-Theoretic Limit
di: Zhang, Bohan, et al.
Pubblicazione: (2025)
di: Zhang, Bohan, et al.
Pubblicazione: (2025)
Scaling Laws for Imitation Learning in Single-Agent Games
di: Tuyls, Jens, et al.
Pubblicazione: (2023)
di: Tuyls, Jens, et al.
Pubblicazione: (2023)
A Statistical Theory of Contrastive Learning via Approximate Sufficient Statistics
di: Lin, Licong, et al.
Pubblicazione: (2025)
di: Lin, Licong, et al.
Pubblicazione: (2025)
A Likelihood Based Approach to Distribution Regression Using Conditional Deep Generative Models
di: Kumar, Shivam, et al.
Pubblicazione: (2024)
di: Kumar, Shivam, et al.
Pubblicazione: (2024)
Loss-to-Loss Prediction: Scaling Laws for All Datasets
di: Brandfonbrener, David, et al.
Pubblicazione: (2024)
di: Brandfonbrener, David, et al.
Pubblicazione: (2024)
Minimax Optimal Convergence of Gradient Descent in Logistic Regression via Large and Adaptive Stepsizes
di: Zhang, Ruiqi, et al.
Pubblicazione: (2025)
di: Zhang, Ruiqi, et al.
Pubblicazione: (2025)
Scaling Limits of Long-Context Transformers
di: Bruno, Giuseppe, et al.
Pubblicazione: (2026)
di: Bruno, Giuseppe, et al.
Pubblicazione: (2026)
A Statistical Analysis of Wasserstein Autoencoders for Intrinsically Low-dimensional Data
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2024)
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2024)
A Statistical Analysis for Supervised Deep Learning with Exponential Families for Intrinsically Low-dimensional Data
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2024)
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2024)
Diffusion Posterior Sampling is Computationally Intractable
di: Gupta, Shivam, et al.
Pubblicazione: (2024)
di: Gupta, Shivam, et al.
Pubblicazione: (2024)
Cyclic Counterfactuals under Shift-Scale Interventions
di: Saha, Saptarshi, et al.
Pubblicazione: (2025)
di: Saha, Saptarshi, et al.
Pubblicazione: (2025)
Differentially Private Two-Stage Gradient Descent for Instrumental Variable Regression
di: Liang, Haodong, et al.
Pubblicazione: (2025)
di: Liang, Haodong, et al.
Pubblicazione: (2025)
Navigating the Exploration-Exploitation Tradeoff in Inference-Time Scaling of Diffusion Models
di: Su, Xun, et al.
Pubblicazione: (2025)
di: Su, Xun, et al.
Pubblicazione: (2025)
A Computational Theory for Efficient Mini Agent Evaluation with Causal Guarantees
di: Yan, Hedong
Pubblicazione: (2025)
di: Yan, Hedong
Pubblicazione: (2025)
Towards Bayesian Data Selection
di: Rodemann, Julian
Pubblicazione: (2024)
di: Rodemann, Julian
Pubblicazione: (2024)
Flash Inference: Near Linear Time Inference for Long Convolution Sequence Models and Beyond
di: Oncescu, Costin-Andrei, et al.
Pubblicazione: (2024)
di: Oncescu, Costin-Andrei, et al.
Pubblicazione: (2024)
Neural Networks Generalize on Low Complexity Data
di: Chatterjee, Sourav, et al.
Pubblicazione: (2024)
di: Chatterjee, Sourav, et al.
Pubblicazione: (2024)
How Particle-System Random Batch Methods Enhance Graph Transformer: Memory Efficiency and Parallel Computing Strategy
di: Liu, Hanwen, et al.
Pubblicazione: (2025)
di: Liu, Hanwen, et al.
Pubblicazione: (2025)
How Does Critical Batch Size Scale in Pre-training?
di: Zhang, Hanlin, et al.
Pubblicazione: (2024)
di: Zhang, Hanlin, et al.
Pubblicazione: (2024)
Convergence of Shallow ReLU Networks on Weakly Interacting Data
di: Dana, Léo, et al.
Pubblicazione: (2025)
di: Dana, Léo, et al.
Pubblicazione: (2025)
Beyond identifiability: Learning causal representations with few environments and finite samples
di: Lee, Inbeom, et al.
Pubblicazione: (2026)
di: Lee, Inbeom, et al.
Pubblicazione: (2026)
Maximizing the Potential of Synthetic Data: Insights from Random Matrix Theory
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2024)
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2024)
Piecewise Polynomial Regression of Tame Functions via Integer Programming
di: Bareilles, Gilles, et al.
Pubblicazione: (2023)
di: Bareilles, Gilles, et al.
Pubblicazione: (2023)
Can Generative Artificial Intelligence Survive Data Contamination? Theoretical Guarantees under Contaminated Recursive Training
di: Wang, Kevin, et al.
Pubblicazione: (2026)
di: Wang, Kevin, et al.
Pubblicazione: (2026)
Scaling Laws are Redundancy Laws
di: Bi, Yuda, et al.
Pubblicazione: (2025)
di: Bi, Yuda, et al.
Pubblicazione: (2025)
A Statistical Theory of Contrastive Pre-training and Multimodal Generative AI
di: Oko, Kazusato, et al.
Pubblicazione: (2025)
di: Oko, Kazusato, et al.
Pubblicazione: (2025)
Diffusion Models and the Manifold Hypothesis: Log-Domain Smoothing is Geometry Adaptive
di: Farghly, Tyler, et al.
Pubblicazione: (2025)
di: Farghly, Tyler, et al.
Pubblicazione: (2025)
Counterfactual Generative Modeling with Variational Causal Inference
di: Wu, Yulun, et al.
Pubblicazione: (2024)
di: Wu, Yulun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Improved Scaling Laws in Linear Regression via Data Reuse
di: Lin, Licong, et al.
Pubblicazione: (2025) -
On the Statistical Properties of Generative Adversarial Models for Low Intrinsic Data Dimension
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2024) -
A Statistical Analysis of Deep Federated Learning for Intrinsically Low-dimensional Data
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2024) -
Generalization Properties of Score-matching Diffusion Models for Intrinsically Low-dimensional Data
di: Chakraborty, Saptarshi, et al.
Pubblicazione: (2026) -
Risk Comparisons in Linear Regression: Implicit Regularization Dominates Explicit Regularization
di: Wu, Jingfeng, et al.
Pubblicazione: (2025)