Learning Linear Regression with Low-Rank Tasks in-Context
Fuente:
arXiv
Salvato in:
| Autori principali: | Takanami, Kaito, Takahashi, Takashi, Kabashima, Yoshiyuki |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Effect of Optimal Self-Distillation in Noisy Gaussian Mixture Model
di: Takanami, Kaito, et al.
Pubblicazione: (2025)
di: Takanami, Kaito, et al.
Pubblicazione: (2025)
Semi-analytic approximate stability selection for correlated data in generalized linear models
di: Takahashi, Takashi, et al.
Pubblicazione: (2020)
di: Takahashi, Takashi, et al.
Pubblicazione: (2020)
Macroscopic Analysis of Vector Approximate Message Passing in a Model Mismatch Setting
di: Takahashi, Takashi, et al.
Pubblicazione: (2020)
di: Takahashi, Takashi, et al.
Pubblicazione: (2020)
Analysis of the Hopfield Model Incorporating the Effects of Unlearning
di: Takeuchi, Shuta, et al.
Pubblicazione: (2026)
di: Takeuchi, Shuta, et al.
Pubblicazione: (2026)
Storage capacity of perceptron with variable selection
di: Xu, Yingying, et al.
Pubblicazione: (2025)
di: Xu, Yingying, et al.
Pubblicazione: (2025)
Dynamical mean field approach to associative memory model with non-monotonic transfer functions
di: Kabashima, Yoshiyuki, et al.
Pubblicazione: (2025)
di: Kabashima, Yoshiyuki, et al.
Pubblicazione: (2025)
DMFT analysis of Hopfield network with plasticity
di: Hara, Yoshinori, et al.
Pubblicazione: (2026)
di: Hara, Yoshinori, et al.
Pubblicazione: (2026)
Asymptotic Dynamics of Alternating Minimization for Bilinear Regression
di: Okajima, Koki, et al.
Pubblicazione: (2024)
di: Okajima, Koki, et al.
Pubblicazione: (2024)
Exact Learning Dynamics of In-Context Learning in Linear Transformers and Its Application to Non-Linear Transformers
di: Mainali, Nischal, et al.
Pubblicazione: (2025)
di: Mainali, Nischal, et al.
Pubblicazione: (2025)
Theory of Scaling Laws for In-Context Regression: Depth, Width, Context and Time
di: Bordelon, Blake, et al.
Pubblicazione: (2025)
di: Bordelon, Blake, et al.
Pubblicazione: (2025)
Exact Replica Symmetric solution for transverse field Hopfield model under finite Trotter size
di: Okajima, Koki, et al.
Pubblicazione: (2024)
di: Okajima, Koki, et al.
Pubblicazione: (2024)
Variational Gaussian Approximation in Replica Analysis of Parametric Models
di: Takahashi, Takashi
Pubblicazione: (2025)
di: Takahashi, Takashi
Pubblicazione: (2025)
A replica analysis of under-bagging
di: Takahashi, Takashi
Pubblicazione: (2024)
di: Takahashi, Takashi
Pubblicazione: (2024)
The Role of Pseudo-labels in Self-training Linear Classifiers on High-dimensional Gaussian Mixture Data
di: Takahashi, Takashi
Pubblicazione: (2022)
di: Takahashi, Takashi
Pubblicazione: (2022)
Quantum effects in rotationally invariant spin glass models
di: Hara, Yoshinori, et al.
Pubblicazione: (2025)
di: Hara, Yoshinori, et al.
Pubblicazione: (2025)
Bilinear Sequence Regression: A Model for Learning from Long Sequences of High-dimensional Tokens
di: Erba, Vittorio, et al.
Pubblicazione: (2024)
di: Erba, Vittorio, et al.
Pubblicazione: (2024)
Dynamical Properties of Dense Associative Memory
di: Mimura, Kazushi, et al.
Pubblicazione: (2025)
di: Mimura, Kazushi, et al.
Pubblicazione: (2025)
Analysis of Bootstrap and Subsampling in High-dimensional Regularized Regression
di: Clarté, Lucas, et al.
Pubblicazione: (2024)
di: Clarté, Lucas, et al.
Pubblicazione: (2024)
Deep Learning as Neural Low-Degree Filtering: A Spectral Theory of Hierarchical Feature Learning
di: Dandi, Yatin, et al.
Pubblicazione: (2026)
di: Dandi, Yatin, et al.
Pubblicazione: (2026)
Statistical Advantage of Softmax Attention: Insights from Single-Location Regression
di: Duranthon, O., et al.
Pubblicazione: (2025)
di: Duranthon, O., et al.
Pubblicazione: (2025)
Dataset-Free Weight-Initialization on Restricted Boltzmann Machine
di: Yasuda, Muneki, et al.
Pubblicazione: (2024)
di: Yasuda, Muneki, et al.
Pubblicazione: (2024)
Two-Point Deterministic Equivalence for Stochastic Gradient Dynamics in Linear Models
di: Atanasov, Alexander, et al.
Pubblicazione: (2025)
di: Atanasov, Alexander, et al.
Pubblicazione: (2025)
Algorithmic Task Capture, Computational Complexity, and Inductive Bias of Infinite Transformers
di: Davidovich, Orit, et al.
Pubblicazione: (2026)
di: Davidovich, Orit, et al.
Pubblicazione: (2026)
Precise Dynamics of Diagonal Linear Networks: A Unifying Analysis by Dynamical Mean-Field Theory
di: Nishiyama, Sota, et al.
Pubblicazione: (2025)
di: Nishiyama, Sota, et al.
Pubblicazione: (2025)
Properties of the geometry of solutions and capacity of multi-layer neural networks with Rectified Linear Units activations
di: Baldassi, Carlo, et al.
Pubblicazione: (2019)
di: Baldassi, Carlo, et al.
Pubblicazione: (2019)
Deep Linear Network Training Dynamics from Random Initialization: Data, Width, Depth, and Hyperparameter Transfer
di: Bordelon, Blake, et al.
Pubblicazione: (2025)
di: Bordelon, Blake, et al.
Pubblicazione: (2025)
When Can You Get Away with Low Memory Adam?
di: Kalra, Dayal Singh, et al.
Pubblicazione: (2025)
di: Kalra, Dayal Singh, et al.
Pubblicazione: (2025)
The Training Process of Many Deep Networks Explores the Same Low-Dimensional Manifold
di: Mao, Jialin, et al.
Pubblicazione: (2023)
di: Mao, Jialin, et al.
Pubblicazione: (2023)
Transfer Learning in Infinite Width Feature Learning Networks
di: Lauditi, Clarissa, et al.
Pubblicazione: (2025)
di: Lauditi, Clarissa, et al.
Pubblicazione: (2025)
Physical Reinforcement Learning
di: Dillavou, Sam, et al.
Pubblicazione: (2025)
di: Dillavou, Sam, et al.
Pubblicazione: (2025)
Learning and extrapolating scale-invariant processes
di: Alvez-Canepa, Anaclara, et al.
Pubblicazione: (2026)
di: Alvez-Canepa, Anaclara, et al.
Pubblicazione: (2026)
Hebbian Learning from First Principles
di: Albanese, Linda, et al.
Pubblicazione: (2024)
di: Albanese, Linda, et al.
Pubblicazione: (2024)
Nonlocal Monte Carlo via Reinforcement Learning
di: Dobrynin, Dmitrii, et al.
Pubblicazione: (2025)
di: Dobrynin, Dmitrii, et al.
Pubblicazione: (2025)
The effect of priors on Learning with Restricted Boltzmann Machines
di: Manzan, Gianluca, et al.
Pubblicazione: (2024)
di: Manzan, Gianluca, et al.
Pubblicazione: (2024)
Why Warmup the Learning Rate? Underlying Mechanisms and Improvements
di: Kalra, Dayal Singh, et al.
Pubblicazione: (2024)
di: Kalra, Dayal Singh, et al.
Pubblicazione: (2024)
The RL Perceptron: Generalisation Dynamics of Policy Learning in High Dimensions
di: Patel, Nishil, et al.
Pubblicazione: (2023)
di: Patel, Nishil, et al.
Pubblicazione: (2023)
How Feature Learning Can Improve Neural Scaling Laws
di: Bordelon, Blake, et al.
Pubblicazione: (2024)
di: Bordelon, Blake, et al.
Pubblicazione: (2024)
The Interplay of Data Structure and Imbalance in the Learning Dynamics of Diffusion Models
di: Nicoletti, Flavio, et al.
Pubblicazione: (2026)
di: Nicoletti, Flavio, et al.
Pubblicazione: (2026)
Learning with Restricted Boltzmann Machines: Asymptotics of AMP and GD in High Dimensions
di: Xu, Yizhou, et al.
Pubblicazione: (2025)
di: Xu, Yizhou, et al.
Pubblicazione: (2025)
Class Imbalance in Anomaly Detection: Learning from an Exactly Solvable Model
di: Pezzicoli, F. S., et al.
Pubblicazione: (2025)
di: Pezzicoli, F. S., et al.
Pubblicazione: (2025)
Documenti analoghi
-
The Effect of Optimal Self-Distillation in Noisy Gaussian Mixture Model
di: Takanami, Kaito, et al.
Pubblicazione: (2025) -
Semi-analytic approximate stability selection for correlated data in generalized linear models
di: Takahashi, Takashi, et al.
Pubblicazione: (2020) -
Macroscopic Analysis of Vector Approximate Message Passing in a Model Mismatch Setting
di: Takahashi, Takashi, et al.
Pubblicazione: (2020) -
Analysis of the Hopfield Model Incorporating the Effects of Unlearning
di: Takeuchi, Shuta, et al.
Pubblicazione: (2026) -
Storage capacity of perceptron with variable selection
di: Xu, Yingying, et al.
Pubblicazione: (2025)