Enregistré dans:
| Auteurs principaux: | Luzi, Lorenzo, Dar, Yehuda, Baraniuk, Richard |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2106.04003 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Common Intuition to Transfer Learning Can Win or Lose: Case Studies for Linear Regression
par: Dar, Yehuda, et autres
Publié: (2021)
par: Dar, Yehuda, et autres
Publié: (2021)
Mixture of Many Zero-Compute Experts: A High-Rate Quantization Theory Perspective
par: Dar, Yehuda
Publié: (2025)
par: Dar, Yehuda
Publié: (2025)
Stable and Privacy-Preserving Synthetic Educational Data with Empirical Marginals: A Copula-Based Approach
par: Ramos, Gabriel Diaz, et autres
Publié: (2026)
par: Ramos, Gabriel Diaz, et autres
Publié: (2026)
Improving Fairness and Mitigating MADness in Generative Models
par: Mayer, Paul, et autres
Publié: (2024)
par: Mayer, Paul, et autres
Publié: (2024)
Boomerang: Local sampling on image manifolds using diffusion models
par: Luzi, Lorenzo, et autres
Publié: (2022)
par: Luzi, Lorenzo, et autres
Publié: (2022)
How Do the Architecture and Optimizer Affect Representation Learning? On the Training Dynamics of Representations in Deep Neural Networks
par: Sharon, Yuval, et autres
Publié: (2024)
par: Sharon, Yuval, et autres
Publié: (2024)
TL-PCA: Transfer Learning of Principal Component Analysis
par: Hendy, Sharon, et autres
Publié: (2024)
par: Hendy, Sharon, et autres
Publié: (2024)
How Does Overparameterization Affect Machine Unlearning of Deep Neural Networks?
par: Alon, Gal, et autres
Publié: (2025)
par: Alon, Gal, et autres
Publié: (2025)
How Much Training Data is Memorized in Overparameterized Autoencoders? An Inverse Problem Perspective on Memorization Evaluation
par: Abitbul, Koren, et autres
Publié: (2023)
par: Abitbul, Koren, et autres
Publié: (2023)
Transfer Learning of Linear Regression with Multiple Pretrained Models: Benefiting from More Pretrained Models via Overparameterization Debiasing
par: Boharon, Daniel, et autres
Publié: (2026)
par: Boharon, Daniel, et autres
Publié: (2026)
SPI-GAN: Denoising Diffusion GANs with Straight-Path Interpolations
par: Jeon, Jinsung, et autres
Publié: (2022)
par: Jeon, Jinsung, et autres
Publié: (2022)
Randomness and Interpolation Improve Gradient Descent
par: Li, Jiawen, et autres
Publié: (2025)
par: Li, Jiawen, et autres
Publié: (2025)
In-context Learning and Gradient Descent Revisited
par: Deutch, Gilad, et autres
Publié: (2023)
par: Deutch, Gilad, et autres
Publié: (2023)
Using Skew to Assess the Quality of GAN-generated Image Features
par: Luzi, Lorenzo, et autres
Publié: (2023)
par: Luzi, Lorenzo, et autres
Publié: (2023)
Synthetic Context Generation for Question Generation
par: Liu, Naiming, et autres
Publié: (2024)
par: Liu, Naiming, et autres
Publié: (2024)
Circuit Complexity of Hierarchical Knowledge Tracing and Implications for Log-Precision Transformers
par: Liu, Naiming, et autres
Publié: (2026)
par: Liu, Naiming, et autres
Publié: (2026)
Bayesian Double Descent
par: Polson, Nick, et autres
Publié: (2025)
par: Polson, Nick, et autres
Publié: (2025)
Manipulating Sparse Double Descent
par: Zhang, Ya Shi
Publié: (2024)
par: Zhang, Ya Shi
Publié: (2024)
MazeNet: An Accurate, Fast, and Scalable Deep Learning Solution for Steiner Minimum Trees
par: Ramos, Gabriel Díaz, et autres
Publié: (2024)
par: Ramos, Gabriel Díaz, et autres
Publié: (2024)
Dropout Drops Double Descent
par: Yang, Tian-Le, et autres
Publié: (2023)
par: Yang, Tian-Le, et autres
Publié: (2023)
Neon: Negative Extrapolation From Self-Training Improves Image Generation
par: Alemohammad, Sina, et autres
Publié: (2025)
par: Alemohammad, Sina, et autres
Publié: (2025)
The Linear Centroids Hypothesis: Features as Directions Learned by Local Experts
par: Walker, Thomas, et autres
Publié: (2026)
par: Walker, Thomas, et autres
Publié: (2026)
GrokAlign: Geometric Characterisation and Acceleration of Grokking
par: Walker, Thomas, et autres
Publié: (2025)
par: Walker, Thomas, et autres
Publié: (2025)
Faster Convergence of Stochastic Accelerated Gradient Descent under Interpolation
par: Mishkin, Aaron, et autres
Publié: (2024)
par: Mishkin, Aaron, et autres
Publié: (2024)
On the Lipschitz Constant of Deep Networks and Double Descent
par: Gamba, Matteo, et autres
Publié: (2023)
par: Gamba, Matteo, et autres
Publié: (2023)
[Re] The Discriminative Kalman Filter for Bayesian Filtering with Nonlinear and Non-Gaussian Observation Models
par: Casco-Rodriguez, Josue, et autres
Publié: (2024)
par: Casco-Rodriguez, Josue, et autres
Publié: (2024)
On the regularization of Wasserstein GANs
par: Petzka, Henning, et autres
Publié: (2017)
par: Petzka, Henning, et autres
Publié: (2017)
Improving Routing in Sparse Mixture of Experts with Graph of Tokens
par: Nguyen, Tam, et autres
Publié: (2025)
par: Nguyen, Tam, et autres
Publié: (2025)
ODE-Constrained Generative Modeling of Cardiac Dynamics for 12-Lead ECG Synthesis
par: Yehuda, Yakir, et autres
Publié: (2024)
par: Yehuda, Yakir, et autres
Publié: (2024)
Deep Networks Always Grok and Here is Why
par: Humayun, Ahmed Imtiaz, et autres
Publié: (2024)
par: Humayun, Ahmed Imtiaz, et autres
Publié: (2024)
On the Geometry of Deep Learning
par: Balestriero, Randall, et autres
Publié: (2024)
par: Balestriero, Randall, et autres
Publié: (2024)
On The Presence of Double-Descent in Deep Reinforcement Learning
par: Veselý, Viktor, et autres
Publié: (2025)
par: Veselý, Viktor, et autres
Publié: (2025)
Mitigating over-exploration in latent space optimization using LES
par: Ronen, Omer, et autres
Publié: (2024)
par: Ronen, Omer, et autres
Publié: (2024)
The Geometric Structure of Models Learning Sparse Data
par: Walker, Thomas, et autres
Publié: (2026)
par: Walker, Thomas, et autres
Publié: (2026)
Data Cleansing for GANs
par: Terashita, Naoyuki, et autres
Publié: (2025)
par: Terashita, Naoyuki, et autres
Publié: (2025)
W4S4: WaLRUS Meets S4 for Long-Range Sequence Modeling
par: Babaei, Hossein, et autres
Publié: (2025)
par: Babaei, Hossein, et autres
Publié: (2025)
Class-wise Activation Unravelling the Engima of Deep Double Descent
par: Gu, Yufei
Publié: (2024)
par: Gu, Yufei
Publié: (2024)
Minimizing Collateral Damage in Activation Steering
par: Nguyen, Tam, et autres
Publié: (2026)
par: Nguyen, Tam, et autres
Publié: (2026)
Privacy-Preserving Federated Convex Optimization: Balancing Partial-Participation and Efficiency via Noise Cancellation
par: Reshef, Roie, et autres
Publié: (2025)
par: Reshef, Roie, et autres
Publié: (2025)
Multi-Scale Texture Loss for CT denoising with GANs
par: Di Feola, Francesco, et autres
Publié: (2024)
par: Di Feola, Francesco, et autres
Publié: (2024)
Documents similaires
-
The Common Intuition to Transfer Learning Can Win or Lose: Case Studies for Linear Regression
par: Dar, Yehuda, et autres
Publié: (2021) -
Mixture of Many Zero-Compute Experts: A High-Rate Quantization Theory Perspective
par: Dar, Yehuda
Publié: (2025) -
Stable and Privacy-Preserving Synthetic Educational Data with Empirical Marginals: A Copula-Based Approach
par: Ramos, Gabriel Diaz, et autres
Publié: (2026) -
Improving Fairness and Mitigating MADness in Generative Models
par: Mayer, Paul, et autres
Publié: (2024) -
Boomerang: Local sampling on image manifolds using diffusion models
par: Luzi, Lorenzo, et autres
Publié: (2022)