Salvato in:
| Autori principali: | Mousavi-Hosseini, Alireza, Javanmard, Adel, Erdogdu, Murat A. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2410.16449 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning Multi-Index Models with Neural Networks via Mean-Field Langevin Dynamics
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2024)
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2024)
Post-Training with Policy Gradients: Optimality and the Base Model Barrier
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2026)
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2026)
From Information to Generative Exponent: Learning Rate Induces Phase Transitions in SGD
di: Tsiolis, Konstantinos Christopher, et al.
Pubblicazione: (2025)
di: Tsiolis, Konstantinos Christopher, et al.
Pubblicazione: (2025)
Pruning is Optimal for Learning Sparse Features in High-Dimensions
di: Vural, Nuri Mert, et al.
Pubblicazione: (2024)
di: Vural, Nuri Mert, et al.
Pubblicazione: (2024)
When Do Transformers Outperform Feedforward and Recurrent Networks? A Statistical Perspective
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2025)
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2025)
A Separation in Heavy-Tailed Sampling: Gaussian vs. Stable Oracles for Proximal Samplers
di: He, Ye, et al.
Pubblicazione: (2024)
di: He, Ye, et al.
Pubblicazione: (2024)
On the Efficiency of ERM in Feature Learning
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2024)
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2024)
Differentially Private Model-X Knockoffs via Johnson-Lindenstrauss Transform
di: Tao, Yuxuan, et al.
Pubblicazione: (2025)
di: Tao, Yuxuan, et al.
Pubblicazione: (2025)
The curse of overparametrization in adversarial training: Precise analysis of robust generalization for random features regression
di: Hassani, Hamed, et al.
Pubblicazione: (2022)
di: Hassani, Hamed, et al.
Pubblicazione: (2022)
Robust Policy Optimization to Prevent Catastrophic Forgetting
di: Sabbaghi, Mahdi, et al.
Pubblicazione: (2026)
di: Sabbaghi, Mahdi, et al.
Pubblicazione: (2026)
Multi-Task Dynamic Pricing in Credit Market with Contextual Information
di: Javanmard, Adel, et al.
Pubblicazione: (2024)
di: Javanmard, Adel, et al.
Pubblicazione: (2024)
Optimal Excess Risk Bounds for Empirical Risk Minimization on $p$-Norm Linear Regression
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2023)
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2023)
PriorBoost: An Adaptive Algorithm for Learning from Aggregate Responses
di: Javanmard, Adel, et al.
Pubblicazione: (2024)
di: Javanmard, Adel, et al.
Pubblicazione: (2024)
Theoretical Perspectives on Data Quality and Synergistic Effects in Pre- and Post-Training Reasoning Models
di: Javanmard, Adel, et al.
Pubblicazione: (2026)
di: Javanmard, Adel, et al.
Pubblicazione: (2026)
InfoSFT: Learn More and Forget Less with Information-Aware Token Weighting
di: Sabbaghi, Mahdi, et al.
Pubblicazione: (2026)
di: Sabbaghi, Mahdi, et al.
Pubblicazione: (2026)
On Fitting Flow Models with Large Sinkhorn Couplings
di: Zhang, Stephen, et al.
Pubblicazione: (2025)
di: Zhang, Stephen, et al.
Pubblicazione: (2025)
Understanding the Role of Training Data in Test-Time Scaling
di: Javanmard, Adel, et al.
Pubblicazione: (2025)
di: Javanmard, Adel, et al.
Pubblicazione: (2025)
Optimistic Rates for Learning from Label Proportions
di: Li, Gene, et al.
Pubblicazione: (2024)
di: Li, Gene, et al.
Pubblicazione: (2024)
Learning Rate Schedules in the Presence of Distribution Shift
di: Fahrbach, Matthew, et al.
Pubblicazione: (2023)
di: Fahrbach, Matthew, et al.
Pubblicazione: (2023)
A Geometric Analysis of PCA
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2025)
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2025)
Learning quadratic neural networks in high dimensions: SGD dynamics and scaling laws
di: Arous, Gérard Ben, et al.
Pubblicazione: (2025)
di: Arous, Gérard Ben, et al.
Pubblicazione: (2025)
Mean-Field Langevin Dynamics for Signed Measures via a Bilevel Approach
di: Wang, Guillaume, et al.
Pubblicazione: (2024)
di: Wang, Guillaume, et al.
Pubblicazione: (2024)
Minimax Linear Regression under the Quantile Risk
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2024)
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2024)
Beyond Labeling Oracles: What does it mean to steal ML models?
di: Shafran, Avital, et al.
Pubblicazione: (2023)
di: Shafran, Avital, et al.
Pubblicazione: (2023)
Improving the Variance of Differentially Private Randomized Experiments through Clustering
di: Javanmard, Adel, et al.
Pubblicazione: (2023)
di: Javanmard, Adel, et al.
Pubblicazione: (2023)
Self-Boost via Optimal Retraining: An Analysis via Approximate Message Passing
di: Javanmard, Adel, et al.
Pubblicazione: (2025)
di: Javanmard, Adel, et al.
Pubblicazione: (2025)
Flow Matching with Semidiscrete Couplings
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2025)
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2025)
Learning from Aggregate responses: Instance Level versus Bag Level Loss Functions
di: Javanmard, Adel, et al.
Pubblicazione: (2024)
di: Javanmard, Adel, et al.
Pubblicazione: (2024)
Sampling from the Mean-Field Stationary Distribution
di: Kook, Yunbum, et al.
Pubblicazione: (2024)
di: Kook, Yunbum, et al.
Pubblicazione: (2024)
Analysis of Langevin Monte Carlo from Poincaré to Log-Sobolev
di: Chewi, Sinho, et al.
Pubblicazione: (2021)
di: Chewi, Sinho, et al.
Pubblicazione: (2021)
DeepCrossAttention: Supercharging Transformer Residual Connections
di: Heddes, Mike, et al.
Pubblicazione: (2025)
di: Heddes, Mike, et al.
Pubblicazione: (2025)
Retraining with Predicted Hard Labels Provably Increases Model Accuracy
di: Das, Rudrajit, et al.
Pubblicazione: (2024)
di: Das, Rudrajit, et al.
Pubblicazione: (2024)
Distributional Training Data Attribution: What do Influence Functions Sample?
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)
Generalized Robust Adaptive-Bandwidth Multi-View Manifold Learning in High Dimensions with Noise
di: Ding, Xiucai, et al.
Pubblicazione: (2026)
di: Ding, Xiucai, et al.
Pubblicazione: (2026)
Sig2Model: A Boosting-Driven Model for Updatable Learned Indexes
di: Heidari, Alireza, et al.
Pubblicazione: (2025)
di: Heidari, Alireza, et al.
Pubblicazione: (2025)
A Novel Approach for Intrinsic Dimension Estimation
di: Özçoban, Kadir, et al.
Pubblicazione: (2025)
di: Özçoban, Kadir, et al.
Pubblicazione: (2025)
DeepBoost-AF: A Novel Unsupervised Feature Learning and Gradient Boosting Fusion for Robust Atrial Fibrillation Detection in Raw ECG Signals
di: Jafari, Alireza, et al.
Pubblicazione: (2025)
di: Jafari, Alireza, et al.
Pubblicazione: (2025)
Feature-to-Image Data Augmentation: Improving Model Feature Extraction with Cluster-Guided Synthetic Samples
di: Haghbin, Yasaman, et al.
Pubblicazione: (2024)
di: Haghbin, Yasaman, et al.
Pubblicazione: (2024)
Robustly Learning Monotone Single-Index Models
di: Wang, Puqian, et al.
Pubblicazione: (2025)
di: Wang, Puqian, et al.
Pubblicazione: (2025)
IntroLM: Introspective Language Models via Prefilling-Time Self-Evaluation
di: Kasnavieh, Hossein Hosseini, et al.
Pubblicazione: (2026)
di: Kasnavieh, Hossein Hosseini, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Learning Multi-Index Models with Neural Networks via Mean-Field Langevin Dynamics
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2024) -
Post-Training with Policy Gradients: Optimality and the Base Model Barrier
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2026) -
From Information to Generative Exponent: Learning Rate Induces Phase Transitions in SGD
di: Tsiolis, Konstantinos Christopher, et al.
Pubblicazione: (2025) -
Pruning is Optimal for Learning Sparse Features in High-Dimensions
di: Vural, Nuri Mert, et al.
Pubblicazione: (2024) -
When Do Transformers Outperform Feedforward and Recurrent Networks? A Statistical Perspective
di: Mousavi-Hosseini, Alireza, et al.
Pubblicazione: (2025)