Improving the Scaling Laws of Synthetic Data with Deliberate Practice
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Askari-Hemmat, Reyhane, Pezeshki, Mohammad, Dohmatob, Elvis, Bordes, Florian, Astolfi, Pietro, Hall, Melissa, Verbeek, Jakob, Drozdzal, Michal, Romero-Soriano, Adriana |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Feedback-guided Data Synthesis for Imbalanced Classification
par: Hemmat, Reyhane Askari, et autres
Publié: (2023)
par: Hemmat, Reyhane Askari, et autres
Publié: (2023)
Why Less is More (Sometimes): A Theory of Data Curation
par: Dohmatob, Elvis, et autres
Publié: (2025)
par: Dohmatob, Elvis, et autres
Publié: (2025)
Increasing the Utility of Synthetic Images through Chamfer Guidance
par: Dall'Asen, Nicola, et autres
Publié: (2025)
par: Dall'Asen, Nicola, et autres
Publié: (2025)
Improving Geo-diversity of Generated Images with Contextualized Vendi Score Guidance
par: Hemmat, Reyhane Askari, et autres
Publié: (2024)
par: Hemmat, Reyhane Askari, et autres
Publié: (2024)
On Improved Conditioning Mechanisms and Pre-training Strategies for Diffusion Models
par: Ifriqi, Tariq Berrada, et autres
Publié: (2024)
par: Ifriqi, Tariq Berrada, et autres
Publié: (2024)
Object-centric Binding in Contrastive Language-Image Pretraining
par: Assouel, Rim, et autres
Publié: (2025)
par: Assouel, Rim, et autres
Publié: (2025)
Multi-Modal Language Models as Text-to-Image Model Evaluators
par: Chen, Jiahui, et autres
Publié: (2025)
par: Chen, Jiahui, et autres
Publié: (2025)
Consistency-diversity-realism Pareto fronts of conditional image generative models
par: Astolfi, Pietro, et autres
Publié: (2024)
par: Astolfi, Pietro, et autres
Publié: (2024)
Boosting Latent Diffusion with Perceptual Objectives
par: Berrada, Tariq, et autres
Publié: (2024)
par: Berrada, Tariq, et autres
Publié: (2024)
Improving the Physics of Video Generation with VJEPA-2 Reward Signal
par: Yuan, Jianhao, et autres
Publié: (2025)
par: Yuan, Jianhao, et autres
Publié: (2025)
EvalGIM: A Library for Evaluating Generative Image Models
par: Hall, Melissa, et autres
Publié: (2024)
par: Hall, Melissa, et autres
Publié: (2024)
Inference-time Physics Alignment of Video Generative Models with Latent World Models
par: Yuan, Jianhao, et autres
Publié: (2026)
par: Yuan, Jianhao, et autres
Publié: (2026)
Improving Text-to-Image Consistency via Automatic Prompt Optimization
par: Mañas, Oscar, et autres
Publié: (2024)
par: Mañas, Oscar, et autres
Publié: (2024)
Entropy Rectifying Guidance for Diffusion and Flow Models
par: Ifriqi, Tariq Berrada, et autres
Publié: (2025)
par: Ifriqi, Tariq Berrada, et autres
Publié: (2025)
A Picture is Worth More Than 77 Text Tokens: Evaluating CLIP-Style Models on Dense Captions
par: Urbanek, Jack, et autres
Publié: (2023)
par: Urbanek, Jack, et autres
Publié: (2023)
Multimodal RewardBench 2: Evaluating Omni Reward Models for Interleaved Text and Image
par: Hu, Yushi, et autres
Publié: (2025)
par: Hu, Yushi, et autres
Publié: (2025)
DIG In: Evaluating Disparities in Image Generations with Indicators for Geographic Diversity
par: Hall, Melissa, et autres
Publié: (2023)
par: Hall, Melissa, et autres
Publié: (2023)
The Pitfalls of Memorization: When Memorization Hurts Generalization
par: Bayat, Reza, et autres
Publié: (2024)
par: Bayat, Reza, et autres
Publié: (2024)
Scaling Laws for Associative Memories
par: Cabannes, Vivien, et autres
Publié: (2023)
par: Cabannes, Vivien, et autres
Publié: (2023)
Towards Geographic Inclusion in the Evaluation of Text-to-Image Models
par: Hall, Melissa, et autres
Publié: (2024)
par: Hall, Melissa, et autres
Publié: (2024)
PGT: Procedurally Generated Tasks for improving visual grounding in MLLMs
par: Assouel, Rim, et autres
Publié: (2026)
par: Assouel, Rim, et autres
Publié: (2026)
The Intricate Dance of Prompt Complexity, Quality, Diversity, and Consistency in T2I Models
par: Xiaofeng, Zhang, et autres
Publié: (2025)
par: Xiaofeng, Zhang, et autres
Publié: (2025)
Unified Text-Image Generation with Weakness-Targeted Post-Training
par: Chen, Jiahui, et autres
Publié: (2026)
par: Chen, Jiahui, et autres
Publié: (2026)
QGen: On the Ability to Generalize in Quantization Aware Training
par: AskariHemmat, MohammadHossein, et autres
Publié: (2024)
par: AskariHemmat, MohammadHossein, et autres
Publié: (2024)
auto-fpt: Automating Free Probability Theory Calculations for Machine Learning Theory
par: Subramonian, Arjun, et autres
Publié: (2025)
par: Subramonian, Arjun, et autres
Publié: (2025)
Egalitarian Gradient Descent: A Simple Approach to Accelerated Grokking
par: Pasand, Ali Saheb, et autres
Publié: (2025)
par: Pasand, Ali Saheb, et autres
Publié: (2025)
A Tale of Tails: Model Collapse as a Change of Scaling Laws
par: Dohmatob, Elvis, et autres
Publié: (2024)
par: Dohmatob, Elvis, et autres
Publié: (2024)
Model Collapse Demystified: The Case of Regression
par: Dohmatob, Elvis, et autres
Publié: (2024)
par: Dohmatob, Elvis, et autres
Publié: (2024)
Efficient Refusal Ablation in LLM through Optimal Transport
par: Nanfack, Geraldin, et autres
Publié: (2026)
par: Nanfack, Geraldin, et autres
Publié: (2026)
Controlling Multimodal LLMs via Reward-guided Decoding
par: Mañas, Oscar, et autres
Publié: (2025)
par: Mañas, Oscar, et autres
Publié: (2025)
What makes a good metric? Evaluating automatic metrics for text-to-image consistency
par: Ross, Candace, et autres
Publié: (2024)
par: Ross, Candace, et autres
Publié: (2024)
Strong Model Collapse
par: Dohmatob, Elvis, et autres
Publié: (2024)
par: Dohmatob, Elvis, et autres
Publié: (2024)
DP-RDM: Adapting Diffusion Models to Private Domains Without Fine-Tuning
par: Lebensold, Jonathan, et autres
Publié: (2024)
par: Lebensold, Jonathan, et autres
Publié: (2024)
An Effective Theory of Bias Amplification
par: Subramonian, Arjun, et autres
Publié: (2024)
par: Subramonian, Arjun, et autres
Publié: (2024)
Beyond Model Collapse: Scaling Up with Synthesized Data Requires Verification
par: Feng, Yunzhen, et autres
Publié: (2024)
par: Feng, Yunzhen, et autres
Publié: (2024)
VoxelCodeBench: Benchmarking 3D World Modeling Through Code Generation
par: Zheng, Yan, et autres
Publié: (2026)
par: Zheng, Yan, et autres
Publié: (2026)
Improved Baselines for Data-efficient Perceptual Augmentation of LLMs
par: Vallaeys, Théophane, et autres
Publié: (2024)
par: Vallaeys, Théophane, et autres
Publié: (2024)
SafeLens: Deliberate and Efficient Video Guardrails with Fast-and-Slow Screening
par: Nahin, Shahriar Kabir, et autres
Publié: (2026)
par: Nahin, Shahriar Kabir, et autres
Publié: (2026)
Some Deliberations on Deliberate Practice in Psychotherapy: A Commentary
par: James Macdonald, et autres
Publié: (2025)
par: James Macdonald, et autres
Publié: (2025)
Qinco2: Vector Compression and Search with Improved Implicit Neural Codebooks
par: Vallaeys, Théophane, et autres
Publié: (2025)
par: Vallaeys, Théophane, et autres
Publié: (2025)
Documents similaires
-
Feedback-guided Data Synthesis for Imbalanced Classification
par: Hemmat, Reyhane Askari, et autres
Publié: (2023) -
Why Less is More (Sometimes): A Theory of Data Curation
par: Dohmatob, Elvis, et autres
Publié: (2025) -
Increasing the Utility of Synthetic Images through Chamfer Guidance
par: Dall'Asen, Nicola, et autres
Publié: (2025) -
Improving Geo-diversity of Generated Images with Contextualized Vendi Score Guidance
par: Hemmat, Reyhane Askari, et autres
Publié: (2024) -
On Improved Conditioning Mechanisms and Pre-training Strategies for Diffusion Models
par: Ifriqi, Tariq Berrada, et autres
Publié: (2024)