MixMin: Finding Data Mixtures via Convex Minimization
Fuente:
arXiv
Guardado en:
| Autores principales: | Thudi, Anvith, Rovers, Evianne, Ruan, Yangjun, Thrush, Tristan, Maddison, Chris J. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MixMax: Distributional Robustness in Function Space via Optimal Data Mixtures
por: Thudi, Anvith, et al.
Publicado: (2024)
por: Thudi, Anvith, et al.
Publicado: (2024)
Observational Scaling Laws and the Predictability of Language Model Performance
por: Ruan, Yangjun, et al.
Publicado: (2024)
por: Ruan, Yangjun, et al.
Publicado: (2024)
Reasoning to Learn from Latent Thoughts
por: Ruan, Yangjun, et al.
Publicado: (2025)
por: Ruan, Yangjun, et al.
Publicado: (2025)
Fast Exact Unlearning for In-Context Learning Data for LLMs
por: Muresanu, Andrei I., et al.
Publicado: (2024)
por: Muresanu, Andrei I., et al.
Publicado: (2024)
Gradients Look Alike: Sensitivity is Often Overestimated in DP-SGD
por: Thudi, Anvith, et al.
Publicado: (2023)
por: Thudi, Anvith, et al.
Publicado: (2023)
Efficient Public Verification of Private ML via Regularization
por: Bell, Zoë Ruha, et al.
Publicado: (2025)
por: Bell, Zoë Ruha, et al.
Publicado: (2025)
Improving Pretraining Data Using Perplexity Correlations
por: Thrush, Tristan, et al.
Publicado: (2024)
por: Thrush, Tristan, et al.
Publicado: (2024)
Selective Prediction via Training Dynamics
por: Rabanser, Stephan, et al.
Publicado: (2022)
por: Rabanser, Stephan, et al.
Publicado: (2022)
Gauss-Newton Unlearning for the LLM Era
por: McKinney, Lev, et al.
Publicado: (2026)
por: McKinney, Lev, et al.
Publicado: (2026)
Predicting Large Model Test Losses with a Noisy Quadratic System
por: Li, Chuning, et al.
Publicado: (2026)
por: Li, Chuning, et al.
Publicado: (2026)
Leveraging Per-Instance Privacy for Machine Unlearning
por: Sepahvand, Nazanin Mohammadi, et al.
Publicado: (2025)
por: Sepahvand, Nazanin Mohammadi, et al.
Publicado: (2025)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
por: Dong, Honghua, et al.
Publicado: (2024)
por: Dong, Honghua, et al.
Publicado: (2024)
Causal Risk Minimization for High-Dimensional Treatments
por: Dhawan, Nikita, et al.
Publicado: (2026)
por: Dhawan, Nikita, et al.
Publicado: (2026)
Identifying the Risks of LM Agents with an LM-Emulated Sandbox
por: Ruan, Yangjun, et al.
Publicado: (2023)
por: Ruan, Yangjun, et al.
Publicado: (2023)
Bayesian Sensitivity of Causal Inference Estimators under Evidence-Based Priors
por: Dhawan, Nikita, et al.
Publicado: (2026)
por: Dhawan, Nikita, et al.
Publicado: (2026)
A Geometric Analysis of PCA
por: Hanchi, Ayoub El, et al.
Publicado: (2025)
por: Hanchi, Ayoub El, et al.
Publicado: (2025)
Experts Don't Cheat: Learning What You Don't Know By Predicting Pairs
por: Johnson, Daniel D., et al.
Publicado: (2024)
por: Johnson, Daniel D., et al.
Publicado: (2024)
GraphMinNet: Learning Dependencies in Graphs with Light Complexity Minimal Architecture
por: Ahamed, Md Atik, et al.
Publicado: (2025)
por: Ahamed, Md Atik, et al.
Publicado: (2025)
End-To-End Causal Effect Estimation from Unstructured Natural Language Data
por: Dhawan, Nikita, et al.
Publicado: (2024)
por: Dhawan, Nikita, et al.
Publicado: (2024)
Minimax Linear Regression under the Quantile Risk
por: Hanchi, Ayoub El, et al.
Publicado: (2024)
por: Hanchi, Ayoub El, et al.
Publicado: (2024)
On the Efficiency of ERM in Feature Learning
por: Hanchi, Ayoub El, et al.
Publicado: (2024)
por: Hanchi, Ayoub El, et al.
Publicado: (2024)
VisMin: Visual Minimal-Change Understanding
por: Awal, Rabiul, et al.
Publicado: (2024)
por: Awal, Rabiul, et al.
Publicado: (2024)
Synthetic Data for any Differentiable Target
por: Thrush, Tristan, et al.
Publicado: (2026)
por: Thrush, Tristan, et al.
Publicado: (2026)
Putting It All into Context: Simplifying Agents with LCLMs
por: Jiang, Mingjian, et al.
Publicado: (2025)
por: Jiang, Mingjian, et al.
Publicado: (2025)
Global Resolution: Optimal Multi-Draft Speculative Sampling via Convex Minimization
por: Thomas, Rahul Krishna, et al.
Publicado: (2025)
por: Thomas, Rahul Krishna, et al.
Publicado: (2025)
Online $\mathrm{L}^{\natural}$-Convex Minimization
por: Yokoyama, Ken, et al.
Publicado: (2024)
por: Yokoyama, Ken, et al.
Publicado: (2024)
Training a force field for proteins and small molecules from scratch
por: Blanco-González, Alexandre, et al.
Publicado: (2026)
por: Blanco-González, Alexandre, et al.
Publicado: (2026)
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
por: Wang, Jiapeng, et al.
Publicado: (2026)
por: Wang, Jiapeng, et al.
Publicado: (2026)
Learning to Solve the Min-Max Mixed-Shelves Picker-Routing Problem via Hierarchical and Parallel Decoding
por: Luttmann, Laurin, et al.
Publicado: (2025)
por: Luttmann, Laurin, et al.
Publicado: (2025)
MinMaxMin $Q$-learning
por: Soffair, Nitsan, et al.
Publicado: (2024)
por: Soffair, Nitsan, et al.
Publicado: (2024)
Finding Moving-Band Statistical Arbitrages via Convex-Concave Optimization
por: Johansson, Kasper, et al.
Publicado: (2024)
por: Johansson, Kasper, et al.
Publicado: (2024)
Graph-based Uncertainty Metrics for Long-form Language Model Outputs
por: Jiang, Mingjian, et al.
Publicado: (2024)
por: Jiang, Mingjian, et al.
Publicado: (2024)
Re-Mix: Optimizing Data Mixtures for Large Scale Imitation Learning
por: Hejna, Joey, et al.
Publicado: (2024)
por: Hejna, Joey, et al.
Publicado: (2024)
MaD-Mix: Multi-Modal Data Mixtures via Latent Space Coupling for Vision-Language Model Training
por: Xie, Wanyun, et al.
Publicado: (2026)
por: Xie, Wanyun, et al.
Publicado: (2026)
Exact Instance Compression for Convex Empirical Risk Minimization via Color Refinement
por: Zhu, Bryan, et al.
Publicado: (2026)
por: Zhu, Bryan, et al.
Publicado: (2026)
Dual Adaptivity: Universal Algorithms for Minimizing the Adaptive Regret of Convex Functions
por: Zhang, Lijun, et al.
Publicado: (2025)
por: Zhang, Lijun, et al.
Publicado: (2025)
Bayesian Network Structural Consensus via Greedy Min-Cut Analysis
por: Torrijos, Pablo, et al.
Publicado: (2025)
por: Torrijos, Pablo, et al.
Publicado: (2025)
MoPEQ: Mixture of Mixed Precision Quantized Experts
por: Chitty-Venkata, Krishna Teja, et al.
Publicado: (2025)
por: Chitty-Venkata, Krishna Teja, et al.
Publicado: (2025)
Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance
por: Ye, Jiasheng, et al.
Publicado: (2024)
por: Ye, Jiasheng, et al.
Publicado: (2024)
MixGCN: Scalable GCN Training by Mixture of Parallelism and Mixture of Accelerators
por: Wan, Cheng, et al.
Publicado: (2025)
por: Wan, Cheng, et al.
Publicado: (2025)
Ejemplares similares
-
MixMax: Distributional Robustness in Function Space via Optimal Data Mixtures
por: Thudi, Anvith, et al.
Publicado: (2024) -
Observational Scaling Laws and the Predictability of Language Model Performance
por: Ruan, Yangjun, et al.
Publicado: (2024) -
Reasoning to Learn from Latent Thoughts
por: Ruan, Yangjun, et al.
Publicado: (2025) -
Fast Exact Unlearning for In-Context Learning Data for LLMs
por: Muresanu, Andrei I., et al.
Publicado: (2024) -
Gradients Look Alike: Sensitivity is Often Overestimated in DP-SGD
por: Thudi, Anvith, et al.
Publicado: (2023)