MLE-Smith: Scaling MLE Tasks with Automated Multi-Agent Pipeline
Fuente:
arXiv
Saved in:
| Main Authors: | Qiang, Rushi, Zhuang, Yuchen, Singh, Anikait, Liang, Percy, Zhang, Chao, Yang, Sherry, Dai, Bo |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MLE-Dojo: Interactive Environments for Empowering LLM Agents in Machine Learning Engineering
by: Qiang, Rushi, et al.
Published: (2025)
by: Qiang, Rushi, et al.
Published: (2025)
Reasoning as Gradient: Scaling MLE Agents Beyond Tree Search
by: Zhang, Yifei, et al.
Published: (2026)
by: Zhang, Yifei, et al.
Published: (2026)
AI Research Agents for Machine Learning: Search, Exploration, and Generalization in MLE-bench
by: Toledo, Edan, et al.
Published: (2025)
by: Toledo, Edan, et al.
Published: (2025)
Matryoshka Pilot: Learning to Drive Black-Box LLMs with LLMs
by: Li, Changhao, et al.
Published: (2024)
by: Li, Changhao, et al.
Published: (2024)
HYDRA: Model Factorization Framework for Black-Box LLM Personalization
by: Zhuang, Yuchen, et al.
Published: (2024)
by: Zhuang, Yuchen, et al.
Published: (2024)
Reinforcement Learning for Machine Learning Engineering Agents
by: Yang, Sherry, et al.
Published: (2025)
by: Yang, Sherry, et al.
Published: (2025)
VideoAgent: Self-Improving Video Generation
by: Soni, Achint, et al.
Published: (2024)
by: Soni, Achint, et al.
Published: (2024)
Adaptive Inference-Time Compute: LLMs Can Predict if They Can Do Better, Even Mid-Generation
by: Manvi, Rohin, et al.
Published: (2024)
by: Manvi, Rohin, et al.
Published: (2024)
MLE-Toolbox: An Open-Source Toolbox for Comprehensive EEG and MEG Data Analysis
by: Liu, Xiaobo
Published: (2026)
by: Liu, Xiaobo
Published: (2026)
BBox-Adapter: Lightweight Adapting for Black-Box Large Language Models
by: Sun, Haotian, et al.
Published: (2024)
by: Sun, Haotian, et al.
Published: (2024)
RuleSmith: Multi-Agent LLMs for Automated Game Balancing
by: Zeng, Ziyao, et al.
Published: (2026)
by: Zeng, Ziyao, et al.
Published: (2026)
DF2: Distribution-Free Decision-Focused Learning
by: Kong, Lingkai, et al.
Published: (2023)
by: Kong, Lingkai, et al.
Published: (2023)
Uncertainty Quantification of MLE for Entity Ranking with Covariates
by: Fan, Jianqing, et al.
Published: (2022)
by: Fan, Jianqing, et al.
Published: (2022)
Transformers Simulate MLE for Sequence Generation in Bayesian Networks
by: Cao, Yuan, et al.
Published: (2025)
by: Cao, Yuan, et al.
Published: (2025)
Coordinate ascent neural Kalman-MLE for state estimation
by: Hanlon, Bettina, et al.
Published: (2025)
by: Hanlon, Bettina, et al.
Published: (2025)
When Models Don't Collapse: On the Consistency of Iterative MLE
by: Barzilai, Daniel, et al.
Published: (2025)
by: Barzilai, Daniel, et al.
Published: (2025)
MLE-STAR: Machine Learning Engineering Agent via Search and Targeted Refinement
by: Nam, Jaehyun, et al.
Published: (2025)
by: Nam, Jaehyun, et al.
Published: (2025)
AutoLoRA: Automatically Tuning Matrix Ranks in Low-Rank Adaptation Based on Meta Learning
by: Zhang, Ruiyi, et al.
Published: (2024)
by: Zhang, Ruiyi, et al.
Published: (2024)
Intelligent Co-Design: An Interactive LLM Framework for Interior Spatial Design via Multi-Modal Agents
by: Lim, Ren Jian, et al.
Published: (2026)
by: Lim, Ren Jian, et al.
Published: (2026)
MLAgentBench: Evaluating Language Agents on Machine Learning Experimentation
by: Huang, Qian, et al.
Published: (2023)
by: Huang, Qian, et al.
Published: (2023)
Random pairing MLE for estimation of item parameters in Rasch model
by: Yang, Yuepeng, et al.
Published: (2024)
by: Yang, Yuepeng, et al.
Published: (2024)
On the Structural Limitations of Weight-Based Neural Adaptation and the Role of Reversible Behavioral Learning
by: Konduru, Pardhu Sri Rushi Varma
Published: (2026)
by: Konduru, Pardhu Sri Rushi Varma
Published: (2026)
Towards Fault Tolerance in Multi-Agent Reinforcement Learning
by: Shi, Yuchen, et al.
Published: (2024)
by: Shi, Yuchen, et al.
Published: (2024)
On the Importance of Task Complexity in Evaluating LLM-Based Multi-Agent Systems
by: Tang, Bohan, et al.
Published: (2025)
by: Tang, Bohan, et al.
Published: (2025)
ThanoRA: Task Heterogeneity-Aware Multi-Task Low-Rank Adaptation
by: Liang, Jian, et al.
Published: (2025)
by: Liang, Jian, et al.
Published: (2025)
Overcoming Catastrophic Forgetting by Exemplar Selection in Task-oriented Dialogue System
by: Chen, Chen, et al.
Published: (2024)
by: Chen, Chen, et al.
Published: (2024)
A Multi-Agent Rhizomatic Pipeline for Non-Linear Literature Analysis
by: Serrano, Julio C., et al.
Published: (2026)
by: Serrano, Julio C., et al.
Published: (2026)
Efficient UAV Swarm-Based Multi-Task Federated Learning with Dynamic Task Knowledge Sharing
by: Yang, Yubo, et al.
Published: (2025)
by: Yang, Yubo, et al.
Published: (2025)
Efficient Multi-Task Modeling through Automated Fusion of Trained Models
by: Zhou, Jingxuan, et al.
Published: (2025)
by: Zhou, Jingxuan, et al.
Published: (2025)
Understanding Agent Scaling in LLM-Based Multi-Agent Systems via Diversity
by: Yang, Yingxuan, et al.
Published: (2026)
by: Yang, Yingxuan, et al.
Published: (2026)
AutoNumerics: An Autonomous, PDE-Agnostic Multi-Agent Pipeline for Scientific Computing
by: Du, Jianda, et al.
Published: (2026)
by: Du, Jianda, et al.
Published: (2026)
Value-Incentivized Preference Optimization: A Unified Approach to Online and Offline RLHF
by: Cen, Shicong, et al.
Published: (2024)
by: Cen, Shicong, et al.
Published: (2024)
Exploration-Driven Optimization for Test-Time Large Language Model Reasoning
by: Li, Changhao, et al.
Published: (2026)
by: Li, Changhao, et al.
Published: (2026)
Towards Unified Modeling in Federated Multi-Task Learning via Subspace Decoupling
by: Wei, Yipan, et al.
Published: (2025)
by: Wei, Yipan, et al.
Published: (2025)
k-MLE, k-Bregman, k-VARs: Theory, Convergence, Computation
by: Yue, Zuogong, et al.
Published: (2024)
by: Yue, Zuogong, et al.
Published: (2024)
Improving Dynamic Object Interactions in Text-to-Video Generation with AI Feedback
by: Furuta, Hiroki, et al.
Published: (2024)
by: Furuta, Hiroki, et al.
Published: (2024)
Omni-Thinker: Scaling Multi-Task RL in LLMs with Hybrid Reward and Task Scheduling
by: Li, Derek, et al.
Published: (2025)
by: Li, Derek, et al.
Published: (2025)
Two Birds with One Stone: Enhancing Uncertainty Quantification and Interpretability with Graph Functional Neural Process
by: Kong, Lingkai, et al.
Published: (2025)
by: Kong, Lingkai, et al.
Published: (2025)
Cal-QL: Calibrated Offline RL Pre-Training for Efficient Online Fine-Tuning
by: Nakamoto, Mitsuhiko, et al.
Published: (2023)
by: Nakamoto, Mitsuhiko, et al.
Published: (2023)
RLAD: Training LLMs to Discover Abstractions for Solving Reasoning Problems
by: Qu, Yuxiao, et al.
Published: (2025)
by: Qu, Yuxiao, et al.
Published: (2025)
Similar Items
-
MLE-Dojo: Interactive Environments for Empowering LLM Agents in Machine Learning Engineering
by: Qiang, Rushi, et al.
Published: (2025) -
Reasoning as Gradient: Scaling MLE Agents Beyond Tree Search
by: Zhang, Yifei, et al.
Published: (2026) -
AI Research Agents for Machine Learning: Search, Exploration, and Generalization in MLE-bench
by: Toledo, Edan, et al.
Published: (2025) -
Matryoshka Pilot: Learning to Drive Black-Box LLMs with LLMs
by: Li, Changhao, et al.
Published: (2024) -
HYDRA: Model Factorization Framework for Black-Box LLM Personalization
by: Zhuang, Yuchen, et al.
Published: (2024)