AutoLLMResearch: Training Research Agents for Automating LLM Experiment Configuration - Learning from Cheap, Optimizing Expensive
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guo, Taicheng, Chawla, Nitesh V., Wiest, Olaf, Zhang, Xiangliang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Large Language Model based Multi-Agents: A Survey of Progress and Challenges
par: Guo, Taicheng, et autres
Publié: (2024)
par: Guo, Taicheng, et autres
Publié: (2024)
AutoSG: LLM-Driven Solver Generation Solely from Task Prompts for Expensive Optimization
par: Gu, Haoran, et autres
Publié: (2026)
par: Gu, Haoran, et autres
Publié: (2026)
Exploring Multi-Temperature Strategies for Token- and Rollout-Level Control in RLVR
par: Zhuang, Haomin, et autres
Publié: (2025)
par: Zhuang, Haomin, et autres
Publié: (2025)
MTSQL-R1: Towards Long-Horizon Multi-Turn Text-to-SQL via Agentic Training
par: Guo, Taicheng, et autres
Publié: (2025)
par: Guo, Taicheng, et autres
Publié: (2025)
Automated Benchmark Generation from Domain Guidelines Informed by Bloom's Taxonomy
par: Chen, Si, et autres
Publié: (2026)
par: Chen, Si, et autres
Publié: (2026)
AutoAgent: A Fully-Automated and Zero-Code Framework for LLM Agents
par: Tang, Jiabin, et autres
Publié: (2025)
par: Tang, Jiabin, et autres
Publié: (2025)
Justice or Prejudice? Quantifying Biases in LLM-as-a-Judge
par: Ye, Jiayi, et autres
Publié: (2024)
par: Ye, Jiayi, et autres
Publié: (2024)
Breaking Language Barriers: Equitable Performance in Multilingual Language Models
par: Nagar, Tanay, et autres
Publié: (2025)
par: Nagar, Tanay, et autres
Publié: (2025)
Position: The Most Expensive Part of an LLM should be its Training Data
par: Kandpal, Nikhil, et autres
Publié: (2025)
par: Kandpal, Nikhil, et autres
Publié: (2025)
Adaptive Testing for LLM Evaluation: A Psychometric Alternative to Static Benchmarks
par: Li, Peiyu, et autres
Publié: (2025)
par: Li, Peiyu, et autres
Publié: (2025)
AutoQual: An LLM Agent for Automated Discovery of Interpretable Features for Review Quality Assessment
par: Lan, Xiaochong, et autres
Publié: (2025)
par: Lan, Xiaochong, et autres
Publié: (2025)
SceMQA: A Scientific College Entrance Level Multimodal Question Answering Benchmark
par: Liang, Zhenwen, et autres
Publié: (2024)
par: Liang, Zhenwen, et autres
Publié: (2024)
AutoPDL: Automatic Prompt Optimization for LLM Agents
par: Spiess, Claudio, et autres
Publié: (2025)
par: Spiess, Claudio, et autres
Publié: (2025)
AutoContext: Instance-Level Context Learning for LLM Agents
par: Cai, Kuntai, et autres
Publié: (2025)
par: Cai, Kuntai, et autres
Publié: (2025)
Artificial Intelligence in Spectroscopy: Advancing Chemistry from Prediction to Generation and Beyond
par: Guo, Kehan, et autres
Publié: (2025)
par: Guo, Kehan, et autres
Publié: (2025)
MolX: Enhancing Large Language Models for Molecular Understanding With A Multi-Modal Extension
par: Le, Khiem, et autres
Publié: (2024)
par: Le, Khiem, et autres
Publié: (2024)
Dual Optimal: Make Your LLM Peer-like with Dignity
par: Wang, Xiangqi, et autres
Publié: (2026)
par: Wang, Xiangqi, et autres
Publié: (2026)
AutoEnv: Automated Environments for Measuring Cross-Environment Agent Learning
par: Zhang, Jiayi, et autres
Publié: (2025)
par: Zhang, Jiayi, et autres
Publié: (2025)
AutoManual: Constructing Instruction Manuals by LLM Agents via Interactive Environmental Learning
par: Chen, Minghao, et autres
Publié: (2024)
par: Chen, Minghao, et autres
Publié: (2024)
Route to Rome Attack: Directing LLM Routers to Expensive Models via Adversarial Suffix Optimization
par: Tang, Haochun, et autres
Publié: (2026)
par: Tang, Haochun, et autres
Publié: (2026)
Beyond Answers: Transferring Reasoning Capabilities to Smaller LLMs Using Multi-Teacher Knowledge Distillation
par: Tian, Yijun, et autres
Publié: (2024)
par: Tian, Yijun, et autres
Publié: (2024)
PEDANTS: Cheap but Effective and Interpretable Answer Equivalence
par: Li, Zongxia, et autres
Publié: (2024)
par: Li, Zongxia, et autres
Publié: (2024)
AutoForge: Automated Environment Synthesis for Agentic Reinforcement Learning
par: Cai, Shihao, et autres
Publié: (2025)
par: Cai, Shihao, et autres
Publié: (2025)
AutoEvoEval: An Automated Framework for Evolving Close-Ended LLM Evaluation Data
par: Wu, JiaRu, et autres
Publié: (2025)
par: Wu, JiaRu, et autres
Publié: (2025)
AutoToM: Scaling Model-based Mental Inference via Automated Agent Modeling
par: Zhang, Zhining, et autres
Publié: (2025)
par: Zhang, Zhining, et autres
Publié: (2025)
Talk Isn't Always Cheap: Understanding Failure Modes in Multi-Agent Debate
par: Wynn, Andrea, et autres
Publié: (2025)
par: Wynn, Andrea, et autres
Publié: (2025)
ReactionTeam: Teaming Experts for Divergent Thinking Beyond Typical Reaction Patterns
par: Guo, Taicheng, et autres
Publié: (2023)
par: Guo, Taicheng, et autres
Publié: (2023)
OpenSeal: Good, Fast, and Cheap Construction of an Open-Source Southeast Asian LLM via Parallel Data
par: Nguyen, Tan Sang, et autres
Publié: (2026)
par: Nguyen, Tan Sang, et autres
Publié: (2026)
LaMDAgent: An Autonomous Framework for Post-Training Pipeline Optimization via LLM Agents
par: Yano, Taro, et autres
Publié: (2025)
par: Yano, Taro, et autres
Publié: (2025)
Dissecting Logical Reasoning in LLMs: A Fine-Grained Evaluation and Supervision Study
par: Zhou, Yujun, et autres
Publié: (2025)
par: Zhou, Yujun, et autres
Publié: (2025)
T-RAG: Lessons from the LLM Trenches
par: Fatehkia, Masoomali, et autres
Publié: (2024)
par: Fatehkia, Masoomali, et autres
Publié: (2024)
AutoFlow: Automated Workflow Generation for Large Language Model Agents
par: Li, Zelong, et autres
Publié: (2024)
par: Li, Zelong, et autres
Publié: (2024)
ARCANE: A Multi-Agent Framework for Interpretable and Configurable Alignment
par: Masters, Charlie, et autres
Publié: (2025)
par: Masters, Charlie, et autres
Publié: (2025)
Interactions Across Blocks in Post-Training Quantization of Large Language Models
par: Shabanovi, Khasmamad, et autres
Publié: (2024)
par: Shabanovi, Khasmamad, et autres
Publié: (2024)
Automated Survey Collection with LLM-based Conversational Agents
par: Kaiyrbekov, Kurmanbek, et autres
Publié: (2025)
par: Kaiyrbekov, Kurmanbek, et autres
Publié: (2025)
UGMAE: A Unified Framework for Graph Masked Autoencoders
par: Tian, Yijun, et autres
Publié: (2024)
par: Tian, Yijun, et autres
Publié: (2024)
ResearchCodeAgent: An LLM Multi-Agent System for Automated Codification of Research Methodologies
par: Gandhi, Shubham, et autres
Publié: (2025)
par: Gandhi, Shubham, et autres
Publié: (2025)
AutoIOT: LLM-Driven Automated Natural Language Programming for AIoT Applications
par: Shen, Leming, et autres
Publié: (2025)
par: Shen, Leming, et autres
Publié: (2025)
AutoML-Agent: A Multi-Agent LLM Framework for Full-Pipeline AutoML
par: Trirat, Patara, et autres
Publié: (2024)
par: Trirat, Patara, et autres
Publié: (2024)
Optimizing In-Context Demonstrations for LLM-based Automated Grading
par: Chu, Yucheng, et autres
Publié: (2026)
par: Chu, Yucheng, et autres
Publié: (2026)
Documents similaires
-
Large Language Model based Multi-Agents: A Survey of Progress and Challenges
par: Guo, Taicheng, et autres
Publié: (2024) -
AutoSG: LLM-Driven Solver Generation Solely from Task Prompts for Expensive Optimization
par: Gu, Haoran, et autres
Publié: (2026) -
Exploring Multi-Temperature Strategies for Token- and Rollout-Level Control in RLVR
par: Zhuang, Haomin, et autres
Publié: (2025) -
MTSQL-R1: Towards Long-Horizon Multi-Turn Text-to-SQL via Agentic Training
par: Guo, Taicheng, et autres
Publié: (2025) -
Automated Benchmark Generation from Domain Guidelines Informed by Bloom's Taxonomy
par: Chen, Si, et autres
Publié: (2026)