ArchPilot: A Proxy-Guided Multi-Agent Approach for Machine Learning Engineering
Fuente:
arXiv
Saved in:
| Main Authors: | Yuan, Zhuowen, Liu, Tao, Yang, Yang, Wang, Yang, Qi, Feng, Rangadurai, Kaushik, Li, Bo, Yang, Shuang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
STARK: Strategic Team of Agents for Refining Kernels
by: Dong, Juncheng, et al.
Published: (2025)
by: Dong, Juncheng, et al.
Published: (2025)
Descent-Guided Policy Gradient for Scalable Cooperative Multi-Agent Learning
by: Yang, Shan, et al.
Published: (2026)
by: Yang, Shan, et al.
Published: (2026)
Reinforcement Learning for Machine Learning Engineering Agents
by: Yang, Sherry, et al.
Published: (2025)
by: Yang, Sherry, et al.
Published: (2025)
Beyond Self-Consistency: Loss-Balanced Perturbation-Based Regularization Improves Industrial-Scale Ads Ranking
by: Ramazanli, Ilqar, et al.
Published: (2025)
by: Ramazanli, Ilqar, et al.
Published: (2025)
MarsRL: Advancing Multi-Agent Reasoning System via Reinforcement Learning with Agentic Pipeline Parallelism
by: Liu, Shulin, et al.
Published: (2025)
by: Liu, Shulin, et al.
Published: (2025)
CoMind: Towards Community-Driven Agents for Machine Learning Engineering
by: Li, Sijie, et al.
Published: (2025)
by: Li, Sijie, et al.
Published: (2025)
Enhancing Embedding Representation Stability in Recommendation Systems with Semantic ID
by: Zheng, Carolina, et al.
Published: (2025)
by: Zheng, Carolina, et al.
Published: (2025)
UDora: A Unified Red Teaming Framework against LLM Agents by Dynamically Hijacking Their Own Reasoning
by: Zhang, Jiawei, et al.
Published: (2025)
by: Zhang, Jiawei, et al.
Published: (2025)
Evolutionary Enhanced Multi-Agent Reinforcement Learning for Cooperative Air Combat
by: Li, Chengwei, et al.
Published: (2026)
by: Li, Chengwei, et al.
Published: (2026)
Robust and Efficient Communication in Multi-Agent Reinforcement Learning
by: Liu, Zejiao, et al.
Published: (2025)
by: Liu, Zejiao, et al.
Published: (2025)
Unveiling Latent Causal Rules: A Temporal Point Process Approach for Abnormal Event Explanation
by: Kuang, Yiling, et al.
Published: (2024)
by: Kuang, Yiling, et al.
Published: (2024)
Reducing Cognitive Overhead in Tool Use via Multi-Small-Agent Reinforcement Learning
by: Wang, Dayu, et al.
Published: (2025)
by: Wang, Dayu, et al.
Published: (2025)
TMAS: Scaling Test-Time Compute via Multi-Agent Synergy
by: Wu, George, et al.
Published: (2026)
by: Wu, George, et al.
Published: (2026)
FedProxy: Federated Fine-Tuning of LLMs via Proxy SLMs and Heterogeneity-Aware Fusion
by: Fan, Tao, et al.
Published: (2026)
by: Fan, Tao, et al.
Published: (2026)
Catching the Infection Before It Spreads: Foresight-Guided Defense in Multi-Agent Systems
by: Ma, Yue, et al.
Published: (2026)
by: Ma, Yue, et al.
Published: (2026)
MaskMA: Towards Zero-Shot Multi-Agent Decision Making with Mask-Based Collaborative Learning
by: Liu, Jie, et al.
Published: (2023)
by: Liu, Jie, et al.
Published: (2023)
Efficient UAV Swarm-Based Multi-Task Federated Learning with Dynamic Task Knowledge Sharing
by: Yang, Yubo, et al.
Published: (2025)
by: Yang, Yubo, et al.
Published: (2025)
RWKVQuant: Quantizing the RWKV Family with Proxy Guided Hybrid of Scalar and Vector Quantization
by: Xu, Chen, et al.
Published: (2025)
by: Xu, Chen, et al.
Published: (2025)
Learning Generalizable Skills from Offline Multi-Task Data for Multi-Agent Cooperation
by: Liu, Sicong, et al.
Published: (2025)
by: Liu, Sicong, et al.
Published: (2025)
UloRL:An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities
by: Du, Dong, et al.
Published: (2025)
by: Du, Dong, et al.
Published: (2025)
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
by: Yang, Guang, et al.
Published: (2025)
by: Yang, Guang, et al.
Published: (2025)
Resisting Manipulative Bots in Meme Coin Copy Trading: A Multi-Agent Approach with Chain-of-Thought Reasoning
by: Luo, Yichen, et al.
Published: (2026)
by: Luo, Yichen, et al.
Published: (2026)
Partially Observable Mean Field Multi-Agent Reinforcement Learning Based on Graph-Attention
by: Yang, Min, et al.
Published: (2023)
by: Yang, Min, et al.
Published: (2023)
The Lighthouse of Language: Enhancing LLM Agents via Critique-Guided Improvement
by: Yang, Ruihan, et al.
Published: (2025)
by: Yang, Ruihan, et al.
Published: (2025)
cuPilot: A Strategy-Coordinated Multi-agent Framework for CUDA Kernel Evolution
by: Chen, Jinwu, et al.
Published: (2025)
by: Chen, Jinwu, et al.
Published: (2025)
Know When to Explore: Difficulty-Aware Certainty as a Guide for LLM Reinforcement Learning
by: Li, Ang, et al.
Published: (2025)
by: Li, Ang, et al.
Published: (2025)
Robust Multi-Agent Reinforcement Learning by Mutual Information Regularization
by: Li, Simin, et al.
Published: (2023)
by: Li, Simin, et al.
Published: (2023)
Whispers in the Noise: Surrogate-Guided Concept Awakening via a Multi-Agent Framework
by: Sun, Mengyu, et al.
Published: (2026)
by: Sun, Mengyu, et al.
Published: (2026)
InqEduAgent: Adaptive AI Learning Partners with Gaussian Process Augmentation
by: Yang, Wen-Xi, et al.
Published: (2025)
by: Yang, Wen-Xi, et al.
Published: (2025)
Agent^2 RL-Bench: Can LLM Agents Engineer Agentic RL Post-Training?
by: Chen, Wanyi, et al.
Published: (2026)
by: Chen, Wanyi, et al.
Published: (2026)
Hierarchical Structured Neural Network: Efficient Retrieval Scaling for Large Scale Recommendation
by: Rangadurai, Kaushik, et al.
Published: (2024)
by: Rangadurai, Kaushik, et al.
Published: (2024)
SentinelNet: Safeguarding Multi-Agent Collaboration Through Credit-Based Dynamic Threat Detection
by: Feng, Yang, et al.
Published: (2025)
by: Feng, Yang, et al.
Published: (2025)
Doc-Guided Sent2Sent++: A Sent2Sent++ Agent with Doc-Guided memory for Document-level Machine Translation
by: Guo, Jiaxin, et al.
Published: (2025)
by: Guo, Jiaxin, et al.
Published: (2025)
EvoAgent: Towards Automatic Multi-Agent Generation via Evolutionary Algorithms
by: Yuan, Siyu, et al.
Published: (2024)
by: Yuan, Siyu, et al.
Published: (2024)
GlobeDiff: State Diffusion Process for Partial Observability in Multi-Agent Systems
by: Yang, Yiqin, et al.
Published: (2026)
by: Yang, Yiqin, et al.
Published: (2026)
ACC-Collab: An Actor-Critic Approach to Multi-Agent LLM Collaboration
by: Estornell, Andrew, et al.
Published: (2024)
by: Estornell, Andrew, et al.
Published: (2024)
SeBot: Structural Entropy Guided Multi-View Contrastive Learning for Social Bot Detection
by: Yang, Yingguang, et al.
Published: (2024)
by: Yang, Yingguang, et al.
Published: (2024)
GroupGuard: A Framework for Modeling and Defending Collusive Attacks in Multi-Agent Systems
by: Tao, Yiling, et al.
Published: (2026)
by: Tao, Yiling, et al.
Published: (2026)
ML-Agent: Reinforcing LLM Agents for Autonomous Machine Learning Engineering
by: Liu, Zexi, et al.
Published: (2025)
by: Liu, Zexi, et al.
Published: (2025)
Proxy-RLHF: Decoupling Generation and Alignment in Large Language Model with Proxy
by: Zhu, Yu, et al.
Published: (2024)
by: Zhu, Yu, et al.
Published: (2024)
Similar Items
-
STARK: Strategic Team of Agents for Refining Kernels
by: Dong, Juncheng, et al.
Published: (2025) -
Descent-Guided Policy Gradient for Scalable Cooperative Multi-Agent Learning
by: Yang, Shan, et al.
Published: (2026) -
Reinforcement Learning for Machine Learning Engineering Agents
by: Yang, Sherry, et al.
Published: (2025) -
Beyond Self-Consistency: Loss-Balanced Perturbation-Based Regularization Improves Industrial-Scale Ads Ranking
by: Ramazanli, Ilqar, et al.
Published: (2025) -
MarsRL: Advancing Multi-Agent Reasoning System via Reinforcement Learning with Agentic Pipeline Parallelism
by: Liu, Shulin, et al.
Published: (2025)