Can We Predict Before Executing Machine Learning Agents?
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zheng, Jingsheng, Zhang, Jintian, Luo, Yujie, Mao, Yuren, Gao, Yunjun, Du, Lun, Chen, Huajun, Zhang, Ningyu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
AutoMind: Adaptive Knowledgeable Agent for Automated Data Science
von: Ou, Yixin, et al.
Veröffentlicht: (2025)
von: Ou, Yixin, et al.
Veröffentlicht: (2025)
InnoGym: Benchmarking the Innovation Potential of AI Agents
von: Zhang, Jintian, et al.
Veröffentlicht: (2025)
von: Zhang, Jintian, et al.
Veröffentlicht: (2025)
Why Do Open-Source LLMs Struggle with Data Analysis? A Systematic Empirical Study
von: Zhu, Yuqi, et al.
Veröffentlicht: (2025)
von: Zhu, Yuqi, et al.
Veröffentlicht: (2025)
What Makes AI Research Replicable? Executable Knowledge Graphs as Scientific Knowledge Representations
von: Luo, Yujie, et al.
Veröffentlicht: (2025)
von: Luo, Yujie, et al.
Veröffentlicht: (2025)
AutoAct: Automatic Agent Learning from Scratch for QA via Self-Planning
von: Qiao, Shuofei, et al.
Veröffentlicht: (2024)
von: Qiao, Shuofei, et al.
Veröffentlicht: (2024)
Exploring Collaboration Mechanisms for LLM Agents: A Social Psychology View
von: Zhang, Jintian, et al.
Veröffentlicht: (2023)
von: Zhang, Jintian, et al.
Veröffentlicht: (2023)
KnowRL: Exploring Knowledgeable Reinforcement Learning for Factuality
von: Ren, Baochang, et al.
Veröffentlicht: (2025)
von: Ren, Baochang, et al.
Veröffentlicht: (2025)
Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis
von: Qiu, Zhisong, et al.
Veröffentlicht: (2026)
von: Qiu, Zhisong, et al.
Veröffentlicht: (2026)
Agent-Kernel: A MicroKernel Multi-Agent System Framework for Adaptive Social Simulation Powered by LLMs
von: Mao, Yuren, et al.
Veröffentlicht: (2025)
von: Mao, Yuren, et al.
Veröffentlicht: (2025)
StackPilot: Autonomous Function Agents for Scalable and Environment-Free Code Execution
von: Zhao, Xinkui, et al.
Veröffentlicht: (2025)
von: Zhao, Xinkui, et al.
Veröffentlicht: (2025)
Memp: Exploring Agent Procedural Memory
von: Fang, Runnan, et al.
Veröffentlicht: (2025)
von: Fang, Runnan, et al.
Veröffentlicht: (2025)
How Brittle is Agent Safety? Rethinking Agent Risk under Intent Concealment and Task Complexity
von: Ma, Zihan, et al.
Veröffentlicht: (2025)
von: Ma, Zihan, et al.
Veröffentlicht: (2025)
A-MapReduce: Executing Wide Search via Agentic MapReduce
von: Chen, Mingju, et al.
Veröffentlicht: (2026)
von: Chen, Mingju, et al.
Veröffentlicht: (2026)
Exploring Model Kinship for Merging Large Language Models
von: Hu, Yedi, et al.
Veröffentlicht: (2024)
von: Hu, Yedi, et al.
Veröffentlicht: (2024)
KnowAgent: Knowledge-Augmented Planning for LLM-Based Agents
von: Zhu, Yuqi, et al.
Veröffentlicht: (2024)
von: Zhu, Yuqi, et al.
Veröffentlicht: (2024)
StitchCUDA: An Automated Multi-Agents End-to-End GPU Programing Framework with Rubric-based Agentic Reinforcement Learning
von: Li, Shiyang, et al.
Veröffentlicht: (2026)
von: Li, Shiyang, et al.
Veröffentlicht: (2026)
SkillMAS: Skill Co-Evolution with LLM-based Multi-Agent System
von: Pan, Shuai, et al.
Veröffentlicht: (2026)
von: Pan, Shuai, et al.
Veröffentlicht: (2026)
Can We Govern the Agent-to-Agent Economy?
von: Chaffer, Tomer Jordi
Veröffentlicht: (2025)
von: Chaffer, Tomer Jordi
Veröffentlicht: (2025)
Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems
von: Zhang, Shaokun, et al.
Veröffentlicht: (2025)
von: Zhang, Shaokun, et al.
Veröffentlicht: (2025)
RunAgent: Interpreting Natural-Language Plans with Constraint-Guided Execution
von: Srivastava, Arunabh, et al.
Veröffentlicht: (2026)
von: Srivastava, Arunabh, et al.
Veröffentlicht: (2026)
SPASM: Stable Persona-driven Agent Simulation for Multi-turn Dialogue Generation
von: Luo, Han, et al.
Veröffentlicht: (2026)
von: Luo, Han, et al.
Veröffentlicht: (2026)
AgentForesight: Online Auditing for Early Failure Prediction in Multi-Agent Systems
von: Zhang, Boxuan, et al.
Veröffentlicht: (2026)
von: Zhang, Boxuan, et al.
Veröffentlicht: (2026)
CONSCIENTIA: Can LLM Agents Learn to Strategize? Emergent Deception and Trust in a Multi-Agent NYC Simulation
von: Sinha, Aarush, et al.
Veröffentlicht: (2026)
von: Sinha, Aarush, et al.
Veröffentlicht: (2026)
Cognitive Duality for Adaptive Web Agents
von: Liu, Jiarun, et al.
Veröffentlicht: (2025)
von: Liu, Jiarun, et al.
Veröffentlicht: (2025)
PTDE: Personalized Training with Distilled Execution for Multi-Agent Reinforcement Learning
von: Chen, Yiqun, et al.
Veröffentlicht: (2022)
von: Chen, Yiqun, et al.
Veröffentlicht: (2022)
Agent Planning with World Knowledge Model
von: Qiao, Shuofei, et al.
Veröffentlicht: (2024)
von: Qiao, Shuofei, et al.
Veröffentlicht: (2024)
AgentNet: Decentralized Evolutionary Coordination for LLM-based Multi-Agent Systems
von: Yang, Yingxuan, et al.
Veröffentlicht: (2025)
von: Yang, Yingxuan, et al.
Veröffentlicht: (2025)
You Only Align Once: Propagating Cooperative Behaviors in Multi-Agent Systems through Seed Agents
von: Hsing, Nicole, et al.
Veröffentlicht: (2026)
von: Hsing, Nicole, et al.
Veröffentlicht: (2026)
Beyond Self-Talk: A Communication-Centric Survey of LLM-Based Multi-Agent Systems
von: Yan, Bingyu, et al.
Veröffentlicht: (2025)
von: Yan, Bingyu, et al.
Veröffentlicht: (2025)
GEMA-Score: Granular Explainable Multi-Agent Scoring Framework for Radiology Report Evaluation
von: Zhang, Zhenxuan, et al.
Veröffentlicht: (2025)
von: Zhang, Zhenxuan, et al.
Veröffentlicht: (2025)
MAS-GPT: Training LLMs to Build LLM-based Multi-Agent Systems
von: Ye, Rui, et al.
Veröffentlicht: (2025)
von: Ye, Rui, et al.
Veröffentlicht: (2025)
MARBLE: A Multi-Agent Rule-Based LLM Reasoning Engine for Accident Severity Prediction
von: Qasim, Kaleem Ullah, et al.
Veröffentlicht: (2025)
von: Qasim, Kaleem Ullah, et al.
Veröffentlicht: (2025)
The Subtle Art of Defection: Understanding Uncooperative Behaviors in LLM based Multi-Agent Systems
von: Kulshreshtha, Devang, et al.
Veröffentlicht: (2025)
von: Kulshreshtha, Devang, et al.
Veröffentlicht: (2025)
One Panel Does Not Fit All: Case-Adaptive Multi-Agent Deliberation for Clinical Prediction
von: Lu, Yuxing, et al.
Veröffentlicht: (2026)
von: Lu, Yuxing, et al.
Veröffentlicht: (2026)
Breaking Event Rumor Detection via Stance-Separated Multi-Agent Debate
von: Zhang, Mingqing, et al.
Veröffentlicht: (2024)
von: Zhang, Mingqing, et al.
Veröffentlicht: (2024)
MemEvolve: Meta-Evolution of Agent Memory Systems
von: Zhang, Guibin, et al.
Veröffentlicht: (2025)
von: Zhang, Guibin, et al.
Veröffentlicht: (2025)
Following the TRACE: A Structured Path to Empathetic Response Generation with Multi-Agent Models
von: Liu, Ziqi, et al.
Veröffentlicht: (2025)
von: Liu, Ziqi, et al.
Veröffentlicht: (2025)
Learning Latency-Aware Orchestration for Parallel Multi-Agent Systems
von: Shi, Xi, et al.
Veröffentlicht: (2026)
von: Shi, Xi, et al.
Veröffentlicht: (2026)
EvoRoute: Experience-Driven Self-Routing LLM Agent Systems
von: Zhang, Guibin, et al.
Veröffentlicht: (2026)
von: Zhang, Guibin, et al.
Veröffentlicht: (2026)
A Survey on LLM-based Multi-Agent System: Recent Advances and New Frontiers in Application
von: Chen, Shuaihang, et al.
Veröffentlicht: (2024)
von: Chen, Shuaihang, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
AutoMind: Adaptive Knowledgeable Agent for Automated Data Science
von: Ou, Yixin, et al.
Veröffentlicht: (2025) -
InnoGym: Benchmarking the Innovation Potential of AI Agents
von: Zhang, Jintian, et al.
Veröffentlicht: (2025) -
Why Do Open-Source LLMs Struggle with Data Analysis? A Systematic Empirical Study
von: Zhu, Yuqi, et al.
Veröffentlicht: (2025) -
What Makes AI Research Replicable? Executable Knowledge Graphs as Scientific Knowledge Representations
von: Luo, Yujie, et al.
Veröffentlicht: (2025) -
AutoAct: Automatic Agent Learning from Scratch for QA via Self-Planning
von: Qiao, Shuofei, et al.
Veröffentlicht: (2024)