Reinforcement Learning for LLM-based Multi-Agent Systems through Orchestration Traces
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Zhang, Chenchen |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Agent Q-Mix: Selecting the Right Action for LLM Multi-Agent Systems through Reinforcement Learning
par: Jiang, Eric Hanchen, et autres
Publié: (2026)
par: Jiang, Eric Hanchen, et autres
Publié: (2026)
From Reasoning to Agentic: Credit Assignment in Reinforcement Learning for Large Language Models
par: Zhang, Chenchen
Publié: (2026)
par: Zhang, Chenchen
Publié: (2026)
Learning Latency-Aware Orchestration for Parallel Multi-Agent Systems
par: Shi, Xi, et autres
Publié: (2026)
par: Shi, Xi, et autres
Publié: (2026)
Reinforcement World Model Learning for LLM-based Agents
par: Yu, Xiao, et autres
Publié: (2026)
par: Yu, Xiao, et autres
Publié: (2026)
Reinforce LLM Reasoning through Multi-Agent Reflection
par: Yuan, Yurun, et autres
Publié: (2025)
par: Yuan, Yurun, et autres
Publié: (2025)
Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning
par: Wu, Yihong, et autres
Publié: (2025)
par: Wu, Yihong, et autres
Publié: (2025)
ClinicalAgents: Multi-Agent Orchestration for Clinical Decision Making with Dual-Memory
par: Ge, Zhuohan, et autres
Publié: (2026)
par: Ge, Zhuohan, et autres
Publié: (2026)
Real-World Doctor Agent with Proactive Consultation through Multi-Agent Reinforcement Learning
par: Feng, Yichun, et autres
Publié: (2025)
par: Feng, Yichun, et autres
Publié: (2025)
The Evolution of Tool Use in LLM Agents: From Single-Tool Call to Multi-Tool Orchestration
par: Xu, Haoyuan, et autres
Publié: (2026)
par: Xu, Haoyuan, et autres
Publié: (2026)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
par: Xi, Zhiheng, et autres
Publié: (2025)
par: Xi, Zhiheng, et autres
Publié: (2025)
MARCH: Multi-Agent Reinforced Self-Check for LLM Hallucination
par: Li, Zhuo, et autres
Publié: (2026)
par: Li, Zhuo, et autres
Publié: (2026)
Improving Retrieval-Augmented Generation through Multi-Agent Reinforcement Learning
par: Chen, Yiqun, et autres
Publié: (2025)
par: Chen, Yiqun, et autres
Publié: (2025)
Unifying Language Agent Algorithms with Graph-based Orchestration Engine for Reproducible Agent Research
par: Zhang, Qianqian, et autres
Publié: (2025)
par: Zhang, Qianqian, et autres
Publié: (2025)
AgentNet: Decentralized Evolutionary Coordination for LLM-based Multi-Agent Systems
par: Yang, Yingxuan, et autres
Publié: (2025)
par: Yang, Yingxuan, et autres
Publié: (2025)
Disagreement as Data: Reasoning Trace Analytics in Multi-Agent Systems
par: Tajik, Elham, et autres
Publié: (2026)
par: Tajik, Elham, et autres
Publié: (2026)
Response-Conditioned Parallel-to-Sequential Orchestration for Multi-Agent Systems
par: Tastan, Nurbek, et autres
Publié: (2026)
par: Tastan, Nurbek, et autres
Publié: (2026)
Bayesian Orchestration of Multi-LLM Agents for Cost-Aware Sequential Decision-Making
par: Amin, Danial
Publié: (2026)
par: Amin, Danial
Publié: (2026)
MASA: LLM-Driven Multi-Agent Systems for Autoformalization
par: Zhang, Lan, et autres
Publié: (2025)
par: Zhang, Lan, et autres
Publié: (2025)
LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions
par: Sun, Chuanneng, et autres
Publié: (2024)
par: Sun, Chuanneng, et autres
Publié: (2024)
Controlling Performance and Budget of a Centralized Multi-agent LLM System with Reinforcement Learning
par: Jin, Bowen, et autres
Publié: (2025)
par: Jin, Bowen, et autres
Publié: (2025)
AMAS: Adaptively Determining Communication Topology for LLM-based Multi-Agent System
par: Leong, Hui Yi, et autres
Publié: (2025)
par: Leong, Hui Yi, et autres
Publié: (2025)
Insight Agents: An LLM-Based Multi-Agent System for Data Insights
par: Bai, Jincheng, et autres
Publié: (2026)
par: Bai, Jincheng, et autres
Publié: (2026)
Maestro: Reinforcement Learning to Orchestrate Hierarchical Model-Skill Ensembles
par: Wu, Jinyang, et autres
Publié: (2026)
par: Wu, Jinyang, et autres
Publié: (2026)
MAO-ARAG: Multi-Agent Orchestration for Adaptive Retrieval-Augmented Generation
par: Chen, Yiqun, et autres
Publié: (2025)
par: Chen, Yiqun, et autres
Publié: (2025)
Creativity in LLM-based Multi-Agent Systems: A Survey
par: Lin, Yi-Cheng, et autres
Publié: (2025)
par: Lin, Yi-Cheng, et autres
Publié: (2025)
G-Memory: Tracing Hierarchical Memory for Multi-Agent Systems
par: Zhang, Guibin, et autres
Publié: (2025)
par: Zhang, Guibin, et autres
Publié: (2025)
Multi-Agent Collaboration via Evolving Orchestration
par: Dang, Yufan, et autres
Publié: (2025)
par: Dang, Yufan, et autres
Publié: (2025)
FinCon: A Synthesized LLM Multi-Agent System with Conceptual Verbal Reinforcement for Enhanced Financial Decision Making
par: Yu, Yangyang, et autres
Publié: (2024)
par: Yu, Yangyang, et autres
Publié: (2024)
SkillMAS: Skill Co-Evolution with LLM-based Multi-Agent System
par: Pan, Shuai, et autres
Publié: (2026)
par: Pan, Shuai, et autres
Publié: (2026)
WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning
par: Zhuang, Yuchen, et autres
Publié: (2025)
par: Zhuang, Yuchen, et autres
Publié: (2025)
PARL: Prompt-based Agents for Reinforcement Learning
par: Resendiz, Yarik Menchaca, et autres
Publié: (2025)
par: Resendiz, Yarik Menchaca, et autres
Publié: (2025)
PersonaTrace: Synthesizing Realistic Digital Footprints with LLM Agents
par: Wang, Minjia, et autres
Publié: (2026)
par: Wang, Minjia, et autres
Publié: (2026)
MASCA: LLM based-Multi Agents System for Credit Assessment
par: Jajoo, Gautam, et autres
Publié: (2025)
par: Jajoo, Gautam, et autres
Publié: (2025)
Multi-Task Reinforcement Learning for Enhanced Multimodal LLM-as-a-Judge
par: Wu, Junjie, et autres
Publié: (2026)
par: Wu, Junjie, et autres
Publié: (2026)
Tool-to-Agent Retrieval: Bridging Tools and Agents for Scalable LLM Multi-Agent Systems
par: Lumer, Elias, et autres
Publié: (2025)
par: Lumer, Elias, et autres
Publié: (2025)
Organizing, Orchestrating, and Benchmarking Agent Skills at Ecosystem Scale
par: Li, Hao, et autres
Publié: (2026)
par: Li, Hao, et autres
Publié: (2026)
Every Response Counts: Quantifying Uncertainty of LLM-based Multi-Agent Systems through Tensor Decomposition
par: Chen, Tiejin, et autres
Publié: (2026)
par: Chen, Tiejin, et autres
Publié: (2026)
Dynamic Optimizations of LLM Ensembles with Two-Stage Reinforcement Learning Agents
par: Tekin, Selim Furkan, et autres
Publié: (2025)
par: Tekin, Selim Furkan, et autres
Publié: (2025)
Bridging the Capability Gap: Joint Alignment Tuning for Harmonizing LLM-based Multi-Agent Systems
par: Zhu, Minghang, et autres
Publié: (2025)
par: Zhu, Minghang, et autres
Publié: (2025)
MARCO: Multi-Agent Real-time Chat Orchestration
par: Shrimal, Anubhav, et autres
Publié: (2024)
par: Shrimal, Anubhav, et autres
Publié: (2024)
Documents similaires
-
Agent Q-Mix: Selecting the Right Action for LLM Multi-Agent Systems through Reinforcement Learning
par: Jiang, Eric Hanchen, et autres
Publié: (2026) -
From Reasoning to Agentic: Credit Assignment in Reinforcement Learning for Large Language Models
par: Zhang, Chenchen
Publié: (2026) -
Learning Latency-Aware Orchestration for Parallel Multi-Agent Systems
par: Shi, Xi, et autres
Publié: (2026) -
Reinforcement World Model Learning for LLM-based Agents
par: Yu, Xiao, et autres
Publié: (2026) -
Reinforce LLM Reasoning through Multi-Agent Reflection
par: Yuan, Yurun, et autres
Publié: (2025)