How to Train a Leader: Hierarchical Reasoning in Multi-Agent LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Estornell, Andrew, Ton, Jean-Francois, Taufiq, Muhammad Faaiz, Li, Hang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Understanding Chain-of-Thought in LLMs through Information Theory
par: Ton, Jean-Francois, et autres
Publié: (2024)
par: Ton, Jean-Francois, et autres
Publié: (2024)
Emergence of Fair Leaders via Mediators in Multi-Agent Reinforcement Learning
par: Dodwadmath, Akshay, et autres
Publié: (2025)
par: Dodwadmath, Akshay, et autres
Publié: (2025)
Robust Multi-Agent LLMs under Byzantine Faults
par: Lee, Haejoon, et autres
Publié: (2026)
par: Lee, Haejoon, et autres
Publié: (2026)
PeerGuard: Defending Multi-Agent Systems Against Backdoor Attacks Through Mutual Reasoning
par: Fan, Falong, et autres
Publié: (2025)
par: Fan, Falong, et autres
Publié: (2025)
Embodiment-Induced Coordination Regimes in Tabular Multi-Agent Q-Learning
par: Atif, Muhammad Ahmed, et autres
Publié: (2026)
par: Atif, Muhammad Ahmed, et autres
Publié: (2026)
Talk Structurally, Act Hierarchically: A Collaborative Framework for LLM Multi-Agent Systems
par: Wang, Zhao, et autres
Publié: (2025)
par: Wang, Zhao, et autres
Publié: (2025)
PTDE: Personalized Training with Distilled Execution for Multi-Agent Reinforcement Learning
par: Chen, Yiqun, et autres
Publié: (2022)
par: Chen, Yiqun, et autres
Publié: (2022)
Agent-Oriented Planning in Multi-Agent Systems
par: Li, Ao, et autres
Publié: (2024)
par: Li, Ao, et autres
Publié: (2024)
HDDLGym: A Tool for Studying Multi-Agent Hierarchical Problems Defined in HDDL with OpenAI Gym
par: La, Ngoc, et autres
Publié: (2025)
par: La, Ngoc, et autres
Publié: (2025)
PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making
par: Light, Jonathan, et autres
Publié: (2024)
par: Light, Jonathan, et autres
Publié: (2024)
SocialGrid: A Benchmark for Planning and Social Reasoning in Embodied Multi-Agent Systems
par: Shindo, Hikaru, et autres
Publié: (2026)
par: Shindo, Hikaru, et autres
Publié: (2026)
Prompting Policies for Multi-step Reasoning and Tool-Use in Black-box LLMs with Iterative Distillation of Experience
par: Sayana, Krishna, et autres
Publié: (2026)
par: Sayana, Krishna, et autres
Publié: (2026)
Harnessing Multi-Agent LLMs for Complex Engineering Problem-Solving: A Framework for Senior Design Projects
par: Mushtaq, Abdullah, et autres
Publié: (2025)
par: Mushtaq, Abdullah, et autres
Publié: (2025)
Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems
par: Hu, Liyuan
Publié: (2025)
par: Hu, Liyuan
Publié: (2025)
Enhancing Aerial Combat Tactics through Hierarchical Multi-Agent Reinforcement Learning
par: Selmonaj, Ardian, et autres
Publié: (2025)
par: Selmonaj, Ardian, et autres
Publié: (2025)
KERAP: A Knowledge-Enhanced Reasoning Approach for Accurate Zero-shot Diagnosis Prediction Using Multi-agent LLMs
par: Xie, Yuzhang, et autres
Publié: (2025)
par: Xie, Yuzhang, et autres
Publié: (2025)
Detecting Multi-Agent Collusion Through Multi-Agent Interpretability
par: Rose, Aaron, et autres
Publié: (2026)
par: Rose, Aaron, et autres
Publié: (2026)
Learn as Individuals, Evolve as a Team: Multi-agent LLMs Adaptation in Embodied Environments
par: Li, Xinran, et autres
Publié: (2025)
par: Li, Xinran, et autres
Publié: (2025)
Hierarchical Policy-Gradient Reinforcement Learning for Multi-Agent Shepherding Control of Non-Cohesive Targets
par: Covone, Stefano, et autres
Publié: (2025)
par: Covone, Stefano, et autres
Publié: (2025)
Learning Progress Driven Multi-Agent Curriculum
par: Zhao, Wenshuai, et autres
Publié: (2022)
par: Zhao, Wenshuai, et autres
Publié: (2022)
Massively Multiagent Minigames for Training Generalist Agents
par: Choe, Kyoung Whan, et autres
Publié: (2024)
par: Choe, Kyoung Whan, et autres
Publié: (2024)
Context Learning for Multi-Agent Discussion
par: Hua, Xingyuan, et autres
Publié: (2026)
par: Hua, Xingyuan, et autres
Publié: (2026)
The Composite Task Challenge for Cooperative Multi-Agent Reinforcement Learning
par: Li, Yurui, et autres
Publié: (2025)
par: Li, Yurui, et autres
Publié: (2025)
GoAgent: Group-of-Agents Communication Topology Generation for LLM-based Multi-Agent Systems
par: Chen, Hongjiang, et autres
Publié: (2026)
par: Chen, Hongjiang, et autres
Publié: (2026)
A Semi Centralized Training Decentralized Execution Architecture for Multi Agent Deep Reinforcement Learning in Traffic Signal Control
par: Rezaali, Arash, et autres
Publié: (2025)
par: Rezaali, Arash, et autres
Publié: (2025)
Revisiting Multi-Agent World Modeling from a Diffusion-Inspired Perspective
par: Zhang, Yang, et autres
Publié: (2025)
par: Zhang, Yang, et autres
Publié: (2025)
Language-Driven Coordination and Learning in Multi-Agent Simulation Environments
par: Li, Zhengyang, et autres
Publié: (2025)
par: Li, Zhengyang, et autres
Publié: (2025)
Scaling Multi-Agent Environment Co-Design with Diffusion Models
par: Li, Hao Xiang, et autres
Publié: (2025)
par: Li, Hao Xiang, et autres
Publié: (2025)
MedRAX: Medical Reasoning Agent for Chest X-ray
par: Fallahpour, Adibvafa, et autres
Publié: (2025)
par: Fallahpour, Adibvafa, et autres
Publié: (2025)
Training Generalizable Collaborative Agents via Strategic Risk Aversion
par: Qu, Chengrui, et autres
Publié: (2026)
par: Qu, Chengrui, et autres
Publié: (2026)
Learning Strategy Representation for Imitation Learning in Multi-Agent Games
par: Lei, Shiqi, et autres
Publié: (2024)
par: Lei, Shiqi, et autres
Publié: (2024)
A Unified Multi-Agent Framework for Universal Multimodal Understanding and Generation
par: Li, Jiulin, et autres
Publié: (2025)
par: Li, Jiulin, et autres
Publié: (2025)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
par: Hu, Kun, et autres
Publié: (2025)
par: Hu, Kun, et autres
Publié: (2025)
Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models
par: Zhang, Yang, et autres
Publié: (2024)
par: Zhang, Yang, et autres
Publié: (2024)
FightLadder: A Benchmark for Competitive Multi-Agent Reinforcement Learning
par: Li, Wenzhe, et autres
Publié: (2024)
par: Li, Wenzhe, et autres
Publié: (2024)
Goal-Oriented Multi-Agent Reinforcement Learning for Decentralized Agent Teams
par: Du, Hung, et autres
Publié: (2025)
par: Du, Hung, et autres
Publié: (2025)
Empirical Study on Robustness and Resilience in Cooperative Multi-Agent Reinforcement Learning
par: Li, Simin, et autres
Publié: (2025)
par: Li, Simin, et autres
Publié: (2025)
OMAC: A Holistic Optimization Framework for LLM-Based Multi-Agent Collaboration
par: Li, Shijun, et autres
Publié: (2025)
par: Li, Shijun, et autres
Publié: (2025)
A Hierarchical Hybrid AI Approach: Integrating Deep Reinforcement Learning and Scripted Agents in Combat Simulations
par: Black, Scotty, et autres
Publié: (2025)
par: Black, Scotty, et autres
Publié: (2025)
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines
par: Zheng, Xuejing, et autres
Publié: (2024)
par: Zheng, Xuejing, et autres
Publié: (2024)
Documents similaires
-
Understanding Chain-of-Thought in LLMs through Information Theory
par: Ton, Jean-Francois, et autres
Publié: (2024) -
Emergence of Fair Leaders via Mediators in Multi-Agent Reinforcement Learning
par: Dodwadmath, Akshay, et autres
Publié: (2025) -
Robust Multi-Agent LLMs under Byzantine Faults
par: Lee, Haejoon, et autres
Publié: (2026) -
PeerGuard: Defending Multi-Agent Systems Against Backdoor Attacks Through Mutual Reasoning
par: Fan, Falong, et autres
Publié: (2025) -
Embodiment-Induced Coordination Regimes in Tabular Multi-Agent Q-Learning
par: Atif, Muhammad Ahmed, et autres
Publié: (2026)