Learning to Deliberate: Meta-policy Collaboration for Agentic LLMs with Multi-agent Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Wei, Thomason, Jesse |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Maestro: Learning to Collaborate via Conditional Listwise Policy Optimization for Multi-Agent LLMs
by: Yang, Wei, et al.
Published: (2025)
by: Yang, Wei, et al.
Published: (2025)
TwoStep: Multi-agent Task Planning using Classical Planners and Large Language Models
by: Bai, David, et al.
Published: (2024)
by: Bai, David, et al.
Published: (2024)
Verco: Learning Coordinated Verbal Communication for Multi-agent Reinforcement Learning
by: Li, Dapeng, et al.
Published: (2024)
by: Li, Dapeng, et al.
Published: (2024)
Evaluating Creativity and Deception in Large Language Models: A Simulation Framework for Multi-Agent Balderdash
by: Hejabi, Parsa, et al.
Published: (2024)
by: Hejabi, Parsa, et al.
Published: (2024)
Nucleolus Credit Assignment for Effective Coalitions in Multi-agent Reinforcement Learning
by: Li, Yugu, et al.
Published: (2025)
by: Li, Yugu, et al.
Published: (2025)
Multi-agent Reinforcement Learning with Deep Networks for Diverse Q-Vectors
by: Luo, Zhenglong, et al.
Published: (2024)
by: Luo, Zhenglong, et al.
Published: (2024)
Scalable Multi-agent Reinforcement Learning for Factory-wide Dynamic Scheduling
by: Jang, Jaeyeon, et al.
Published: (2024)
by: Jang, Jaeyeon, et al.
Published: (2024)
Efficient Multi-agent Reinforcement Learning by Planning
by: Liu, Qihan, et al.
Published: (2024)
by: Liu, Qihan, et al.
Published: (2024)
RobotFleet: An Open-Source Framework for Centralized Multi-Robot Task Planning
by: Gupta, Rohan, et al.
Published: (2025)
by: Gupta, Rohan, et al.
Published: (2025)
Graph Neural Networks with Model-based Reinforcement Learning for Multi-agent Systems
by: Chen, Hanxiao
Published: (2024)
by: Chen, Hanxiao
Published: (2024)
ReMA: Learning to Meta-think for LLMs with Multi-Agent Reinforcement Learning
by: Wan, Ziyu, et al.
Published: (2025)
by: Wan, Ziyu, et al.
Published: (2025)
CREW-WILDFIRE: Benchmarking Agentic Multi-Agent Collaborations at Scale
by: Hyun, Jonathan, et al.
Published: (2025)
by: Hyun, Jonathan, et al.
Published: (2025)
CCL: Collaborative Curriculum Learning for Sparse-Reward Multi-Agent Reinforcement Learning via Co-evolutionary Task Evolution
by: Lin, Yufei, et al.
Published: (2025)
by: Lin, Yufei, et al.
Published: (2025)
The Wisdom of Deliberating AI Crowds: Does Deliberation Improve LLM-Based Forecasting?
by: Schneider, Paul, et al.
Published: (2025)
by: Schneider, Paul, et al.
Published: (2025)
MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework
by: Hong, Sirui, et al.
Published: (2023)
by: Hong, Sirui, et al.
Published: (2023)
Multi-agent Reinforcement Learning: A Comprehensive Survey
by: Huh, Dom, et al.
Published: (2023)
by: Huh, Dom, et al.
Published: (2023)
Towards Multi-agent Reinforcement Learning based Traffic Signal Control through Spatio-temporal Hypergraphs
by: Wang, Kang, et al.
Published: (2024)
by: Wang, Kang, et al.
Published: (2024)
Improving Global Parameter-sharing in Physically Heterogeneous Multi-agent Reinforcement Learning with Unified Action Space
by: Yu, Xiaoyang, et al.
Published: (2024)
by: Yu, Xiaoyang, et al.
Published: (2024)
Collaborative Belief Reasoning with LLMs for Efficient Multi-Agent Collaboration
by: Wang, Zhimin, et al.
Published: (2025)
by: Wang, Zhimin, et al.
Published: (2025)
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
by: Yang, Guang, et al.
Published: (2025)
by: Yang, Guang, et al.
Published: (2025)
Kaleidoscope: Learnable Masks for Heterogeneous Multi-agent Reinforcement Learning
by: Li, Xinran, et al.
Published: (2024)
by: Li, Xinran, et al.
Published: (2024)
Episodic Future Thinking Mechanism for Multi-agent Reinforcement Learning
by: Lee, Dongsu, et al.
Published: (2024)
by: Lee, Dongsu, et al.
Published: (2024)
SrSv: Integrating Sequential Rollouts with Sequential Value Estimation for Multi-agent Reinforcement Learning
by: Wan, Xu, et al.
Published: (2025)
by: Wan, Xu, et al.
Published: (2025)
SAMVAD: A Multi-Agent System for Simulating Judicial Deliberation Dynamics in India
by: Devadiga, Prathamesh, et al.
Published: (2025)
by: Devadiga, Prathamesh, et al.
Published: (2025)
Internal vs. External: Comparing Deliberation and Evolution for Multi-Agent Constitutional Design
by: Niranjani, Hershraj, et al.
Published: (2026)
by: Niranjani, Hershraj, et al.
Published: (2026)
Manalyzer: End-to-end Automated Meta-analysis with Multi-agent System
by: Xu, Wanghan, et al.
Published: (2025)
by: Xu, Wanghan, et al.
Published: (2025)
GHQ: Grouped Hybrid Q Learning for Heterogeneous Cooperative Multi-agent Reinforcement Learning
by: Yu, Xiaoyang, et al.
Published: (2023)
by: Yu, Xiaoyang, et al.
Published: (2023)
Heterogeneity in Multi-Agent Reinforcement Learning
by: Hu, Tianyi, et al.
Published: (2025)
by: Hu, Tianyi, et al.
Published: (2025)
Exponential Topology-enabled Scalable Communication in Multi-agent Reinforcement Learning
by: Li, Xinran, et al.
Published: (2025)
by: Li, Xinran, et al.
Published: (2025)
Model-based Multi-agent Reinforcement Learning: Recent Progress and Prospects
by: Wang, Xihuai, et al.
Published: (2022)
by: Wang, Xihuai, et al.
Published: (2022)
Multi-agent Reinforcement Learning for Dynamic Dispatching in Material Handling Systems
by: Lee, Xian Yeow, et al.
Published: (2024)
by: Lee, Xian Yeow, et al.
Published: (2024)
Emergence of Collective Open-Ended Exploration from Decentralized Meta-Reinforcement Learning
by: Bornemann, Richard, et al.
Published: (2023)
by: Bornemann, Richard, et al.
Published: (2023)
SocialGFs: Learning Social Gradient Fields for Multi-Agent Reinforcement Learning
by: Long, Qian, et al.
Published: (2024)
by: Long, Qian, et al.
Published: (2024)
Causal Mean Field Multi-Agent Reinforcement Learning
by: Ma, Hao, et al.
Published: (2025)
by: Ma, Hao, et al.
Published: (2025)
Measuring Policy Distance for Multi-Agent Reinforcement Learning
by: Hu, Tianyi, et al.
Published: (2024)
by: Hu, Tianyi, et al.
Published: (2024)
Multi-source Plume Tracing via Multi-Agent Reinforcement Learning
by: Granadeno, Pedro Antonio Alarcon, et al.
Published: (2025)
by: Granadeno, Pedro Antonio Alarcon, et al.
Published: (2025)
Scalable Safe Multi-Agent Reinforcement Learning for Multi-Agent System
by: Du, Haikuo, et al.
Published: (2025)
by: Du, Haikuo, et al.
Published: (2025)
Learn as Individuals, Evolve as a Team: Multi-agent LLMs Adaptation in Embodied Environments
by: Li, Xinran, et al.
Published: (2025)
by: Li, Xinran, et al.
Published: (2025)
MedDCR: Learning to Design Agentic Workflows for Medical Coding
by: Zheng, Jiyang, et al.
Published: (2025)
by: Zheng, Jiyang, et al.
Published: (2025)
Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning
by: Li, Simin, et al.
Published: (2025)
by: Li, Simin, et al.
Published: (2025)
Similar Items
-
Maestro: Learning to Collaborate via Conditional Listwise Policy Optimization for Multi-Agent LLMs
by: Yang, Wei, et al.
Published: (2025) -
TwoStep: Multi-agent Task Planning using Classical Planners and Large Language Models
by: Bai, David, et al.
Published: (2024) -
Verco: Learning Coordinated Verbal Communication for Multi-agent Reinforcement Learning
by: Li, Dapeng, et al.
Published: (2024) -
Evaluating Creativity and Deception in Large Language Models: A Simulation Framework for Multi-Agent Balderdash
by: Hejabi, Parsa, et al.
Published: (2024) -
Nucleolus Credit Assignment for Effective Coalitions in Multi-agent Reinforcement Learning
by: Li, Yugu, et al.
Published: (2025)