ReMA: Learning to Meta-think for LLMs with Multi-Agent Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Wan, Ziyu, Li, Yunxiang, Wen, Xiaoyu, Song, Yan, Wang, Hanjing, Yang, Linyi, Schmidt, Mark, Wang, Jun, Zhang, Weinan, Hu, Shuyue, Wen, Ying |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Agent Exchange: Shaping the Future of AI Agent Economics
by: Yang, Yingxuan, et al.
Published: (2025)
by: Yang, Yingxuan, et al.
Published: (2025)
MARFT: Multi-Agent Reinforcement Fine-Tuning
by: Liao, Junwei, et al.
Published: (2025)
by: Liao, Junwei, et al.
Published: (2025)
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
by: Feng, Jinyuan, et al.
Published: (2025)
by: Feng, Jinyuan, et al.
Published: (2025)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
by: Hu, Kun, et al.
Published: (2025)
by: Hu, Kun, et al.
Published: (2025)
Language Games as the Pathway to Artificial Superhuman Intelligence
by: Wen, Ying, et al.
Published: (2025)
by: Wen, Ying, et al.
Published: (2025)
Provably Efficient Information-Directed Sampling Algorithms for Multi-Agent Reinforcement Learning
by: Zhang, Qiaosheng, et al.
Published: (2024)
by: Zhang, Qiaosheng, et al.
Published: (2024)
Stronger-MAS: Multi-Agent Reinforcement Learning for Collaborative LLMs
by: Zhao, Yujie, et al.
Published: (2025)
by: Zhao, Yujie, et al.
Published: (2025)
Model-based Multi-agent Reinforcement Learning: Recent Progress and Prospects
by: Wang, Xihuai, et al.
Published: (2022)
by: Wang, Xihuai, et al.
Published: (2022)
Subgoal-based Hierarchical Reinforcement Learning for Multi-Agent Collaboration
by: Xu, Cheng, et al.
Published: (2024)
by: Xu, Cheng, et al.
Published: (2024)
MobileUse: A GUI Agent with Hierarchical Reflection for Autonomous Mobile Operation
by: Li, Ning, et al.
Published: (2025)
by: Li, Ning, et al.
Published: (2025)
Learning to Deliberate: Meta-policy Collaboration for Agentic LLMs with Multi-agent Reinforcement Learning
by: Yang, Wei, et al.
Published: (2025)
by: Yang, Wei, et al.
Published: (2025)
MasRouter: Learning to Route LLMs for Multi-Agent Systems
by: Yue, Yanwei, et al.
Published: (2025)
by: Yue, Yanwei, et al.
Published: (2025)
Asynchronous Credit Assignment for Multi-Agent Reinforcement Learning
by: Liang, Yongheng, et al.
Published: (2024)
by: Liang, Yongheng, et al.
Published: (2024)
SocialGFs: Learning Social Gradient Fields for Multi-Agent Reinforcement Learning
by: Long, Qian, et al.
Published: (2024)
by: Long, Qian, et al.
Published: (2024)
MARPO: A Reflective Policy Optimization for Multi Agent Reinforcement Learning
by: Wu, Cuiling, et al.
Published: (2025)
by: Wu, Cuiling, et al.
Published: (2025)
MARS: A Meta-Adaptive Reinforcement Learning Framework for Risk-Aware Multi-Agent Portfolio Management
by: Chen, Jiayi, et al.
Published: (2025)
by: Chen, Jiayi, et al.
Published: (2025)
Towards Language-Augmented Multi-Agent Deep Reinforcement Learning
by: Toquebiau, Maxime, et al.
Published: (2025)
by: Toquebiau, Maxime, et al.
Published: (2025)
Bottom-Up Reputation Promotes Cooperation with Multi-Agent Reinforcement Learning
by: Ren, Tianyu, et al.
Published: (2025)
by: Ren, Tianyu, et al.
Published: (2025)
Heterogeneity in Multi-Agent Reinforcement Learning
by: Hu, Tianyi, et al.
Published: (2025)
by: Hu, Tianyi, et al.
Published: (2025)
Safe Multi-Agent Deep Reinforcement Learning for Privacy-Aware Edge-Device Collaborative DNN Inference
by: Wang, Hong, et al.
Published: (2026)
by: Wang, Hong, et al.
Published: (2026)
Attention-Guided Contrastive Role Representations for Multi-Agent Reinforcement Learning
by: Hu, Zican, et al.
Published: (2023)
by: Hu, Zican, et al.
Published: (2023)
Causal-Inspired Multi-Agent Decision-Making via Graph Reinforcement Learning
by: Wang, Jing, et al.
Published: (2025)
by: Wang, Jing, et al.
Published: (2025)
Learning Efficient Communication Protocols for Multi-Agent Reinforcement Learning
by: Zhang, Xinren, et al.
Published: (2025)
by: Zhang, Xinren, et al.
Published: (2025)
Greedy-based Value Representation for Optimal Coordination in Multi-agent Reinforcement Learning
by: Wan, Lipeng, et al.
Published: (2021)
by: Wan, Lipeng, et al.
Published: (2021)
Safe Continuous-time Multi-Agent Reinforcement Learning via Epigraph Form
by: Wang, Xuefeng, et al.
Published: (2026)
by: Wang, Xuefeng, et al.
Published: (2026)
Multi-Agent Model-Based Reinforcement Learning with Joint State-Action Learned Embeddings
by: Wang, Zhizun, et al.
Published: (2026)
by: Wang, Zhizun, et al.
Published: (2026)
Algorithmic Contract Design with Reinforcement Learning Agents
by: Concha, David Molina, et al.
Published: (2024)
by: Concha, David Molina, et al.
Published: (2024)
Multi-agent Uncertainty-Aware Pessimistic Model-Based Reinforcement Learning for Connected Autonomous Vehicles
by: Wen, Ruoqi, et al.
Published: (2025)
by: Wen, Ruoqi, et al.
Published: (2025)
Revisiting Communication Efficiency in Multi-Agent Reinforcement Learning from the Dimensional Analysis Perspective
by: Sun, Chuxiong, et al.
Published: (2025)
by: Sun, Chuxiong, et al.
Published: (2025)
Dynamic Deep Factor Graph for Multi-Agent Reinforcement Learning
by: Shi, Yuchen, et al.
Published: (2024)
by: Shi, Yuchen, et al.
Published: (2024)
Emergence of Social Norms in Generative Agent Societies: Principles and Architecture
by: Ren, Siyue, et al.
Published: (2024)
by: Ren, Siyue, et al.
Published: (2024)
An Agent-Centric Dynamical Systems Perspective on Multi-Agent Reinforcement Learning
by: Rudd-Jones, James, et al.
Published: (2025)
by: Rudd-Jones, James, et al.
Published: (2025)
A Survey of Multi-Agent Deep Reinforcement Learning with Communication
by: Zhu, Changxi, et al.
Published: (2022)
by: Zhu, Changxi, et al.
Published: (2022)
Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning
by: Li, Simin, et al.
Published: (2025)
by: Li, Simin, et al.
Published: (2025)
Learning Nudges for Conditional Cooperation: A Multi-Agent Reinforcement Learning Model
by: Kulkarni, Shatayu, et al.
Published: (2024)
by: Kulkarni, Shatayu, et al.
Published: (2024)
Double Distillation Network for Multi-Agent Reinforcement Learning
by: Zhou, Yang, et al.
Published: (2025)
by: Zhou, Yang, et al.
Published: (2025)
Heterogeneous Information-Bottleneck Coordination Graphs for Multi-Agent Reinforcement Learning
by: Duan, Wei, et al.
Published: (2026)
by: Duan, Wei, et al.
Published: (2026)
Multicopy Reinforcement Learning Agents
by: Wolfe, Alicia P., et al.
Published: (2023)
by: Wolfe, Alicia P., et al.
Published: (2023)
Reinforcing Language Agents via Policy Optimization with Action Decomposition
by: Wen, Muning, et al.
Published: (2024)
by: Wen, Muning, et al.
Published: (2024)
MARS-DA: A Hierarchical Reinforcement Learning Framework for Risk-Aware Multi-Agent Bidding in Power Grids
by: Chen, Jiayi, et al.
Published: (2026)
by: Chen, Jiayi, et al.
Published: (2026)
Similar Items
-
Agent Exchange: Shaping the Future of AI Agent Economics
by: Yang, Yingxuan, et al.
Published: (2025) -
MARFT: Multi-Agent Reinforcement Fine-Tuning
by: Liao, Junwei, et al.
Published: (2025) -
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
by: Feng, Jinyuan, et al.
Published: (2025) -
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
by: Hu, Kun, et al.
Published: (2025) -
Language Games as the Pathway to Artificial Superhuman Intelligence
by: Wen, Ying, et al.
Published: (2025)