MARPO: A Reflective Policy Optimization for Multi Agent Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Wu, Cuiling, Gan, Yaozhong, Xing, Junliang, Fu, Ying |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LLM-ALSO: LLM-Driven Adaptive Learning-Signal Optimization for Multi-Agent Reinforcement Learning
by: Wu, Xiaoguang, et al.
Published: (2026)
by: Wu, Xiaoguang, et al.
Published: (2026)
TVDO: Tchebycheff Value-Decomposition Optimization for Multi-Agent Reinforcement Learning
by: Hu, Xiaoliang, et al.
Published: (2023)
by: Hu, Xiaoliang, et al.
Published: (2023)
Asynchronous Credit Assignment for Multi-Agent Reinforcement Learning
by: Liang, Yongheng, et al.
Published: (2024)
by: Liang, Yongheng, et al.
Published: (2024)
Measuring Policy Distance for Multi-Agent Reinforcement Learning
by: Hu, Tianyi, et al.
Published: (2024)
by: Hu, Tianyi, et al.
Published: (2024)
Generalized Per-Agent Advantage Estimation for Multi-Agent Policy Optimization
by: Kim, Seongmin, et al.
Published: (2026)
by: Kim, Seongmin, et al.
Published: (2026)
Distributed Neural Policy Gradient Algorithm for Global Convergence of Networked Multi-Agent Reinforcement Learning
by: Dai, Pengcheng, et al.
Published: (2025)
by: Dai, Pengcheng, et al.
Published: (2025)
Multi-Agent Reinforcement Learning Simulation for Environmental Policy Synthesis
by: Rudd-Jones, James, et al.
Published: (2025)
by: Rudd-Jones, James, et al.
Published: (2025)
MARLIN: Multi-Agent Reinforcement Learning with Murmuration Intelligence and LLM Guidance for Reservoir Management
by: Fu, Heming, et al.
Published: (2025)
by: Fu, Heming, et al.
Published: (2025)
Causally-Guided Automated Feature Engineering with Multi-Agent Reinforcement Learning
by: Malarkkan, Arun Vignesh, et al.
Published: (2026)
by: Malarkkan, Arun Vignesh, et al.
Published: (2026)
Policy Optimization in Multi-Agent Settings under Partially Observable Environments
by: Zhaikhan, Ainur, et al.
Published: (2025)
by: Zhaikhan, Ainur, et al.
Published: (2025)
An Agent-Centric Dynamical Systems Perspective on Multi-Agent Reinforcement Learning
by: Rudd-Jones, James, et al.
Published: (2025)
by: Rudd-Jones, James, et al.
Published: (2025)
Learning Efficient Communication Protocols for Multi-Agent Reinforcement Learning
by: Zhang, Xinren, et al.
Published: (2025)
by: Zhang, Xinren, et al.
Published: (2025)
Task Placement and Resource Allocation for Edge Machine Learning: A GNN-based Multi-Agent Reinforcement Learning Paradigm
by: Li, Yihong, et al.
Published: (2023)
by: Li, Yihong, et al.
Published: (2023)
Multi-Agent Guided Policy Optimization
by: Li, Yueheng, et al.
Published: (2025)
by: Li, Yueheng, et al.
Published: (2025)
Leveraging Partial Symmetry for Multi-Agent Reinforcement Learning
by: Yu, Xin, et al.
Published: (2023)
by: Yu, Xin, et al.
Published: (2023)
Learning Nudges for Conditional Cooperation: A Multi-Agent Reinforcement Learning Model
by: Kulkarni, Shatayu, et al.
Published: (2024)
by: Kulkarni, Shatayu, et al.
Published: (2024)
How Exploration Breaks Cooperation in Shared-Policy Multi-Agent Reinforcement Learning
by: Weng, Yi-Ning, et al.
Published: (2026)
by: Weng, Yi-Ning, et al.
Published: (2026)
VissimRL: A Multi-Agent Reinforcement Learning Framework for Traffic Signal Control Based on Vissim
by: Chang, Hsiao-Chuan, et al.
Published: (2026)
by: Chang, Hsiao-Chuan, et al.
Published: (2026)
Adaptive Event-Triggered Policy Gradient for Multi-Agent Reinforcement Learning
by: Siddique, Umer, et al.
Published: (2025)
by: Siddique, Umer, et al.
Published: (2025)
HyperAgent: Leveraging Hypergraphs for Topology Optimization in Multi-Agent Communication
by: Zhang, Heng, et al.
Published: (2025)
by: Zhang, Heng, et al.
Published: (2025)
Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning
by: Lee, Min Whoo, et al.
Published: (2025)
by: Lee, Min Whoo, et al.
Published: (2025)
Towards Language-Augmented Multi-Agent Deep Reinforcement Learning
by: Toquebiau, Maxime, et al.
Published: (2025)
by: Toquebiau, Maxime, et al.
Published: (2025)
Dynamic Graph Communication for Decentralised Multi-Agent Reinforcement Learning
by: McClusky, Ben
Published: (2024)
by: McClusky, Ben
Published: (2024)
LAGMA: LAtent Goal-guided Multi-Agent Reinforcement Learning
by: Na, Hyungho, et al.
Published: (2024)
by: Na, Hyungho, et al.
Published: (2024)
Multi-Agent Reinforcement Learning for UAV-Based Chemical Plume Source Localization
by: Li, Zhirun, et al.
Published: (2026)
by: Li, Zhirun, et al.
Published: (2026)
Multi-Agent Reinforcement Learning for Multi-Cell Spectrum and Power Allocation
by: Zhang, Yiming, et al.
Published: (2023)
by: Zhang, Yiming, et al.
Published: (2023)
B2MAPO: A Batch-by-Batch Multi-Agent Policy Optimization to Balance Performance and Efficiency
by: Zhang, Wenjing, et al.
Published: (2024)
by: Zhang, Wenjing, et al.
Published: (2024)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
by: Hu, Kun, et al.
Published: (2025)
by: Hu, Kun, et al.
Published: (2025)
Bottom-Up Reputation Promotes Cooperation with Multi-Agent Reinforcement Learning
by: Ren, Tianyu, et al.
Published: (2025)
by: Ren, Tianyu, et al.
Published: (2025)
GAWM: Global-Aware World Model for Multi-Agent Reinforcement Learning
by: Shi, Zifeng, et al.
Published: (2025)
by: Shi, Zifeng, et al.
Published: (2025)
Intrinsic Action Tendency Consistency for Cooperative Multi-Agent Reinforcement Learning
by: Zhang, Junkai, et al.
Published: (2024)
by: Zhang, Junkai, et al.
Published: (2024)
Attention-Guided Contrastive Role Representations for Multi-Agent Reinforcement Learning
by: Hu, Zican, et al.
Published: (2023)
by: Hu, Zican, et al.
Published: (2023)
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
by: Yang, Guang, et al.
Published: (2025)
by: Yang, Guang, et al.
Published: (2025)
COCO: Cognitive Operating System with Continuous Oversight for Multi-Agent Workflow Reliability
by: Liang, Churong, et al.
Published: (2025)
by: Liang, Churong, et al.
Published: (2025)
Making Teams and Influencing Agents: Efficiently Coordinating Decision Trees for Interpretable Multi-Agent Reinforcement Learning
by: Chen, Rex, et al.
Published: (2025)
by: Chen, Rex, et al.
Published: (2025)
HYGMA: Hypergraph Coordination Networks with Dynamic Grouping for Multi-Agent Reinforcement Learning
by: Liu, Chiqiang, et al.
Published: (2025)
by: Liu, Chiqiang, et al.
Published: (2025)
Causal-Inspired Multi-Agent Decision-Making via Graph Reinforcement Learning
by: Wang, Jing, et al.
Published: (2025)
by: Wang, Jing, et al.
Published: (2025)
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
by: Feng, Jinyuan, et al.
Published: (2025)
by: Feng, Jinyuan, et al.
Published: (2025)
Safe Continuous-time Multi-Agent Reinforcement Learning via Epigraph Form
by: Wang, Xuefeng, et al.
Published: (2026)
by: Wang, Xuefeng, et al.
Published: (2026)
JointPPO: Diving Deeper into the Effectiveness of PPO in Multi-Agent Reinforcement Learning
by: Liu, Chenxing, et al.
Published: (2024)
by: Liu, Chenxing, et al.
Published: (2024)
Similar Items
-
LLM-ALSO: LLM-Driven Adaptive Learning-Signal Optimization for Multi-Agent Reinforcement Learning
by: Wu, Xiaoguang, et al.
Published: (2026) -
TVDO: Tchebycheff Value-Decomposition Optimization for Multi-Agent Reinforcement Learning
by: Hu, Xiaoliang, et al.
Published: (2023) -
Asynchronous Credit Assignment for Multi-Agent Reinforcement Learning
by: Liang, Yongheng, et al.
Published: (2024) -
Measuring Policy Distance for Multi-Agent Reinforcement Learning
by: Hu, Tianyi, et al.
Published: (2024) -
Generalized Per-Agent Advantage Estimation for Multi-Agent Policy Optimization
by: Kim, Seongmin, et al.
Published: (2026)