Generalized Per-Agent Advantage Estimation for Multi-Agent Policy Optimization
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kim, Seongmin, Park, Giseung, Kim, Woojun, Jeon, Jiwon, Han, Seungyul, Sung, Youngchul |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Focusing Influence Mechanism for Multi-Agent Reinforcement Learning
von: Park, Yisak, et al.
Veröffentlicht: (2025)
von: Park, Yisak, et al.
Veröffentlicht: (2025)
LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning
von: Bae, Sangjun, et al.
Veröffentlicht: (2026)
von: Bae, Sangjun, et al.
Veröffentlicht: (2026)
Fair Cooperation in Mixed-Motive Games via Conflict-Aware Gradient Adjustment
von: Kim, Woojun, et al.
Veröffentlicht: (2025)
von: Kim, Woojun, et al.
Veröffentlicht: (2025)
Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning
von: Lee, Sunwoo, et al.
Veröffentlicht: (2026)
von: Lee, Sunwoo, et al.
Veröffentlicht: (2026)
Wolfpack Adversarial Attack for Robust Multi-Agent Reinforcement Learning
von: Lee, Sunwoo, et al.
Veröffentlicht: (2025)
von: Lee, Sunwoo, et al.
Veröffentlicht: (2025)
Speaking the Language of Teamwork: LLM-Guided Credit Assignment in Multi-Agent Reinforcement Learning
von: Lin, Muhan, et al.
Veröffentlicht: (2025)
von: Lin, Muhan, et al.
Veröffentlicht: (2025)
Progressive Multi-Agent Reasoning for Biological Perturbation Prediction
von: Kim, Hyomin, et al.
Veröffentlicht: (2026)
von: Kim, Hyomin, et al.
Veröffentlicht: (2026)
Multi-Agent Guided Policy Optimization
von: Li, Yueheng, et al.
Veröffentlicht: (2025)
von: Li, Yueheng, et al.
Veröffentlicht: (2025)
HiMemFormer: Hierarchical Memory-Aware Transformer for Multi-Agent Action Anticipation
von: Wang, Zirui, et al.
Veröffentlicht: (2024)
von: Wang, Zirui, et al.
Veröffentlicht: (2024)
Policy Optimization in Multi-Agent Settings under Partially Observable Environments
von: Zhaikhan, Ainur, et al.
Veröffentlicht: (2025)
von: Zhaikhan, Ainur, et al.
Veröffentlicht: (2025)
MARPO: A Reflective Policy Optimization for Multi Agent Reinforcement Learning
von: Wu, Cuiling, et al.
Veröffentlicht: (2025)
von: Wu, Cuiling, et al.
Veröffentlicht: (2025)
Self-Refining Topology Optimization via an LLM-Based Multi-Agent Framework
von: Park, Hyunjee, et al.
Veröffentlicht: (2026)
von: Park, Hyunjee, et al.
Veröffentlicht: (2026)
Distributed Multi-robot Source Seeking in Unknown Environments with Unknown Number of Sources
von: Chen, Lingpeng, et al.
Veröffentlicht: (2025)
von: Chen, Lingpeng, et al.
Veröffentlicht: (2025)
Behavior Modeling for Training-free Building of Private Domain Multi Agent System
von: Cho, Won Ik, et al.
Veröffentlicht: (2025)
von: Cho, Won Ik, et al.
Veröffentlicht: (2025)
Modeling Latent Partner Strategies for Adaptive Zero-Shot Human-Agent Collaboration
von: Li, Benjamin, et al.
Veröffentlicht: (2025)
von: Li, Benjamin, et al.
Veröffentlicht: (2025)
Agent-GSPO: Communication-Efficient Multi-Agent Systems via Group Sequence Policy Optimization
von: Fan, Yijia, et al.
Veröffentlicht: (2025)
von: Fan, Yijia, et al.
Veröffentlicht: (2025)
Quantum Advantage in Multi Agent Reinforcement Learning
von: Dahia, Simranjeet Singh, et al.
Veröffentlicht: (2026)
von: Dahia, Simranjeet Singh, et al.
Veröffentlicht: (2026)
Practical Abstractions for Model Checking Continuous-Time Multi-Agent Systems
von: Kim, Yan, et al.
Veröffentlicht: (2025)
von: Kim, Yan, et al.
Veröffentlicht: (2025)
B2MAPO: A Batch-by-Batch Multi-Agent Policy Optimization to Balance Performance and Efficiency
von: Zhang, Wenjing, et al.
Veröffentlicht: (2024)
von: Zhang, Wenjing, et al.
Veröffentlicht: (2024)
PAC-BENCH: Evaluating Multi-Agent Collaboration under Privacy Constraints
von: Park, Minjun, et al.
Veröffentlicht: (2026)
von: Park, Minjun, et al.
Veröffentlicht: (2026)
Human Implicit Preference-Based Policy Fine-tuning for Multi-Agent Reinforcement Learning in USV Swarm
von: Kim, Hyeonjun, et al.
Veröffentlicht: (2025)
von: Kim, Hyeonjun, et al.
Veröffentlicht: (2025)
AgentMixer: Multi-Agent Correlated Policy Factorization
von: Li, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Li, Zhiyuan, et al.
Veröffentlicht: (2024)
Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation
von: Wang, Siying, et al.
Veröffentlicht: (2025)
von: Wang, Siying, et al.
Veröffentlicht: (2025)
Multi-Agent Corridor Generating Algorithm
von: Pertzovsky, Arseniy, et al.
Veröffentlicht: (2024)
von: Pertzovsky, Arseniy, et al.
Veröffentlicht: (2024)
Safe Equilibrium Policy Optimization for Strategic Agent Policies
von: Arumugam, Karthika, et al.
Veröffentlicht: (2026)
von: Arumugam, Karthika, et al.
Veröffentlicht: (2026)
Theory of Mind Guided Strategy Adaptation for Zero-Shot Coordination
von: Ni, Andrew, et al.
Veröffentlicht: (2026)
von: Ni, Andrew, et al.
Veröffentlicht: (2026)
Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning
von: Lee, Min Whoo, et al.
Veröffentlicht: (2025)
von: Lee, Min Whoo, et al.
Veröffentlicht: (2025)
AgentConductor: Topology Evolution for Multi-Agent Competition-Level Code Generation
von: Wang, Siyu, et al.
Veröffentlicht: (2026)
von: Wang, Siyu, et al.
Veröffentlicht: (2026)
AutoGenesisAgent: Self-Generating Multi-Agent Systems for Complex Tasks
von: Harper, Jeremy
Veröffentlicht: (2024)
von: Harper, Jeremy
Veröffentlicht: (2024)
Symmetric Policy Design for Multi-Agent Dispatch Coordination in Supply Chains
von: Sudhakara, Sagar
Veröffentlicht: (2025)
von: Sudhakara, Sagar
Veröffentlicht: (2025)
Synthesis of Communication Policies for Multi-Agent Systems Robust to Communication Restrictions
von: Soudijani, Saleh, et al.
Veröffentlicht: (2025)
von: Soudijani, Saleh, et al.
Veröffentlicht: (2025)
HyperAgent: Leveraging Hypergraphs for Topology Optimization in Multi-Agent Communication
von: Zhang, Heng, et al.
Veröffentlicht: (2025)
von: Zhang, Heng, et al.
Veröffentlicht: (2025)
Counterfactual Multi-Agent Policy Gradients
von: Foerster, Jakob, et al.
Veröffentlicht: (2017)
von: Foerster, Jakob, et al.
Veröffentlicht: (2017)
Optimistic Multi-Agent Policy Gradient
von: Zhao, Wenshuai, et al.
Veröffentlicht: (2023)
von: Zhao, Wenshuai, et al.
Veröffentlicht: (2023)
Long Live the Librarian! A Persistent Search Sub-Agent for Energy-Efficient Multi-Agent Software Engineering Systems
von: Cho, Seunghyuk, et al.
Veröffentlicht: (2026)
von: Cho, Seunghyuk, et al.
Veröffentlicht: (2026)
Superficial Success vs. Internal Breakdown: An Empirical Study of Generalization in Adaptive Multi-Agent Systems
von: So, Namyoung, et al.
Veröffentlicht: (2026)
von: So, Namyoung, et al.
Veröffentlicht: (2026)
TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
von: Lou, Xingzhou, et al.
Veröffentlicht: (2023)
von: Lou, Xingzhou, et al.
Veröffentlicht: (2023)
PARCO: Parallel AutoRegressive Models for Multi-Agent Combinatorial Optimization
von: Berto, Federico, et al.
Veröffentlicht: (2024)
von: Berto, Federico, et al.
Veröffentlicht: (2024)
Do Mixed-Vendor Multi-Agent LLMs Improve Clinical Diagnosis?
von: Yuan, Grace Chang, et al.
Veröffentlicht: (2026)
von: Yuan, Grace Chang, et al.
Veröffentlicht: (2026)
Direct Preference Optimization-Enhanced Multi-Guided Diffusion Model for Traffic Scenario Generation
von: Yu, Seungjun, et al.
Veröffentlicht: (2025)
von: Yu, Seungjun, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Focusing Influence Mechanism for Multi-Agent Reinforcement Learning
von: Park, Yisak, et al.
Veröffentlicht: (2025) -
LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning
von: Bae, Sangjun, et al.
Veröffentlicht: (2026) -
Fair Cooperation in Mixed-Motive Games via Conflict-Aware Gradient Adjustment
von: Kim, Woojun, et al.
Veröffentlicht: (2025) -
Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning
von: Lee, Sunwoo, et al.
Veröffentlicht: (2026) -
Wolfpack Adversarial Attack for Robust Multi-Agent Reinforcement Learning
von: Lee, Sunwoo, et al.
Veröffentlicht: (2025)