B2MAPO: A Batch-by-Batch Multi-Agent Policy Optimization to Balance Performance and Efficiency
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Wenjing, Zhang, Wei, Hu, Wenqing, Wang, Yifan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning
di: Zhang, Wenjing, et al.
Pubblicazione: (2025)
di: Zhang, Wenjing, et al.
Pubblicazione: (2025)
Intrinsic Action Tendency Consistency for Cooperative Multi-Agent Reinforcement Learning
di: Zhang, Junkai, et al.
Pubblicazione: (2024)
di: Zhang, Junkai, et al.
Pubblicazione: (2024)
Generalized Per-Agent Advantage Estimation for Multi-Agent Policy Optimization
di: Kim, Seongmin, et al.
Pubblicazione: (2026)
di: Kim, Seongmin, et al.
Pubblicazione: (2026)
MARPO: A Reflective Policy Optimization for Multi Agent Reinforcement Learning
di: Wu, Cuiling, et al.
Pubblicazione: (2025)
di: Wu, Cuiling, et al.
Pubblicazione: (2025)
Agent-GSPO: Communication-Efficient Multi-Agent Systems via Group Sequence Policy Optimization
di: Fan, Yijia, et al.
Pubblicazione: (2025)
di: Fan, Yijia, et al.
Pubblicazione: (2025)
Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation
di: Wang, Siying, et al.
Pubblicazione: (2025)
di: Wang, Siying, et al.
Pubblicazione: (2025)
Policy Optimization in Multi-Agent Settings under Partially Observable Environments
di: Zhaikhan, Ainur, et al.
Pubblicazione: (2025)
di: Zhaikhan, Ainur, et al.
Pubblicazione: (2025)
Multi-Agent Guided Policy Optimization
di: Li, Yueheng, et al.
Pubblicazione: (2025)
di: Li, Yueheng, et al.
Pubblicazione: (2025)
Network Topology and Information Efficiency of Multi-Agent Systems: Study based on MARL
di: Zhang, Xinren, et al.
Pubblicazione: (2025)
di: Zhang, Xinren, et al.
Pubblicazione: (2025)
Relational Weight Optimization for Enhancing Team Performance in Multi-Agent Multi-Armed Bandits
di: Kotturu, Monish Reddy, et al.
Pubblicazione: (2024)
di: Kotturu, Monish Reddy, et al.
Pubblicazione: (2024)
SMAUG: A Sliding Multidimensional Task Window-Based MARL Framework for Adaptive Real-Time Subtask Recognition
di: Zhang, Wenjing, et al.
Pubblicazione: (2024)
di: Zhang, Wenjing, et al.
Pubblicazione: (2024)
A Historical Interaction-Enhanced Shapley Policy Gradient Algorithm for Multi-Agent Credit Assignment
di: Ding, Ao, et al.
Pubblicazione: (2025)
di: Ding, Ao, et al.
Pubblicazione: (2025)
HyperAgent: Leveraging Hypergraphs for Topology Optimization in Multi-Agent Communication
di: Zhang, Heng, et al.
Pubblicazione: (2025)
di: Zhang, Heng, et al.
Pubblicazione: (2025)
AgenticPrecoding: LLM-Empowered Multi-Agent System for Precoding Optimization
di: Yang, Zijiu, et al.
Pubblicazione: (2026)
di: Yang, Zijiu, et al.
Pubblicazione: (2026)
HiveMind: Contribution-Guided Online Prompt Optimization of LLM Multi-Agent Systems
di: Xia, Yihan, et al.
Pubblicazione: (2025)
di: Xia, Yihan, et al.
Pubblicazione: (2025)
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
di: Feng, Jinyuan, et al.
Pubblicazione: (2025)
di: Feng, Jinyuan, et al.
Pubblicazione: (2025)
Revisiting Communication Efficiency in Multi-Agent Reinforcement Learning from the Dimensional Analysis Perspective
di: Sun, Chuxiong, et al.
Pubblicazione: (2025)
di: Sun, Chuxiong, et al.
Pubblicazione: (2025)
Maestro: Learning to Collaborate via Conditional Listwise Policy Optimization for Multi-Agent LLMs
di: Yang, Wei, et al.
Pubblicazione: (2025)
di: Yang, Wei, et al.
Pubblicazione: (2025)
Distributed Neural Policy Gradient Algorithm for Global Convergence of Networked Multi-Agent Reinforcement Learning
di: Dai, Pengcheng, et al.
Pubblicazione: (2025)
di: Dai, Pengcheng, et al.
Pubblicazione: (2025)
TVDO: Tchebycheff Value-Decomposition Optimization for Multi-Agent Reinforcement Learning
di: Hu, Xiaoliang, et al.
Pubblicazione: (2023)
di: Hu, Xiaoliang, et al.
Pubblicazione: (2023)
OPTIMA: Optimized Policy for Intelligent Multi-Agent Systems Enables Coordination-Aware Autonomous Vehicles
di: Du, Rui, et al.
Pubblicazione: (2024)
di: Du, Rui, et al.
Pubblicazione: (2024)
Attention-Guided Contrastive Role Representations for Multi-Agent Reinforcement Learning
di: Hu, Zican, et al.
Pubblicazione: (2023)
di: Hu, Zican, et al.
Pubblicazione: (2023)
Online Guidance Graph Optimization for Lifelong Multi-Agent Path Finding
di: Zang, Hongzhi, et al.
Pubblicazione: (2024)
di: Zang, Hongzhi, et al.
Pubblicazione: (2024)
TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
di: Lou, Xingzhou, et al.
Pubblicazione: (2023)
di: Lou, Xingzhou, et al.
Pubblicazione: (2023)
The Value of Variance: Mitigating Debate Collapse in Multi-Agent Systems via Uncertainty-Driven Policy Optimization
di: Tang, Luoxi, et al.
Pubblicazione: (2026)
di: Tang, Luoxi, et al.
Pubblicazione: (2026)
Helix: A Dual-Helix Co-Evolutionary Multi-Agent System for Prompt Optimization and Question Reformulation
di: Zhu, Kewen, et al.
Pubblicazione: (2026)
di: Zhu, Kewen, et al.
Pubblicazione: (2026)
DAO-Agent: Zero Knowledge-Verified Incentives for Decentralized Multi-Agent Coordination
di: Xia, Yihan, et al.
Pubblicazione: (2025)
di: Xia, Yihan, et al.
Pubblicazione: (2025)
Measuring Policy Distance for Multi-Agent Reinforcement Learning
di: Hu, Tianyi, et al.
Pubblicazione: (2024)
di: Hu, Tianyi, et al.
Pubblicazione: (2024)
Can a Robot Walk the Robotic Dog: Triple-Zero Collaborative Navigation for Heterogeneous Multi-Agent Systems
di: Wang, Yaxuan, et al.
Pubblicazione: (2026)
di: Wang, Yaxuan, et al.
Pubblicazione: (2026)
Rethinking Priority Scheduling for Sequential Multi-Agent Decision Making in Stackelberg Games
di: Liu, Xiangyu, et al.
Pubblicazione: (2026)
di: Liu, Xiangyu, et al.
Pubblicazione: (2026)
Symmetric Policy Design for Multi-Agent Dispatch Coordination in Supply Chains
di: Sudhakara, Sagar
Pubblicazione: (2025)
di: Sudhakara, Sagar
Pubblicazione: (2025)
Synthesis of Communication Policies for Multi-Agent Systems Robust to Communication Restrictions
di: Soudijani, Saleh, et al.
Pubblicazione: (2025)
di: Soudijani, Saleh, et al.
Pubblicazione: (2025)
Graphon Mean-Field Control for Cooperative Multi-Agent Reinforcement Learning
di: Hu, Yuanquan, et al.
Pubblicazione: (2022)
di: Hu, Yuanquan, et al.
Pubblicazione: (2022)
From Global Policies to Local Strategies: Multi-Objective Optimization of Resource-Specific Handover Policies
di: Kirchdorfer, Lukas, et al.
Pubblicazione: (2026)
di: Kirchdorfer, Lukas, et al.
Pubblicazione: (2026)
Influencing LLM Multi-Agent Dialogue via Policy-Parameterized Prompts
di: Bo, Hongbo, et al.
Pubblicazione: (2026)
di: Bo, Hongbo, et al.
Pubblicazione: (2026)
Safe Equilibrium Policy Optimization for Strategic Agent Policies
di: Arumugam, Karthika, et al.
Pubblicazione: (2026)
di: Arumugam, Karthika, et al.
Pubblicazione: (2026)
IBGP: Imperfect Byzantine Generals Problem for Zero-Shot Robustness in Communicative Multi-Agent Systems
di: Mao, Yihuan, et al.
Pubblicazione: (2024)
di: Mao, Yihuan, et al.
Pubblicazione: (2024)
VIL2C: Value-of-Information Aware Low-Latency Communication for Multi-Agent Reinforcement Learning
di: Zhang, Qian, et al.
Pubblicazione: (2025)
di: Zhang, Qian, et al.
Pubblicazione: (2025)
DTPPO: Dual-Transformer Encoder-based Proximal Policy Optimization for Multi-UAV Navigation in Unseen Complex Environments
di: Wei, Anning, et al.
Pubblicazione: (2024)
di: Wei, Anning, et al.
Pubblicazione: (2024)
MASTER: Multi-Agent Security Through Exploration of Roles and Topological Structures -- A Comprehensive Framework
di: Zhu, Yifan, et al.
Pubblicazione: (2025)
di: Zhu, Yifan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning
di: Zhang, Wenjing, et al.
Pubblicazione: (2025) -
Intrinsic Action Tendency Consistency for Cooperative Multi-Agent Reinforcement Learning
di: Zhang, Junkai, et al.
Pubblicazione: (2024) -
Generalized Per-Agent Advantage Estimation for Multi-Agent Policy Optimization
di: Kim, Seongmin, et al.
Pubblicazione: (2026) -
MARPO: A Reflective Policy Optimization for Multi Agent Reinforcement Learning
di: Wu, Cuiling, et al.
Pubblicazione: (2025) -
Agent-GSPO: Communication-Efficient Multi-Agent Systems via Group Sequence Policy Optimization
di: Fan, Yijia, et al.
Pubblicazione: (2025)