Optimistic Multi-Agent Policy Gradient
Fuente:
arXiv
Saved in:
| Main Authors: | Zhao, Wenshuai, Zhao, Yi, Li, Zhiyuan, Kannala, Juho, Pajarinen, Joni |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning Progress Driven Multi-Agent Curriculum
by: Zhao, Wenshuai, et al.
Published: (2022)
by: Zhao, Wenshuai, et al.
Published: (2022)
AgentMixer: Multi-Agent Correlated Policy Factorization
by: Li, Zhiyuan, et al.
Published: (2024)
by: Li, Zhiyuan, et al.
Published: (2024)
Closed-Loop Vision-Language Planning for Multi-Agent Coordination
by: Li, Zhiyuan, et al.
Published: (2025)
by: Li, Zhiyuan, et al.
Published: (2025)
Backpropagation Through Agents
by: Li, Zhiyuan, et al.
Published: (2024)
by: Li, Zhiyuan, et al.
Published: (2024)
Optimistic ε-Greedy Exploration for Cooperative Multi-Agent Reinforcement Learning
by: Zhang, Ruoning, et al.
Published: (2025)
by: Zhang, Ruoning, et al.
Published: (2025)
Heterogeneous Multi-agent Collaboration in UAV-assisted Mobile Crowdsensing Networks
by: Deng, Xianyang, et al.
Published: (2025)
by: Deng, Xianyang, et al.
Published: (2025)
Descent-Guided Policy Gradient for Scalable Cooperative Multi-Agent Learning
by: Yang, Shan, et al.
Published: (2026)
by: Yang, Shan, et al.
Published: (2026)
TeamTR: Trust-Region Fine-Tuning for Multi-Agent LLM Coordination
by: Xie, Yi, et al.
Published: (2026)
by: Xie, Yi, et al.
Published: (2026)
Conformal Off-Policy Prediction for Multi-Agent Systems
by: Kuipers, Tom, et al.
Published: (2024)
by: Kuipers, Tom, et al.
Published: (2024)
OPTIMA: Optimized Policy for Intelligent Multi-Agent Systems Enables Coordination-Aware Autonomous Vehicles
by: Du, Rui, et al.
Published: (2024)
by: Du, Rui, et al.
Published: (2024)
Stronger-MAS: Multi-Agent Reinforcement Learning for Collaborative LLMs
by: Zhao, Yujie, et al.
Published: (2025)
by: Zhao, Yujie, et al.
Published: (2025)
Effective Policy Learning for Multi-Agent Online Coordination Beyond Submodular Objectives
by: Zhang, Qixin, et al.
Published: (2025)
by: Zhang, Qixin, et al.
Published: (2025)
Mini Honor of Kings: A Lightweight Environment for Multi-Agent Reinforcement Learning
by: Liu, Lin, et al.
Published: (2024)
by: Liu, Lin, et al.
Published: (2024)
Double Distillation Network for Multi-Agent Reinforcement Learning
by: Zhou, Yang, et al.
Published: (2025)
by: Zhou, Yang, et al.
Published: (2025)
Hierarchical Policy-Gradient Reinforcement Learning for Multi-Agent Shepherding Control of Non-Cohesive Targets
by: Covone, Stefano, et al.
Published: (2025)
by: Covone, Stefano, et al.
Published: (2025)
Sparsely Supervised Diffusion
by: Zhao, Wenshuai, et al.
Published: (2026)
by: Zhao, Wenshuai, et al.
Published: (2026)
Multi-Agent Probabilistic Ensembles with Trajectory Sampling for Connected Autonomous Vehicles
by: Wen, Ruoqi, et al.
Published: (2023)
by: Wen, Ruoqi, et al.
Published: (2023)
The Value of Variance: Mitigating Debate Collapse in Multi-Agent Systems via Uncertainty-Driven Policy Optimization
by: Tang, Luoxi, et al.
Published: (2026)
by: Tang, Luoxi, et al.
Published: (2026)
Beyond the All-in-One Agent: Benchmarking Role-Specialized Multi-Agent Collaboration in Enterprise Workflows
by: Yu, Tao, et al.
Published: (2026)
by: Yu, Tao, et al.
Published: (2026)
MobiAgent: A Systematic Framework for Customizable Mobile Agents
by: Zhang, Cheng, et al.
Published: (2025)
by: Zhang, Cheng, et al.
Published: (2025)
Grouped Discrete Representation for Object-Centric Learning
by: Zhao, Rongzhen, et al.
Published: (2024)
by: Zhao, Rongzhen, et al.
Published: (2024)
Co-Optimizing Reconfigurable Environments and Policies for Decentralized Multi-Agent Navigation
by: Gao, Zhan, et al.
Published: (2024)
by: Gao, Zhan, et al.
Published: (2024)
Internal State-Based Policy Gradient Methods for Partially Observable Markov Potential Games
by: Yang, Wonseok, et al.
Published: (2026)
by: Yang, Wonseok, et al.
Published: (2026)
Adaptive Context Length Optimization with Low-Frequency Truncation for Multi-Agent Reinforcement Learning
by: Duan, Wenchang, et al.
Published: (2025)
by: Duan, Wenchang, et al.
Published: (2025)
Context Learning for Multi-Agent Discussion
by: Hua, Xingyuan, et al.
Published: (2026)
by: Hua, Xingyuan, et al.
Published: (2026)
From Solo to Symphony: Orchestrating Multi-Agent Collaboration with Single-Agent Demos
by: Wang, Xun, et al.
Published: (2025)
by: Wang, Xun, et al.
Published: (2025)
Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus
by: Zhao, Zijian, et al.
Published: (2026)
by: Zhao, Zijian, et al.
Published: (2026)
Beyond Scaling: Agents Are Heading to the Edge
by: Tian, Chunlin, et al.
Published: (2026)
by: Tian, Chunlin, et al.
Published: (2026)
Multi-Agent Craftax: Benchmarking Open-Ended Multi-Agent Reinforcement Learning at the Hyperscale
by: Omari, Bassel Al, et al.
Published: (2025)
by: Omari, Bassel Al, et al.
Published: (2025)
Decentralized Diffusion Policy Learning for Enhanced Exploration in Cooperative Multi-agent Reinforcement Learning
by: Zhang, Yuyang, et al.
Published: (2026)
by: Zhang, Yuyang, et al.
Published: (2026)
LEED: A Highly Efficient and Scalable LLM-Empowered Expert Demonstrations Framework for Multi-Agent Reinforcement Learning
by: Duan, Tianyang, et al.
Published: (2025)
by: Duan, Tianyang, et al.
Published: (2025)
AgentsNet: Coordination and Collaborative Reasoning in Multi-Agent LLMs
by: Grötschla, Florian, et al.
Published: (2025)
by: Grötschla, Florian, et al.
Published: (2025)
Agent Bazaar: Enabling Economic Alignment in Multi-Agent Marketplaces
by: Karten, Seth, et al.
Published: (2026)
by: Karten, Seth, et al.
Published: (2026)
Multi-Agent Coordination via Multi-Level Communication
by: Ding, Ziluo, et al.
Published: (2022)
by: Ding, Ziluo, et al.
Published: (2022)
Cooperative Multi-Agent Graph Bandits: UCB Algorithm and Regret Analysis
by: Paschalidis, Phevos, et al.
Published: (2024)
by: Paschalidis, Phevos, et al.
Published: (2024)
Continuous-Time Value Iteration for Multi-Agent Reinforcement Learning
by: Wang, Xuefeng, et al.
Published: (2025)
by: Wang, Xuefeng, et al.
Published: (2025)
Communication Learning in Multi-Agent Systems from Graph Modeling Perspective
by: Hu, Shengchao, et al.
Published: (2024)
by: Hu, Shengchao, et al.
Published: (2024)
Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models
by: Zhang, Yang, et al.
Published: (2024)
by: Zhang, Yang, et al.
Published: (2024)
GoAgent: Group-of-Agents Communication Topology Generation for LLM-based Multi-Agent Systems
by: Chen, Hongjiang, et al.
Published: (2026)
by: Chen, Hongjiang, et al.
Published: (2026)
Sequence Pathfinder for Multi-Agent Pickup and Delivery in the Warehouse
by: Zhao, Zeyuan, et al.
Published: (2025)
by: Zhao, Zeyuan, et al.
Published: (2025)
Similar Items
-
Learning Progress Driven Multi-Agent Curriculum
by: Zhao, Wenshuai, et al.
Published: (2022) -
AgentMixer: Multi-Agent Correlated Policy Factorization
by: Li, Zhiyuan, et al.
Published: (2024) -
Closed-Loop Vision-Language Planning for Multi-Agent Coordination
by: Li, Zhiyuan, et al.
Published: (2025) -
Backpropagation Through Agents
by: Li, Zhiyuan, et al.
Published: (2024) -
Optimistic ε-Greedy Exploration for Cooperative Multi-Agent Reinforcement Learning
by: Zhang, Ruoning, et al.
Published: (2025)