Policy Optimization in Multi-Agent Settings under Partially Observable Environments
Fuente:
arXiv
Saved in:
| Main Authors: | Zhaikhan, Ainur, Khammassi, Malek, Sayed, Ali H. |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-agent Off-policy Actor-Critic Reinforcement Learning for Partially Observable Environments
by: Zhaikhan, Ainur, et al.
Published: (2024)
by: Zhaikhan, Ainur, et al.
Published: (2024)
Graph Exploration for Effective Multi-agent Q-Learning
by: Zhaikhan, Ainur, et al.
Published: (2023)
by: Zhaikhan, Ainur, et al.
Published: (2023)
MACRO-LLM: LLM-Empowered Multi-Agent Collaborative Reasoning under Spatiotemporal Partial Observability
by: Chen, Handi, et al.
Published: (2026)
by: Chen, Handi, et al.
Published: (2026)
LLaMAR: Long-Horizon Planning for Multi-Agent Robots in Partially Observable Environments
by: Nayak, Siddharth, et al.
Published: (2024)
by: Nayak, Siddharth, et al.
Published: (2024)
Computing Universal Plans for Partially Observable Multi-Agent Routing Using Answer Set Programming
by: Zhu, Fengming, et al.
Published: (2023)
by: Zhu, Fengming, et al.
Published: (2023)
Evader-Agnostic Team-Based Pursuit Strategies in Partially-Observable Environments
by: Kalanther, Addison, et al.
Published: (2025)
by: Kalanther, Addison, et al.
Published: (2025)
Transparency as Delayed Observability in Multi-Agent Systems
by: Dwarakanath, Kshama, et al.
Published: (2024)
by: Dwarakanath, Kshama, et al.
Published: (2024)
Coordinated Autonomous Drones for Human-Centered Fire Evacuation in Partially Observable Urban Environments
by: Mendoza, Maria G., et al.
Published: (2025)
by: Mendoza, Maria G., et al.
Published: (2025)
Generalized Per-Agent Advantage Estimation for Multi-Agent Policy Optimization
by: Kim, Seongmin, et al.
Published: (2026)
by: Kim, Seongmin, et al.
Published: (2026)
Co-Optimizing Reconfigurable Environments and Policies for Decentralized Multi-Agent Navigation
by: Gao, Zhan, et al.
Published: (2024)
by: Gao, Zhan, et al.
Published: (2024)
Internal State-Based Policy Gradient Methods for Partially Observable Markov Potential Games
by: Yang, Wonseok, et al.
Published: (2026)
by: Yang, Wonseok, et al.
Published: (2026)
Generating Local Shields for Decentralised Partially Observable Markov Decision Processes
by: Yang, Haoran, et al.
Published: (2026)
by: Yang, Haoran, et al.
Published: (2026)
Multi-Agent Coordination for a Partially Observable and Dynamic Robot Soccer Environment with Limited Communication
by: Affinita, Daniele, et al.
Published: (2024)
by: Affinita, Daniele, et al.
Published: (2024)
MARPO: A Reflective Policy Optimization for Multi Agent Reinforcement Learning
by: Wu, Cuiling, et al.
Published: (2025)
by: Wu, Cuiling, et al.
Published: (2025)
Asynchronous Diffusion Learning with Agent Subsampling and Local Updates
by: Rizk, Elsa, et al.
Published: (2024)
by: Rizk, Elsa, et al.
Published: (2024)
Partially Observable Multi-Agent Reinforcement Learning with Information Sharing
by: Liu, Xiangyu, et al.
Published: (2023)
by: Liu, Xiangyu, et al.
Published: (2023)
Multi-Agent Guided Policy Optimization
by: Li, Yueheng, et al.
Published: (2025)
by: Li, Yueheng, et al.
Published: (2025)
PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making
by: Light, Jonathan, et al.
Published: (2024)
by: Light, Jonathan, et al.
Published: (2024)
Nash Approximation Gap in Truncated Infinite-horizon Partially Observable Markov Games
by: Sang, Lan, et al.
Published: (2026)
by: Sang, Lan, et al.
Published: (2026)
Differentiable Environment-Trajectory Co-Optimization for Safe Multi-Agent Navigation
by: Gao, Zhan, et al.
Published: (2026)
by: Gao, Zhan, et al.
Published: (2026)
Asynchronous Training of Mixed-Role Human Actors in a Partially-Observable Environment
by: Chang, Kimberlee Chestnut, et al.
Published: (2024)
by: Chang, Kimberlee Chestnut, et al.
Published: (2024)
Assigning Credit with Partial Reward Decoupling in Multi-Agent Proximal Policy Optimization
by: Kapoor, Aditya, et al.
Published: (2024)
by: Kapoor, Aditya, et al.
Published: (2024)
DTPPO: Dual-Transformer Encoder-based Proximal Policy Optimization for Multi-UAV Navigation in Unseen Complex Environments
by: Wei, Anning, et al.
Published: (2024)
by: Wei, Anning, et al.
Published: (2024)
On-policy Actor-Critic Reinforcement Learning for Multi-UAV Exploration
by: Farid, Ali Moltajaei, et al.
Published: (2024)
by: Farid, Ali Moltajaei, et al.
Published: (2024)
B2MAPO: A Batch-by-Batch Multi-Agent Policy Optimization to Balance Performance and Efficiency
by: Zhang, Wenjing, et al.
Published: (2024)
by: Zhang, Wenjing, et al.
Published: (2024)
Leveraging Partial Symmetry for Multi-Agent Reinforcement Learning
by: Yu, Xin, et al.
Published: (2023)
by: Yu, Xin, et al.
Published: (2023)
NegotiationGym: Self-Optimizing Agents in a Multi-Agent Social Simulation Environment
by: Mangla, Shashank, et al.
Published: (2025)
by: Mangla, Shashank, et al.
Published: (2025)
Multi-Agent Motion Planning with Bézier Curve Optimization under Kinodynamic Constraints
by: Yan, Jingtian, et al.
Published: (2023)
by: Yan, Jingtian, et al.
Published: (2023)
Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation
by: Wang, Siying, et al.
Published: (2025)
by: Wang, Siying, et al.
Published: (2025)
Dynamic Strategy Adaptation in Multi-Agent Environments with Large Language Models
by: Mallampati, Shaurya, et al.
Published: (2025)
by: Mallampati, Shaurya, et al.
Published: (2025)
Collaborative State Fusion in Partially Known Multi-agent Environments
by: Zhou, Tianlong, et al.
Published: (2024)
by: Zhou, Tianlong, et al.
Published: (2024)
Agent-GSPO: Communication-Efficient Multi-Agent Systems via Group Sequence Policy Optimization
by: Fan, Yijia, et al.
Published: (2025)
by: Fan, Yijia, et al.
Published: (2025)
High-Probability Convergence in Decentralized Stochastic Optimization with Gradient Tracking
by: Armacki, Aleksandar, et al.
Published: (2026)
by: Armacki, Aleksandar, et al.
Published: (2026)
Symmetric Policy Design for Multi-Agent Dispatch Coordination in Supply Chains
by: Sudhakara, Sagar
Published: (2025)
by: Sudhakara, Sagar
Published: (2025)
Synthesis of Communication Policies for Multi-Agent Systems Robust to Communication Restrictions
by: Soudijani, Saleh, et al.
Published: (2025)
by: Soudijani, Saleh, et al.
Published: (2025)
From Global Policies to Local Strategies: Multi-Objective Optimization of Resource-Specific Handover Policies
by: Kirchdorfer, Lukas, et al.
Published: (2026)
by: Kirchdorfer, Lukas, et al.
Published: (2026)
Safe Equilibrium Policy Optimization for Strategic Agent Policies
by: Arumugam, Karthika, et al.
Published: (2026)
by: Arumugam, Karthika, et al.
Published: (2026)
Detection of Malicious Agents in Social Learning
by: Shumovskaia, Valentina, et al.
Published: (2024)
by: Shumovskaia, Valentina, et al.
Published: (2024)
On Mobile Ad Hoc Networks for Coverage of Partially Observable Worlds
by: Meriaux, Edwin, et al.
Published: (2025)
by: Meriaux, Edwin, et al.
Published: (2025)
Partial Attention in Deep Reinforcement Learning for Safe Multi-Agent Control
by: Mohaya, Turki Bin, et al.
Published: (2026)
by: Mohaya, Turki Bin, et al.
Published: (2026)
Similar Items
-
Multi-agent Off-policy Actor-Critic Reinforcement Learning for Partially Observable Environments
by: Zhaikhan, Ainur, et al.
Published: (2024) -
Graph Exploration for Effective Multi-agent Q-Learning
by: Zhaikhan, Ainur, et al.
Published: (2023) -
MACRO-LLM: LLM-Empowered Multi-Agent Collaborative Reasoning under Spatiotemporal Partial Observability
by: Chen, Handi, et al.
Published: (2026) -
LLaMAR: Long-Horizon Planning for Multi-Agent Robots in Partially Observable Environments
by: Nayak, Siddharth, et al.
Published: (2024) -
Computing Universal Plans for Partially Observable Multi-Agent Routing Using Answer Set Programming
by: Zhu, Fengming, et al.
Published: (2023)