CPIG: Leveraging Consistency Policy with Intention Guidance for Multi-agent Exploration
Fuente:
arXiv
Guardado en:
| Autores principales: | Fu, Yuqian, Zhu, Yuanheng, Li, Haoran, Zhao, Zijie, Chai, Jiajun, Zhao, Dongbin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Decentralized Diffusion Policy Learning for Enhanced Exploration in Cooperative Multi-agent Reinforcement Learning
por: Zhang, Yuyang, et al.
Publicado: (2026)
por: Zhang, Yuyang, et al.
Publicado: (2026)
Multi-agent Uncertainty-Aware Pessimistic Model-Based Reinforcement Learning for Connected Autonomous Vehicles
por: Wen, Ruoqi, et al.
Publicado: (2025)
por: Wen, Ruoqi, et al.
Publicado: (2025)
Knowing What Not to Do: Leverage Language Model Insights for Action Space Pruning in Multi-agent Reinforcement Learning
por: Liu, Zhihao, et al.
Publicado: (2024)
por: Liu, Zhihao, et al.
Publicado: (2024)
Graph Exploration for Effective Multi-agent Q-Learning
por: Zhaikhan, Ainur, et al.
Publicado: (2023)
por: Zhaikhan, Ainur, et al.
Publicado: (2023)
Optimistic Multi-Agent Policy Gradient
por: Zhao, Wenshuai, et al.
Publicado: (2023)
por: Zhao, Wenshuai, et al.
Publicado: (2023)
MARLIN: Multi-Agent Reinforcement Learning with Murmuration Intelligence and LLM Guidance for Reservoir Management
por: Fu, Heming, et al.
Publicado: (2025)
por: Fu, Heming, et al.
Publicado: (2025)
DHLight: Multi-agent Policy-based Directed Hypergraph Learning for Traffic Signal Control
por: Lei, Zhen, et al.
Publicado: (2024)
por: Lei, Zhen, et al.
Publicado: (2024)
IFS: Information Flow Structure for Multi-agent Ad Hoc System
por: Fu, Yanqing, et al.
Publicado: (2025)
por: Fu, Yanqing, et al.
Publicado: (2025)
Exploration enhances cooperation in the multi-agent communication system
por: Song, Zhao, et al.
Publicado: (2026)
por: Song, Zhao, et al.
Publicado: (2026)
Consensus Tracking Control of Multi-agent Systems with A Time-varying Reference State under Binary-valued Communication
por: Wang, Ting, et al.
Publicado: (2025)
por: Wang, Ting, et al.
Publicado: (2025)
Bayesian Optimization Framework for Efficient Fleet Design in Autonomous Multi-Robot Exploration
por: Concha, David Molina, et al.
Publicado: (2024)
por: Concha, David Molina, et al.
Publicado: (2024)
DTPPO: Dual-Transformer Encoder-based Proximal Policy Optimization for Multi-UAV Navigation in Unseen Complex Environments
por: Wei, Anning, et al.
Publicado: (2024)
por: Wei, Anning, et al.
Publicado: (2024)
Distributed Zeroth-Order Policy Gradient for Networked Multi-agent Reinforcement Learning from Human Feedback
por: Dai, Pengcheng, et al.
Publicado: (2026)
por: Dai, Pengcheng, et al.
Publicado: (2026)
Heterogeneous Multi-agent Collaboration in UAV-assisted Mobile Crowdsensing Networks
por: Deng, Xianyang, et al.
Publicado: (2025)
por: Deng, Xianyang, et al.
Publicado: (2025)
Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation
por: Wang, Siying, et al.
Publicado: (2025)
por: Wang, Siying, et al.
Publicado: (2025)
Online Guidance Graph Optimization for Lifelong Multi-Agent Path Finding
por: Zang, Hongzhi, et al.
Publicado: (2024)
por: Zang, Hongzhi, et al.
Publicado: (2024)
MARPO: A Reflective Policy Optimization for Multi Agent Reinforcement Learning
por: Wu, Cuiling, et al.
Publicado: (2025)
por: Wu, Cuiling, et al.
Publicado: (2025)
AgentMixer: Multi-Agent Correlated Policy Factorization
por: Li, Zhiyuan, et al.
Publicado: (2024)
por: Li, Zhiyuan, et al.
Publicado: (2024)
Multi-agent Reinforcement Learning for Low-Carbon P2P Energy Trading among Self-Interested Microgrids
por: Ren, Junhao, et al.
Publicado: (2026)
por: Ren, Junhao, et al.
Publicado: (2026)
Multi-UAV Path Following using Vector-Field Guidance
por: Kumar, Gautam, et al.
Publicado: (2026)
por: Kumar, Gautam, et al.
Publicado: (2026)
Replicating the behaviour of electric vehicle drivers using an agent-based reinforcement learning model
por: Feng, Zixin, et al.
Publicado: (2025)
por: Feng, Zixin, et al.
Publicado: (2025)
TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
por: Lou, Xingzhou, et al.
Publicado: (2023)
por: Lou, Xingzhou, et al.
Publicado: (2023)
H-NeiFi: Non-Invasive and Consensus-Efficient Multi-Agent Opinion Guidance
por: Guo, Shijun, et al.
Publicado: (2025)
por: Guo, Shijun, et al.
Publicado: (2025)
Graph Neural Network-based Multi-agent Reinforcement Learning for Resilient Distributed Coordination of Multi-Robot Systems
por: Goeckner, Anthony, et al.
Publicado: (2024)
por: Goeckner, Anthony, et al.
Publicado: (2024)
Achilles Heel of Distributed Multi-Agent Systems
por: Zhang, Yiting, et al.
Publicado: (2025)
por: Zhang, Yiting, et al.
Publicado: (2025)
Motion Prediction of Multi-agent systems with Multi-view clustering
por: James, Anegi, et al.
Publicado: (2024)
por: James, Anegi, et al.
Publicado: (2024)
Communication-Efficient Soft Actor-Critic Policy Collaboration via Regulated Segment Mixture
por: Yu, Xiaoxue, et al.
Publicado: (2023)
por: Yu, Xiaoxue, et al.
Publicado: (2023)
Helix: A Dual-Helix Co-Evolutionary Multi-Agent System for Prompt Optimization and Question Reformulation
por: Zhu, Kewen, et al.
Publicado: (2026)
por: Zhu, Kewen, et al.
Publicado: (2026)
How Exploration Breaks Cooperation in Shared-Policy Multi-Agent Reinforcement Learning
por: Weng, Yi-Ning, et al.
Publicado: (2026)
por: Weng, Yi-Ning, et al.
Publicado: (2026)
Multi-agent Reinforcement Learning-based Joint Design of Low-Carbon P2P Market and Bidding Strategy in Microgrids
por: Ren, Junhao, et al.
Publicado: (2026)
por: Ren, Junhao, et al.
Publicado: (2026)
Joint Optimization of Multi-agent Memory System
por: Mao, Wenyu, et al.
Publicado: (2026)
por: Mao, Wenyu, et al.
Publicado: (2026)
Distributed Finite-time Differentiator for Multi-agent Systems Under Directed Graph
por: Chen, Weile, et al.
Publicado: (2024)
por: Chen, Weile, et al.
Publicado: (2024)
Efficient Leave-one-out Approximation in LLM Multi-agent Debate Based on Introspection
por: Cui, Yue, et al.
Publicado: (2025)
por: Cui, Yue, et al.
Publicado: (2025)
Robust Multi-agent Communication Based on Decentralization-Oriented Adversarial Training
por: Ma, Xuyan, et al.
Publicado: (2025)
por: Ma, Xuyan, et al.
Publicado: (2025)
Language Grounded Multi-agent Reinforcement Learning with Human-interpretable Communication
por: Li, Huao, et al.
Publicado: (2024)
por: Li, Huao, et al.
Publicado: (2024)
Hierarchical Multiagent Reinforcement Learning for Multi-Group Tax Game
por: Guo, Honglei, et al.
Publicado: (2026)
por: Guo, Honglei, et al.
Publicado: (2026)
Who's the Mole? Modeling and Detecting Intention-Hiding Malicious Agents in LLM-Based Multi-Agent Systems
por: Xie, Yizhe, et al.
Publicado: (2025)
por: Xie, Yizhe, et al.
Publicado: (2025)
Sima 1.0: A Collaborative Multi-Agent Framework for Documentary Video Production
por: Song, Zhao
Publicado: (2026)
por: Song, Zhao
Publicado: (2026)
Streaming Multi-agent Pathfinding
por: Tang, Mingkai, et al.
Publicado: (2025)
por: Tang, Mingkai, et al.
Publicado: (2025)
Adaptation of Parameters in Heterogeneous Multi-agent Systems
por: Shim, Hyungbo, et al.
Publicado: (2025)
por: Shim, Hyungbo, et al.
Publicado: (2025)
Ejemplares similares
-
Decentralized Diffusion Policy Learning for Enhanced Exploration in Cooperative Multi-agent Reinforcement Learning
por: Zhang, Yuyang, et al.
Publicado: (2026) -
Multi-agent Uncertainty-Aware Pessimistic Model-Based Reinforcement Learning for Connected Autonomous Vehicles
por: Wen, Ruoqi, et al.
Publicado: (2025) -
Knowing What Not to Do: Leverage Language Model Insights for Action Space Pruning in Multi-agent Reinforcement Learning
por: Liu, Zhihao, et al.
Publicado: (2024) -
Graph Exploration for Effective Multi-agent Q-Learning
por: Zhaikhan, Ainur, et al.
Publicado: (2023) -
Optimistic Multi-Agent Policy Gradient
por: Zhao, Wenshuai, et al.
Publicado: (2023)