Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Zhuoran, Zhong, Hai, Wang, Xun, Xia, Qingxin, Zhang, Lihua, Huang, Longbo |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
OM2P: Offline Multi-Agent Mean-Flow Policy
by: Li, Zhuoran, et al.
Published: (2025)
by: Li, Zhuoran, et al.
Published: (2025)
Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration
by: Zhong, Hai, et al.
Published: (2024)
by: Zhong, Hai, et al.
Published: (2024)
Offline Critic-Guided Diffusion Policy for Multi-User Delay-Constrained Scheduling
by: Li, Zhuoran, et al.
Published: (2025)
by: Li, Zhuoran, et al.
Published: (2025)
Reparameterization Flow Policy Optimization
by: Zhong, Hai, et al.
Published: (2026)
by: Zhong, Hai, et al.
Published: (2026)
Reparameterization Proximal Policy Optimization
by: Zhong, Hai, et al.
Published: (2025)
by: Zhong, Hai, et al.
Published: (2025)
Beyond Shallow Behavior: Task-Efficient Value-Based Multi-Task Offline MARL via Skill Discovery
by: Wang, Xun, et al.
Published: (2025)
by: Wang, Xun, et al.
Published: (2025)
Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training
by: Chen, Ruishuo, et al.
Published: (2025)
by: Chen, Ruishuo, et al.
Published: (2025)
From Solo to Symphony: Orchestrating Multi-Agent Collaboration with Single-Agent Demos
by: Wang, Xun, et al.
Published: (2025)
by: Wang, Xun, et al.
Published: (2025)
Beyond Squared Error: Exploring Loss Design for Enhanced Training of Generative Flow Networks
by: Hu, Rui, et al.
Published: (2024)
by: Hu, Rui, et al.
Published: (2024)
PowerFlow: Unlocking the Dual Nature of LLMs via Principled Distribution Matching
by: Chen, Ruishuo, et al.
Published: (2026)
by: Chen, Ruishuo, et al.
Published: (2026)
Layer-Aware Influence for Online Data Valuation Estimation
by: Yang, Ziao, et al.
Published: (2025)
by: Yang, Ziao, et al.
Published: (2025)
Latent Diffusion : Multi-Dimension Stable Diffusion Latent Space Explorer
by: Zhong, Zhihua, et al.
Published: (2025)
by: Zhong, Zhihua, et al.
Published: (2025)
Real-Time Parallel Counterfactual Regret Minimization
by: Li, Boning, et al.
Published: (2026)
by: Li, Boning, et al.
Published: (2026)
PokerSkill: LLMs Can Play Expert-Level Poker without Training or Solvers
by: Li, Boning, et al.
Published: (2026)
by: Li, Boning, et al.
Published: (2026)
Make-An-Agent: A Generalizable Policy Network Generator with Behavior-Prompted Diffusion
by: Liang, Yongyuan, et al.
Published: (2024)
by: Liang, Yongyuan, et al.
Published: (2024)
Learning Coordinated Bimanual Manipulation Policies using State Diffusion and Inverse Dynamics Models
by: Chen, Haonan, et al.
Published: (2025)
by: Chen, Haonan, et al.
Published: (2025)
AdaWorldPolicy: World-Model-Driven Diffusion Policy with Online Adaptive Learning for Robotic Manipulation
by: Yuan, Ge, et al.
Published: (2026)
by: Yuan, Ge, et al.
Published: (2026)
AC-DiT: Adaptive Coordination Diffusion Transformer for Mobile Manipulation
by: Chen, Sixiang, et al.
Published: (2025)
by: Chen, Sixiang, et al.
Published: (2025)
Efficient and Stable Reinforcement Learning for Diffusion Language Models
by: Liu, Jiawei, et al.
Published: (2026)
by: Liu, Jiawei, et al.
Published: (2026)
D2PPO: Diffusion Policy Policy Optimization with Dispersive Loss
by: Zou, Guowei, et al.
Published: (2025)
by: Zou, Guowei, et al.
Published: (2025)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
by: Huang, Xiao, et al.
Published: (2025)
by: Huang, Xiao, et al.
Published: (2025)
KABB: Knowledge-Aware Bayesian Bandits for Dynamic Expert Coordination in Multi-Agent Systems
by: Zhang, Jusheng, et al.
Published: (2025)
by: Zhang, Jusheng, et al.
Published: (2025)
Diffusion-Inspired Cold Start with Sufficient Prior in Computerized Adaptive Testing
by: Ma, Haiping, et al.
Published: (2024)
by: Ma, Haiping, et al.
Published: (2024)
Finite-time Convergence Analysis of Actor-Critic with Evolving Reward
by: Hu, Rui, et al.
Published: (2025)
by: Hu, Rui, et al.
Published: (2025)
Network Topology Optimization via Deep Reinforcement Learning
by: Li, Zhuoran, et al.
Published: (2022)
by: Li, Zhuoran, et al.
Published: (2022)
Agent-GSPO: Communication-Efficient Multi-Agent Systems via Group Sequence Policy Optimization
by: Fan, Yijia, et al.
Published: (2025)
by: Fan, Yijia, et al.
Published: (2025)
GlobeDiff: State Diffusion Process for Partial Observability in Multi-Agent Systems
by: Yang, Yiqin, et al.
Published: (2026)
by: Yang, Yiqin, et al.
Published: (2026)
Streaming Diffusion Policy: Fast Policy Synthesis with Variable Noise Diffusion Models
by: Høeg, Sigmund H., et al.
Published: (2024)
by: Høeg, Sigmund H., et al.
Published: (2024)
RADAR: Redundancy-Aware Diffusion for Multi-Agent Communication Structure Generation
by: Zhang, Zhen, et al.
Published: (2026)
by: Zhang, Zhen, et al.
Published: (2026)
Phase-Scheduled Multi-Agent Systems for Token-Efficient Coordination
by: Dubey, Mohit
Published: (2026)
by: Dubey, Mohit
Published: (2026)
Conditional Diffusion Model for Multi-Agent Dynamic Task Decomposition
by: Zhu, Yanda, et al.
Published: (2025)
by: Zhu, Yanda, et al.
Published: (2025)
On-Device Diffusion Transformer Policy for Efficient Robot Manipulation
by: Wu, Yiming, et al.
Published: (2025)
by: Wu, Yiming, et al.
Published: (2025)
Adaptive Theory of Mind for LLM-based Multi-Agent Coordination
by: Mu, Chunjiang, et al.
Published: (2026)
by: Mu, Chunjiang, et al.
Published: (2026)
Agents on a Tree: Pathwise Coordination for Multi-Objective Molecular Optimization
by: Zhang, Jia, et al.
Published: (2026)
by: Zhang, Jia, et al.
Published: (2026)
Feedback Efficient Online Fine-Tuning of Diffusion Models
by: Uehara, Masatoshi, et al.
Published: (2024)
by: Uehara, Masatoshi, et al.
Published: (2024)
NaRA: Noise-Aware LoRA for Parameter-Efficient Fine-Tuning of Diffusion LLMs
by: Wang, Shuaidi, et al.
Published: (2026)
by: Wang, Shuaidi, et al.
Published: (2026)
Distributional Soft Actor-Critic with Diffusion Policy
by: Liu, Tong, et al.
Published: (2025)
by: Liu, Tong, et al.
Published: (2025)
SCORP: Scene-Consistent Multi-agent Diffusion Planning with Stable Online Reinforcement Post-Training for Cooperative Driving
by: Bai, Haojie, et al.
Published: (2026)
by: Bai, Haojie, et al.
Published: (2026)
CoFlow: Coordinated Few-Step Flow for Offline Multi-Agent Decision Making
by: Zou, Guowei, et al.
Published: (2026)
by: Zou, Guowei, et al.
Published: (2026)
A Review of Online Diffusion Policy RL Algorithms for Scalable Robotic Control
by: Choi, Wonhyeok, et al.
Published: (2026)
by: Choi, Wonhyeok, et al.
Published: (2026)
Similar Items
-
OM2P: Offline Multi-Agent Mean-Flow Policy
by: Li, Zhuoran, et al.
Published: (2025) -
Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration
by: Zhong, Hai, et al.
Published: (2024) -
Offline Critic-Guided Diffusion Policy for Multi-User Delay-Constrained Scheduling
by: Li, Zhuoran, et al.
Published: (2025) -
Reparameterization Flow Policy Optimization
by: Zhong, Hai, et al.
Published: (2026) -
Reparameterization Proximal Policy Optimization
by: Zhong, Hai, et al.
Published: (2025)