Beyond Shallow Behavior: Task-Efficient Value-Based Multi-Task Offline MARL via Skill Discovery
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Xun, Li, Zhuoran, Zhong, Hai, Huang, Longbo |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning Generalizable Skills from Offline Multi-Task Data for Multi-Agent Cooperation
by: Liu, Sicong, et al.
Published: (2025)
by: Liu, Sicong, et al.
Published: (2025)
From Solo to Symphony: Orchestrating Multi-Agent Collaboration with Single-Agent Demos
by: Wang, Xun, et al.
Published: (2025)
by: Wang, Xun, et al.
Published: (2025)
Coordination Failure in Cooperative Offline MARL
by: Tilbury, Callum Rhys, et al.
Published: (2024)
by: Tilbury, Callum Rhys, et al.
Published: (2024)
Learning Partial Action Replacement in Offline MARL
by: Jin, Yue, et al.
Published: (2026)
by: Jin, Yue, et al.
Published: (2026)
Partial Action Replacement: Tackling Distribution Shift in Offline MARL
by: Jin, Yue, et al.
Published: (2025)
by: Jin, Yue, et al.
Published: (2025)
BenchMARL: Benchmarking Multi-Agent Reinforcement Learning
by: Bettini, Matteo, et al.
Published: (2023)
by: Bettini, Matteo, et al.
Published: (2023)
HyperMARL: Adaptive Hypernetworks for Multi-Agent RL
by: Tessera, Kale-ab Abebe, et al.
Published: (2024)
by: Tessera, Kale-ab Abebe, et al.
Published: (2024)
Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus
by: Zhao, Zijian, et al.
Published: (2026)
by: Zhao, Zijian, et al.
Published: (2026)
Sable: a Performant, Efficient and Scalable Sequence Model for MARL
by: Mahjoub, Omayma, et al.
Published: (2024)
by: Mahjoub, Omayma, et al.
Published: (2024)
JaxMARL: Multi-Agent RL Environments and Algorithms in JAX
by: Rutherford, Alexander, et al.
Published: (2023)
by: Rutherford, Alexander, et al.
Published: (2023)
Investigating Relational State Abstraction in Collaborative MARL
by: Utke, Sharlin, et al.
Published: (2024)
by: Utke, Sharlin, et al.
Published: (2024)
Towards Global Optimality in Cooperative MARL with the Transformation And Distillation Framework
by: Ye, Jianing, et al.
Published: (2022)
by: Ye, Jianing, et al.
Published: (2022)
Is Centralized Training with Decentralized Execution Framework Centralized Enough for MARL?
by: Zhou, Yihe, et al.
Published: (2023)
by: Zhou, Yihe, et al.
Published: (2023)
Multi-Agent Path Finding via Offline RL and LLM Collaboration
by: Atasever, Merve, et al.
Published: (2025)
by: Atasever, Merve, et al.
Published: (2025)
The Composite Task Challenge for Cooperative Multi-Agent Reinforcement Learning
by: Li, Yurui, et al.
Published: (2025)
by: Li, Yurui, et al.
Published: (2025)
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem
by: Barde, Paul, et al.
Published: (2023)
by: Barde, Paul, et al.
Published: (2023)
Achieving Optimal Tissue Repair Through MARL with Reward Shaping and Curriculum Learning
by: Khan, Muhammad Al-Zafar, et al.
Published: (2025)
by: Khan, Muhammad Al-Zafar, et al.
Published: (2025)
Attention-Driven Multi-Agent Reinforcement Learning: Enhancing Decisions with Expertise-Informed Tasks
by: Kuroswiski, Andre R, et al.
Published: (2024)
by: Kuroswiski, Andre R, et al.
Published: (2024)
Triple-BERT: Do We Really Need MARL for Order Dispatch on Ride-Sharing Platforms?
by: Zhao, Zijian, et al.
Published: (2025)
by: Zhao, Zijian, et al.
Published: (2025)
Generalizing Cooperative Eco-driving via Multi-residual Task Learning
by: Jayawardana, Vindula, et al.
Published: (2024)
by: Jayawardana, Vindula, et al.
Published: (2024)
Selective Reincarnation: Offline-to-Online Multi-Agent Reinforcement Learning
by: Formanek, Claude, et al.
Published: (2023)
by: Formanek, Claude, et al.
Published: (2023)
Putting Data at the Centre of Offline Multi-Agent Reinforcement Learning
by: Formanek, Claude, et al.
Published: (2024)
by: Formanek, Claude, et al.
Published: (2024)
Improvement of Optimization using Learning Based Models in Mixed Integer Linear Programming Tasks
by: Wang, Xiaoke, et al.
Published: (2025)
by: Wang, Xiaoke, et al.
Published: (2025)
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
by: Behari, Nikhil, et al.
Published: (2024)
by: Behari, Nikhil, et al.
Published: (2024)
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks
by: Biswas, Arpita, et al.
Published: (2023)
by: Biswas, Arpita, et al.
Published: (2023)
EcoFair-CH-MARL: Scalable Constrained Hierarchical Multi-Agent RL with Real-Time Emission Budgets and Fairness Guarantees
by: Alqithami, Saad
Published: (2026)
by: Alqithami, Saad
Published: (2026)
Episodic Memory in Agentic Frameworks: Suggesting Next Tasks
by: Fiorini, Sandro Rama, et al.
Published: (2025)
by: Fiorini, Sandro Rama, et al.
Published: (2025)
Meritocratic Fairness in Budgeted Combinatorial Multi-armed Bandits via Shapley Values
by: Sharma, Shradha, et al.
Published: (2026)
by: Sharma, Shradha, et al.
Published: (2026)
SkillGen: Verified Inference-Time Agent Skill Synthesis
by: Ma, Yuchen, et al.
Published: (2026)
by: Ma, Yuchen, et al.
Published: (2026)
OffLight: An Offline Multi-Agent Reinforcement Learning Framework for Traffic Signal Control
by: Bokade, Rohit, et al.
Published: (2024)
by: Bokade, Rohit, et al.
Published: (2024)
Distributed Multi-Agent Reinforcement Learning Based on Graph-Induced Local Value Functions
by: Jing, Gangshan, et al.
Published: (2022)
by: Jing, Gangshan, et al.
Published: (2022)
JCAS-MARL: Joint Communication and Sensing UAV Networks via Resource-Constrained Multi-Agent Reinforcement Learning
by: Guven, Islam, et al.
Published: (2026)
by: Guven, Islam, et al.
Published: (2026)
Imagine, Initialize, and Explore: An Effective Exploration Method in Multi-Agent Reinforcement Learning
by: Liu, Zeyang, et al.
Published: (2024)
by: Liu, Zeyang, et al.
Published: (2024)
In-Context Curiosity: Distilling Exploration for Decision-Pretrained Transformers on Bandit Tasks
by: Yang, Huitao, et al.
Published: (2025)
by: Yang, Huitao, et al.
Published: (2025)
Flexible Swarm Learning May Outpace Foundation Models in Essential Tasks
by: Samadi, Moein E., et al.
Published: (2025)
by: Samadi, Moein E., et al.
Published: (2025)
Skill-Aligned Fairness in Multi-Agent Learning for Collaboration in Healthcare
by: Ekpo, Promise Osaine, et al.
Published: (2025)
by: Ekpo, Promise Osaine, et al.
Published: (2025)
SMAUG: A Sliding Multidimensional Task Window-Based MARL Framework for Adaptive Real-Time Subtask Recognition
by: Zhang, Wenjing, et al.
Published: (2024)
by: Zhang, Wenjing, et al.
Published: (2024)
Learning Complex Teamwork Tasks Using a Given Sub-task Decomposition
by: Fosong, Elliot, et al.
Published: (2023)
by: Fosong, Elliot, et al.
Published: (2023)
KernelSkill: A Multi-Agent Framework for GPU Kernel Optimization
by: Sun, Qitong, et al.
Published: (2026)
by: Sun, Qitong, et al.
Published: (2026)
OM2P: Offline Multi-Agent Mean-Flow Policy
by: Li, Zhuoran, et al.
Published: (2025)
by: Li, Zhuoran, et al.
Published: (2025)
Similar Items
-
Learning Generalizable Skills from Offline Multi-Task Data for Multi-Agent Cooperation
by: Liu, Sicong, et al.
Published: (2025) -
From Solo to Symphony: Orchestrating Multi-Agent Collaboration with Single-Agent Demos
by: Wang, Xun, et al.
Published: (2025) -
Coordination Failure in Cooperative Offline MARL
by: Tilbury, Callum Rhys, et al.
Published: (2024) -
Learning Partial Action Replacement in Offline MARL
by: Jin, Yue, et al.
Published: (2026) -
Partial Action Replacement: Tackling Distribution Shift in Offline MARL
by: Jin, Yue, et al.
Published: (2025)