Breakthrough the Suboptimal Stable Point in Value-Factorization-Based Multi-Agent Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tao, Lesong, Wang, Yifei, Jing, Haodong, Fu, Jingwen, Kang, Miao, Chen, Shitao, Zheng, Nanning |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Complementing Onboard Sensors with Satellite Map: A New Perspective for HD Map Construction
par: Gao, Wenjie, et autres
Publié: (2023)
par: Gao, Wenjie, et autres
Publié: (2023)
Leveraging Anchor-based LiDAR 3D Object Detection via Point Assisted Sample Selection
par: Chen, Shitao, et autres
Publié: (2024)
par: Chen, Shitao, et autres
Publié: (2024)
UniHOI: Unified Human-Object Interaction Understanding via Unified Token Space
par: Yang, Panqi, et autres
Publié: (2025)
par: Yang, Panqi, et autres
Publié: (2025)
Retaining Suboptimal Actions to Follow Shifting Optima in Multi-Agent Reinforcement Learning
par: Jo, Yonghyeon, et autres
Publié: (2026)
par: Jo, Yonghyeon, et autres
Publié: (2026)
On Stateful Value Factorization in Multi-Agent Reinforcement Learning
par: Marchesini, Enrico, et autres
Publié: (2024)
par: Marchesini, Enrico, et autres
Publié: (2024)
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
par: Yang, Guang, et autres
Publié: (2025)
par: Yang, Guang, et autres
Publié: (2025)
RiskQ: Risk-sensitive Multi-Agent Reinforcement Learning Value Factorization
par: Shen, Siqi, et autres
Publié: (2023)
par: Shen, Siqi, et autres
Publié: (2023)
StructVPR++: Distill Structural and Semantic Knowledge with Weighting Samples for Visual Place Recognition
par: Shen, Yanqing, et autres
Publié: (2025)
par: Shen, Yanqing, et autres
Publié: (2025)
Suboptimal Shapley Value Explanations
par: Lu, Xiaolei
Publié: (2025)
par: Lu, Xiaolei
Publié: (2025)
Shaping Schema via Language Representation as the Next Frontier for LLM Intelligence Expanding
par: Yang, Zhiqin, et autres
Publié: (2026)
par: Yang, Zhiqin, et autres
Publié: (2026)
Distributed Multi-Agent Reinforcement Learning Based on Graph-Induced Local Value Functions
par: Jing, Gangshan, et autres
Publié: (2022)
par: Jing, Gangshan, et autres
Publié: (2022)
PlaneHEC: Efficient Hand-Eye Calibration for Multi-view Robotic Arm via Any Point Cloud Plane Detection
par: Wang, Ye, et autres
Publié: (2025)
par: Wang, Ye, et autres
Publié: (2025)
Distributionally Robust Cooperative Multi-Agent Reinforcement Learning via Robust Value Factorization
par: Qu, Chengrui, et autres
Publié: (2026)
par: Qu, Chengrui, et autres
Publié: (2026)
Dr. MAS: Stable Reinforcement Learning for Multi-Agent LLM Systems
par: Feng, Lang, et autres
Publié: (2026)
par: Feng, Lang, et autres
Publié: (2026)
InfoFlow: Reinforcing Search Agent Via Reward Density Optimization
par: Luo, Kun, et autres
Publié: (2025)
par: Luo, Kun, et autres
Publié: (2025)
EVA: Mixture-of-Experts Semantic Variant Alignment for Compositional Zero-Shot Learning
par: Zhang, Xiao, et autres
Publié: (2025)
par: Zhang, Xiao, et autres
Publié: (2025)
POWQMIX: Weighted Value Factorization with Potentially Optimal Joint Actions Recognition for Cooperative Multi-Agent Reinforcement Learning
par: Huang, Chang, et autres
Publié: (2024)
par: Huang, Chang, et autres
Publié: (2024)
New Mechanisms in Flex Distribution for Bounded Suboptimal Multi-Agent Path Finding
par: Chan, Shao-Hung, et autres
Publié: (2025)
par: Chan, Shao-Hung, et autres
Publié: (2025)
Quantum-Train-Based Distributed Multi-Agent Reinforcement Learning
par: Chen, Kuan-Cheng, et autres
Publié: (2024)
par: Chen, Kuan-Cheng, et autres
Publié: (2024)
Unreal-MAP: Unreal-Engine-Based General Platform for Multi-Agent Reinforcement Learning
par: Hu, Tianyi, et autres
Publié: (2025)
par: Hu, Tianyi, et autres
Publié: (2025)
Generalizing Beyond Suboptimality: Offline Reinforcement Learning Learns Effective Scheduling through Random Data
par: van Remmerden, Jesse, et autres
Publié: (2025)
par: van Remmerden, Jesse, et autres
Publié: (2025)
GAP: Graph-Based Agent Planning with Parallel Tool Use and Reinforcement Learning
par: Wu, Jiaqi, et autres
Publié: (2025)
par: Wu, Jiaqi, et autres
Publié: (2025)
DRAFT-RL: Multi-Agent Chain-of-Draft Reasoning for Reinforcement Learning-Enhanced LLMs
par: Li, Yuanhao, et autres
Publié: (2025)
par: Li, Yuanhao, et autres
Publié: (2025)
An Overlay Multicast Routing Method Based on Network Situational Awareness and Hierarchical Multi-Agent Reinforcement Learning
par: Ye, Miao, et autres
Publié: (2026)
par: Ye, Miao, et autres
Publié: (2026)
Adaptive Robust Estimator for Multi-Agent Reinforcement Learning
par: Li, Zhongyi, et autres
Publié: (2026)
par: Li, Zhongyi, et autres
Publié: (2026)
Breaking through the learning plateaus of in-context learning in Transformer
par: Fu, Jingwen, et autres
Publié: (2023)
par: Fu, Jingwen, et autres
Publié: (2023)
Concept Learning for Cooperative Multi-Agent Reinforcement Learning
par: Ge, Zhonghan, et autres
Publié: (2025)
par: Ge, Zhonghan, et autres
Publié: (2025)
MCGM: Multi-stage Clustered Global Modeling for Long-range Interactions in Molecules
par: Pan, Haodong, et autres
Publié: (2025)
par: Pan, Haodong, et autres
Publié: (2025)
A General Theory for Compositional Generalization
par: Fu, Jingwen, et autres
Publié: (2024)
par: Fu, Jingwen, et autres
Publié: (2024)
See Through Their Minds: Learning Transferable Neural Representation from Cross-Subject fMRI
par: Liu, Yulong, et autres
Publié: (2024)
par: Liu, Yulong, et autres
Publié: (2024)
Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration
par: Zhong, Hai, et autres
Publié: (2024)
par: Zhong, Hai, et autres
Publié: (2024)
Transformers Provably Implement In-Context Reinforcement Learning with Policy Improvement
par: Liang, Haodong, et autres
Publié: (2026)
par: Liang, Haodong, et autres
Publié: (2026)
Heterogeneity in Multi-Agent Reinforcement Learning
par: Hu, Tianyi, et autres
Publié: (2025)
par: Hu, Tianyi, et autres
Publié: (2025)
$Agent^2$: An Agent-Generates-Agent Framework for Reinforcement Learning Automation
par: Wei, Yuan, et autres
Publié: (2025)
par: Wei, Yuan, et autres
Publié: (2025)
Hierarchical Memory Orchestration for Personalized Persistent Agents
par: Liu, Junming, et autres
Publié: (2026)
par: Liu, Junming, et autres
Publié: (2026)
Reaching Consensus in Cooperative Multi-Agent Reinforcement Learning with Goal Imagination
par: Wang, Liangzhou, et autres
Publié: (2024)
par: Wang, Liangzhou, et autres
Publié: (2024)
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines
par: Zheng, Xuejing, et autres
Publié: (2024)
par: Zheng, Xuejing, et autres
Publié: (2024)
Self-Clustering Hierarchical Multi-Agent Reinforcement Learning with Extensible Cooperation Graph
par: Fu, Qingxu, et autres
Publié: (2024)
par: Fu, Qingxu, et autres
Publié: (2024)
Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning
par: Lee, Sunwoo, et autres
Publié: (2026)
par: Lee, Sunwoo, et autres
Publié: (2026)
Robust Noisy Label Learning via Two-Stream Sample Distillation
par: Bai, Sihan, et autres
Publié: (2024)
par: Bai, Sihan, et autres
Publié: (2024)
Documents similaires
-
Complementing Onboard Sensors with Satellite Map: A New Perspective for HD Map Construction
par: Gao, Wenjie, et autres
Publié: (2023) -
Leveraging Anchor-based LiDAR 3D Object Detection via Point Assisted Sample Selection
par: Chen, Shitao, et autres
Publié: (2024) -
UniHOI: Unified Human-Object Interaction Understanding via Unified Token Space
par: Yang, Panqi, et autres
Publié: (2025) -
Retaining Suboptimal Actions to Follow Shifting Optima in Multi-Agent Reinforcement Learning
par: Jo, Yonghyeon, et autres
Publié: (2026) -
On Stateful Value Factorization in Multi-Agent Reinforcement Learning
par: Marchesini, Enrico, et autres
Publié: (2024)