QSIM: Mitigating Overestimation in Multi-Agent Reinforcement Learning via Action Similarity Weighted Q-Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Yuanjun, Zhang, Bin, Chen, Hao, Jiang, Zhouyang, Li, Dapeng, Xu, Zhiwei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
QLLM: Do We Really Need a Mixing Network for Credit Assignment in Multi-Agent Reinforcement Learning?
por: Li, Yuanjun, et al.
Publicado: (2025)
por: Li, Yuanjun, et al.
Publicado: (2025)
Beyond Local Views: Global State Inference with Diffusion Models for Cooperative Multi-Agent Reinforcement Learning
por: Xu, Zhiwei, et al.
Publicado: (2024)
por: Xu, Zhiwei, et al.
Publicado: (2024)
Verco: Learning Coordinated Verbal Communication for Multi-agent Reinforcement Learning
por: Li, Dapeng, et al.
Publicado: (2024)
por: Li, Dapeng, et al.
Publicado: (2024)
High-order Interactions Modeling for Interpretable Multi-Agent Q-Learning
por: Xu, Qinyu, et al.
Publicado: (2025)
por: Xu, Qinyu, et al.
Publicado: (2025)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
por: Hu, Kun, et al.
Publicado: (2025)
por: Hu, Kun, et al.
Publicado: (2025)
Heterogeneity in Multi-Agent Reinforcement Learning
por: Hu, Tianyi, et al.
Publicado: (2025)
por: Hu, Tianyi, et al.
Publicado: (2025)
Multi-agent Reinforcement Learning with Deep Networks for Diverse Q-Vectors
por: Luo, Zhenglong, et al.
Publicado: (2024)
por: Luo, Zhenglong, et al.
Publicado: (2024)
RiskQ: Risk-sensitive Multi-Agent Reinforcement Learning Value Factorization
por: Shen, Siqi, et al.
Publicado: (2023)
por: Shen, Siqi, et al.
Publicado: (2023)
Causal Mean Field Multi-Agent Reinforcement Learning
por: Ma, Hao, et al.
Publicado: (2025)
por: Ma, Hao, et al.
Publicado: (2025)
Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning
por: Li, Simin, et al.
Publicado: (2025)
por: Li, Simin, et al.
Publicado: (2025)
Multi-source Plume Tracing via Multi-Agent Reinforcement Learning
por: Granadeno, Pedro Antonio Alarcon, et al.
Publicado: (2025)
por: Granadeno, Pedro Antonio Alarcon, et al.
Publicado: (2025)
The Composite Task Challenge for Cooperative Multi-Agent Reinforcement Learning
por: Li, Yurui, et al.
Publicado: (2025)
por: Li, Yurui, et al.
Publicado: (2025)
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
por: Yang, Guang, et al.
Publicado: (2025)
por: Yang, Guang, et al.
Publicado: (2025)
Scalable Safe Multi-Agent Reinforcement Learning for Multi-Agent System
por: Du, Haikuo, et al.
Publicado: (2025)
por: Du, Haikuo, et al.
Publicado: (2025)
Achieving Equilibrium under Utility Heterogeneity: An Agent-Attention Framework for Multi-Agent Multi-Objective Reinforcement Learning
por: Li, Zhuhui, et al.
Publicado: (2025)
por: Li, Zhuhui, et al.
Publicado: (2025)
Multi-Agent Target Assignment and Path Finding for Intelligent Warehouse: A Cooperative Multi-Agent Deep Reinforcement Learning Perspective
por: Liu, Qi, et al.
Publicado: (2024)
por: Liu, Qi, et al.
Publicado: (2024)
CCL: Collaborative Curriculum Learning for Sparse-Reward Multi-Agent Reinforcement Learning via Co-evolutionary Task Evolution
por: Lin, Yufei, et al.
Publicado: (2025)
por: Lin, Yufei, et al.
Publicado: (2025)
Constructive Conflict-Driven Multi-Agent Reinforcement Learning for Strategic Diversity
por: Mai, Yuxiang, et al.
Publicado: (2025)
por: Mai, Yuxiang, et al.
Publicado: (2025)
Coevolving with the Other You: Fine-Tuning LLM with Sequential Cooperative Multi-Agent Reinforcement Learning
por: Ma, Hao, et al.
Publicado: (2024)
por: Ma, Hao, et al.
Publicado: (2024)
Measuring Policy Distance for Multi-Agent Reinforcement Learning
por: Hu, Tianyi, et al.
Publicado: (2024)
por: Hu, Tianyi, et al.
Publicado: (2024)
Toward Dependency Dynamics in Multi-Agent Reinforcement Learning for Traffic Signal Control
por: Zhang, Yuli, et al.
Publicado: (2025)
por: Zhang, Yuli, et al.
Publicado: (2025)
Distributionally Robust Cooperative Multi-Agent Reinforcement Learning via Robust Value Factorization
por: Qu, Chengrui, et al.
Publicado: (2026)
por: Qu, Chengrui, et al.
Publicado: (2026)
SocialGFs: Learning Social Gradient Fields for Multi-Agent Reinforcement Learning
por: Long, Qian, et al.
Publicado: (2024)
por: Long, Qian, et al.
Publicado: (2024)
Communication Gain and Delay Cost Under Cross-Timestep Delays in Cooperative Multi-Agent Reinforcement Learning
por: Gao, Zihong, et al.
Publicado: (2026)
por: Gao, Zihong, et al.
Publicado: (2026)
Tacit Learning with Adaptive Information Selection for Cooperative Multi-Agent Reinforcement Learning
por: Liu, Lunjun, et al.
Publicado: (2024)
por: Liu, Lunjun, et al.
Publicado: (2024)
Multi-Agent Reinforcement Learning Simulation for Environmental Policy Synthesis
por: Rudd-Jones, James, et al.
Publicado: (2025)
por: Rudd-Jones, James, et al.
Publicado: (2025)
PTDE: Personalized Training with Distilled Execution for Multi-Agent Reinforcement Learning
por: Chen, Yiqun, et al.
Publicado: (2022)
por: Chen, Yiqun, et al.
Publicado: (2022)
Cooperation and Fairness in Multi-Agent Reinforcement Learning
por: Aloor, Jasmine Jerry, et al.
Publicado: (2024)
por: Aloor, Jasmine Jerry, et al.
Publicado: (2024)
OPTAGENT: Optimizing Multi-Agent LLM Interactions Through Verbal Reinforcement Learning for Enhanced Reasoning
por: Bi, Zhenyu, et al.
Publicado: (2025)
por: Bi, Zhenyu, et al.
Publicado: (2025)
Cooperative Informative Sensing for Monitoring Dynamic Indoor Environments via Multi-Agent Reinforcement Learning
por: Lee, Kanghoon, et al.
Publicado: (2026)
por: Lee, Kanghoon, et al.
Publicado: (2026)
Empirical Study on Robustness and Resilience in Cooperative Multi-Agent Reinforcement Learning
por: Li, Simin, et al.
Publicado: (2025)
por: Li, Simin, et al.
Publicado: (2025)
Multicopy Reinforcement Learning Agents
por: Wolfe, Alicia P., et al.
Publicado: (2023)
por: Wolfe, Alicia P., et al.
Publicado: (2023)
MAPF-World: Action World Model for Multi-Agent Path Finding
por: Yang, Zhanjiang, et al.
Publicado: (2025)
por: Yang, Zhanjiang, et al.
Publicado: (2025)
Multi-Agent Reinforcement Learning for Market Making: Competition without Collusion
por: Wang, Ziyi, et al.
Publicado: (2025)
por: Wang, Ziyi, et al.
Publicado: (2025)
SCoUT: Scalable Communication via Utility-Guided Temporal Grouping in Multi-Agent Reinforcement Learning
por: Vora, Manav, et al.
Publicado: (2026)
por: Vora, Manav, et al.
Publicado: (2026)
Multi-Agent Reinforcement Learning for Autonomous Driving: A Survey
por: Zhang, Ruiqi, et al.
Publicado: (2024)
por: Zhang, Ruiqi, et al.
Publicado: (2024)
Trust-Based Social Learning for Communication (TSLEC) Protocol Evolution in Multi-Agent Reinforcement Learning
por: Weinberg, Abraham Itzhak
Publicado: (2025)
por: Weinberg, Abraham Itzhak
Publicado: (2025)
Learning Individual Intrinsic Reward in Multi-Agent Reinforcement Learning via Incorporating Generalized Human Expertise
por: Wu, Xuefei, et al.
Publicado: (2025)
por: Wu, Xuefei, et al.
Publicado: (2025)
Distributed Deep Reinforcement Learning: A Survey and A Multi-Player Multi-Agent Learning Toolbox
por: Yin, Qiyue, et al.
Publicado: (2022)
por: Yin, Qiyue, et al.
Publicado: (2022)
MedSentry: Understanding and Mitigating Safety Risks in Medical LLM Multi-Agent Systems
por: Chen, Kai, et al.
Publicado: (2025)
por: Chen, Kai, et al.
Publicado: (2025)
Ejemplares similares
-
QLLM: Do We Really Need a Mixing Network for Credit Assignment in Multi-Agent Reinforcement Learning?
por: Li, Yuanjun, et al.
Publicado: (2025) -
Beyond Local Views: Global State Inference with Diffusion Models for Cooperative Multi-Agent Reinforcement Learning
por: Xu, Zhiwei, et al.
Publicado: (2024) -
Verco: Learning Coordinated Verbal Communication for Multi-agent Reinforcement Learning
por: Li, Dapeng, et al.
Publicado: (2024) -
High-order Interactions Modeling for Interpretable Multi-Agent Q-Learning
por: Xu, Qinyu, et al.
Publicado: (2025) -
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
por: Hu, Kun, et al.
Publicado: (2025)