Ensemble Value Functions for Efficient Exploration in Multi-Agent Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Schäfer, Lukas, Slumbers, Oliver, McAleer, Stephen, Du, Yali, Albrecht, Stefano V., Mguni, David |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Game-Theoretic Multiagent Reinforcement Learning
par: Yang, Yaodong, et autres
Publié: (2020)
par: Yang, Yaodong, et autres
Publié: (2020)
Stochastic Games with Minimally Bounded Action Costs
par: Mguni, David
Publié: (2024)
par: Mguni, David
Publié: (2024)
Optimistic ε-Greedy Exploration for Cooperative Multi-Agent Reinforcement Learning
par: Zhang, Ruoning, et autres
Publié: (2025)
par: Zhang, Ruoning, et autres
Publié: (2025)
Scalable Mechanism Design for Multi-Agent Path Finding
par: Friedrich, Paul, et autres
Publié: (2024)
par: Friedrich, Paul, et autres
Publié: (2024)
Policy Space Response Oracles: A Survey
par: Bighashdel, Ariyan, et autres
Publié: (2024)
par: Bighashdel, Ariyan, et autres
Publié: (2024)
Fault Tolerant Multi-Agent Learning with Adversarial Budget Constraints
par: Mguni, David, et autres
Publié: (2025)
par: Mguni, David, et autres
Publié: (2025)
Using Large Language Models to Simulate Human Behavioural Experiments: Port of Mars
par: Slumbers, Oliver, et autres
Publié: (2025)
par: Slumbers, Oliver, et autres
Publié: (2025)
Scalable Multi-Agent Reinforcement Learning for Warehouse Logistics with Robotic and Human Co-Workers
par: Krnjaic, Aleksandar, et autres
Publié: (2022)
par: Krnjaic, Aleksandar, et autres
Publié: (2022)
Grasper: A Generalist Pursuer for Pursuit-Evasion Problems
par: Li, Pengdeng, et autres
Publié: (2024)
par: Li, Pengdeng, et autres
Publié: (2024)
On the Geometry of Games and their Solvers
par: Sun, Yaqi, et autres
Publié: (2026)
par: Sun, Yaqi, et autres
Publié: (2026)
TVDO: Tchebycheff Value-Decomposition Optimization for Multi-Agent Reinforcement Learning
par: Hu, Xiaoliang, et autres
Publié: (2023)
par: Hu, Xiaoliang, et autres
Publié: (2023)
Redistributing Rewards Across Time and Agents for Multi-Agent Reinforcement Learning
par: Kapoor, Aditya, et autres
Publié: (2025)
par: Kapoor, Aditya, et autres
Publié: (2025)
Learning Efficient Communication Protocols for Multi-Agent Reinforcement Learning
par: Zhang, Xinren, et autres
Publié: (2025)
par: Zhang, Xinren, et autres
Publié: (2025)
Multi-Agent Reinforcement Learning for Autonomous Driving: A Survey
par: Zhang, Ruiqi, et autres
Publié: (2024)
par: Zhang, Ruiqi, et autres
Publié: (2024)
MACCA: Offline Multi-agent Reinforcement Learning with Causal Credit Assignment
par: Wang, Ziyan, et autres
Publié: (2023)
par: Wang, Ziyan, et autres
Publié: (2023)
Dynamic Graph Communication for Decentralised Multi-Agent Reinforcement Learning
par: McClusky, Ben
Publié: (2024)
par: McClusky, Ben
Publié: (2024)
Scalable Safe Multi-Agent Reinforcement Learning for Multi-Agent System
par: Du, Haikuo, et autres
Publié: (2025)
par: Du, Haikuo, et autres
Publié: (2025)
MACTAS: Self-Attention-Based Inter-Agent Communication in Multi-Agent Reinforcement Learning with Action-Value Function Decomposition
par: Wojtala, Maciej, et autres
Publié: (2025)
par: Wojtala, Maciej, et autres
Publié: (2025)
Continuous-Time Value Iteration for Multi-Agent Reinforcement Learning
par: Wang, Xuefeng, et autres
Publié: (2025)
par: Wang, Xuefeng, et autres
Publié: (2025)
Distributed Multi-Agent Reinforcement Learning Based on Graph-Induced Local Value Functions
par: Jing, Gangshan, et autres
Publié: (2022)
par: Jing, Gangshan, et autres
Publié: (2022)
M3HF: Multi-agent Reinforcement Learning from Multi-phase Human Feedback of Mixed Quality
par: Wang, Ziyan, et autres
Publié: (2025)
par: Wang, Ziyan, et autres
Publié: (2025)
Joint Intrinsic Motivation for Coordinated Exploration in Multi-Agent Deep Reinforcement Learning
par: Toquebiau, Maxime, et autres
Publié: (2024)
par: Toquebiau, Maxime, et autres
Publié: (2024)
Quality-Aware Exploration Budget Allocation for Cooperative Multi-Agent Reinforcement Learning
par: Oh, Dahyun, et autres
Publié: (2026)
par: Oh, Dahyun, et autres
Publié: (2026)
How Exploration Breaks Cooperation in Shared-Policy Multi-Agent Reinforcement Learning
par: Weng, Yi-Ning, et autres
Publié: (2026)
par: Weng, Yi-Ning, et autres
Publié: (2026)
Towards Better Sample Efficiency in Multi-Agent Reinforcement Learning via Exploration
par: Baghi, Amir, et autres
Publié: (2025)
par: Baghi, Amir, et autres
Publié: (2025)
Safe Multi-agent Reinforcement Learning with Natural Language Constraints
par: Wang, Ziyan, et autres
Publié: (2024)
par: Wang, Ziyan, et autres
Publié: (2024)
Towards Ethical Multi-Agent Systems of Large Language Models: A Mechanistic Interpretability Perspective
par: Lee, Jae Hee, et autres
Publié: (2025)
par: Lee, Jae Hee, et autres
Publié: (2025)
ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning
par: Zhang, Wenjing, et autres
Publié: (2025)
par: Zhang, Wenjing, et autres
Publié: (2025)
VIL2C: Value-of-Information Aware Low-Latency Communication for Multi-Agent Reinforcement Learning
par: Zhang, Qian, et autres
Publié: (2025)
par: Zhang, Qian, et autres
Publié: (2025)
TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
par: Lou, Xingzhou, et autres
Publié: (2023)
par: Lou, Xingzhou, et autres
Publié: (2023)
Making Teams and Influencing Agents: Efficiently Coordinating Decision Trees for Interpretable Multi-Agent Reinforcement Learning
par: Chen, Rex, et autres
Publié: (2025)
par: Chen, Rex, et autres
Publié: (2025)
Latent Space Reinforcement Learning for Multi-Robot Exploration
par: Rajasekar, Sriram, et autres
Publié: (2026)
par: Rajasekar, Sriram, et autres
Publié: (2026)
HyperMARL: Adaptive Hypernetworks for Multi-Agent RL
par: Tessera, Kale-ab Abebe, et autres
Publié: (2024)
par: Tessera, Kale-ab Abebe, et autres
Publié: (2024)
Evaluating Collective Behaviour of Hundreds of LLM Agents
par: Willis, Richard, et autres
Publié: (2026)
par: Willis, Richard, et autres
Publié: (2026)
Agent-Temporal Credit Assignment for Optimal Policy Preservation in Sparse Multi-Agent Reinforcement Learning
par: Kapoor, Aditya, et autres
Publié: (2024)
par: Kapoor, Aditya, et autres
Publié: (2024)
Community-based Multi-Agent Reinforcement Learning with Transfer and Active Exploration
par: Shi, Zhaoyang
Publié: (2025)
par: Shi, Zhaoyang
Publié: (2025)
Distributionally Robust Cooperative Multi-Agent Reinforcement Learning via Robust Value Factorization
par: Qu, Chengrui, et autres
Publié: (2026)
par: Qu, Chengrui, et autres
Publié: (2026)
MARVEL: Multi-Agent Reinforcement Learning for constrained field-of-View multi-robot Exploration in Large-scale environments
par: Chiun, Jimmy, et autres
Publié: (2025)
par: Chiun, Jimmy, et autres
Publié: (2025)
Downside Risk-Aware Equilibria for Strategic Decision-Making
par: Slumbers, Oliver, et autres
Publié: (2025)
par: Slumbers, Oliver, et autres
Publié: (2025)
An Agent-Centric Dynamical Systems Perspective on Multi-Agent Reinforcement Learning
par: Rudd-Jones, James, et autres
Publié: (2025)
par: Rudd-Jones, James, et autres
Publié: (2025)
Documents similaires
-
Game-Theoretic Multiagent Reinforcement Learning
par: Yang, Yaodong, et autres
Publié: (2020) -
Stochastic Games with Minimally Bounded Action Costs
par: Mguni, David
Publié: (2024) -
Optimistic ε-Greedy Exploration for Cooperative Multi-Agent Reinforcement Learning
par: Zhang, Ruoning, et autres
Publié: (2025) -
Scalable Mechanism Design for Multi-Agent Path Finding
par: Friedrich, Paul, et autres
Publié: (2024) -
Policy Space Response Oracles: A Survey
par: Bighashdel, Ariyan, et autres
Publié: (2024)