Ad-Hoc Human-AI Coordination Challenge
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dizdarević, Tin, Hammond, Ravi, Gessler, Tobias, Calinescu, Anisoara, Cook, Jonathan, Gallici, Matteo, Lupu, Andrei, Muglich, Darius, Forkel, Johannes, Foerster, Jakob Nicolaus |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Expected Return Symmetries
par: Muglich, Darius, et autres
Publié: (2025)
par: Muglich, Darius, et autres
Publié: (2025)
OvercookedV2: Rethinking Overcooked for Zero-Shot Coordination
par: Gessler, Tobias, et autres
Publié: (2025)
par: Gessler, Tobias, et autres
Publié: (2025)
The Yokai Learning Environment: Tracking Beliefs Over Space and Time
par: Ruhdorfer, Constantin, et autres
Publié: (2025)
par: Ruhdorfer, Constantin, et autres
Publié: (2025)
The Decrypto Benchmark for Multi-Agent Reasoning and Theory of Mind
par: Lupu, Andrei, et autres
Publié: (2025)
par: Lupu, Andrei, et autres
Publié: (2025)
High entropy leads to symmetry equivariant policies in Dec-POMDPs
par: Forkel, Johannes, et autres
Publié: (2025)
par: Forkel, Johannes, et autres
Publié: (2025)
JaxMARL-HFT: GPU-Accelerated Large-Scale Multi-Agent Reinforcement Learning for High-Frequency Trading
par: Mohl, Valentin, et autres
Publié: (2025)
par: Mohl, Valentin, et autres
Publié: (2025)
A multi-objective combinatorial optimisation framework for large scale hierarchical population synthesis
par: Mahmood, Imran, et autres
Publié: (2024)
par: Mahmood, Imran, et autres
Publié: (2024)
JaxMARL: Multi-Agent RL Environments and Algorithms in JAX
par: Rutherford, Alexander, et autres
Publié: (2023)
par: Rutherford, Alexander, et autres
Publié: (2023)
Neural Network-Based Parameter Estimation of a Labour Market Agent-Based Model
par: Alves, M Lopes, et autres
Publié: (2026)
par: Alves, M Lopes, et autres
Publié: (2026)
Bayesian Decision Making around Experts
par: Ornia, Daniel Jarne, et autres
Publié: (2025)
par: Ornia, Daniel Jarne, et autres
Publié: (2025)
Sequence Modeling for N-Agent Ad Hoc Teamwork
par: Wang, Caroline, et autres
Publié: (2025)
par: Wang, Caroline, et autres
Publié: (2025)
Zero-Shot Coordination in Ad Hoc Teams with Generalized Policy Improvement and Difference Rewards
par: Nigam, Rupal, et autres
Publié: (2025)
par: Nigam, Rupal, et autres
Publié: (2025)
IFS: Information Flow Structure for Multi-agent Ad Hoc System
par: Fu, Yanqing, et autres
Publié: (2025)
par: Fu, Yanqing, et autres
Publié: (2025)
ConventionPlay: Capability-Limited Training for Robust Ad-Hoc Collaboration
par: Sriraman, Abhishek, et autres
Publié: (2026)
par: Sriraman, Abhishek, et autres
Publié: (2026)
Symmetry-Breaking Augmentations for Ad Hoc Teamwork
par: Hammond, Ravi, et autres
Publié: (2024)
par: Hammond, Ravi, et autres
Publié: (2024)
Open Ad Hoc Teamwork with Cooperative Game Theory
par: Wang, Jianhong, et autres
Publié: (2024)
par: Wang, Jianhong, et autres
Publié: (2024)
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem
par: Barde, Paul, et autres
Publié: (2023)
par: Barde, Paul, et autres
Publié: (2023)
Optimization of Flying Ad Hoc Network Topology and Collaborative Path Planning for Multiple UAVs
par: He, Ming, et autres
Publié: (2025)
par: He, Ming, et autres
Publié: (2025)
Multi-Agent Craftax: Benchmarking Open-Ended Multi-Agent Reinforcement Learning at the Hyperscale
par: Omari, Bassel Al, et autres
Publié: (2025)
par: Omari, Bassel Al, et autres
Publié: (2025)
On Mobile Ad Hoc Networks for Coverage of Partially Observable Worlds
par: Meriaux, Edwin, et autres
Publié: (2025)
par: Meriaux, Edwin, et autres
Publié: (2025)
Multi-party Agent Relation Sampling for Multi-party Ad Hoc Teamwork
par: Zhang, Beiwen, et autres
Publié: (2025)
par: Zhang, Beiwen, et autres
Publié: (2025)
Generic-to-Specific Reasoning and Learning for Scalable Ad Hoc Teamwork
par: Dodampegama, Hasra, et autres
Publié: (2025)
par: Dodampegama, Hasra, et autres
Publié: (2025)
CONCAT: Consensus- and Confidence-Driven Ad Hoc Teaming for Efficient LLM-Based Multi-Agent Systems
par: Ma, Ziyang, et autres
Publié: (2026)
par: Ma, Ziyang, et autres
Publié: (2026)
LLM-Ehnanced Holonic Architecture for Ad-Hoc Scalable SoS
par: Ashfaq, Muhammad, et autres
Publié: (2025)
par: Ashfaq, Muhammad, et autres
Publié: (2025)
Automatic Differentiation of Agent-Based Models
par: Quera-Bofarull, Arnau, et autres
Publié: (2025)
par: Quera-Bofarull, Arnau, et autres
Publié: (2025)
RecBayes: Recurrent Bayesian Ad Hoc Teamwork in Large Partially Observable Domains
par: Ribeiro, João G., et autres
Publié: (2025)
par: Ribeiro, João G., et autres
Publié: (2025)
Learning Ad Hoc Network Dynamics via Graph-Structured World Models
par: Karacelebi, Can, et autres
Publié: (2026)
par: Karacelebi, Can, et autres
Publié: (2026)
Counterfactual Multi-Agent Policy Gradients
par: Foerster, Jakob, et autres
Publié: (2017)
par: Foerster, Jakob, et autres
Publié: (2017)
Learning to Drive in New Cities Without Human Demonstrations
par: Wang, Zilin, et autres
Publié: (2026)
par: Wang, Zilin, et autres
Publié: (2026)
Equivariant Networks for Zero-Shot Coordination
par: Muglich, Darius, et autres
Publié: (2022)
par: Muglich, Darius, et autres
Publié: (2022)
Shapley Machine: A Game-Theoretic Framework for N-Agent Ad Hoc Teamwork
par: Wang, Jianhong, et autres
Publié: (2025)
par: Wang, Jianhong, et autres
Publié: (2025)
Evolving Many Worlds: Towards Open-Ended Discovery in Petri Dish NCA via Population-Based Training
par: Berdica, Uljad, et autres
Publié: (2026)
par: Berdica, Uljad, et autres
Publié: (2026)
Towards Hypermedia Environments for Adaptive Coordination in Industrial Automation
par: Ramanathan, Ganesh, et autres
Publié: (2024)
par: Ramanathan, Ganesh, et autres
Publié: (2024)
Painting the market: generative diffusion models for financial limit order book simulation and forecasting
par: Backhouse, Alfred, et autres
Publié: (2025)
par: Backhouse, Alfred, et autres
Publié: (2025)
Select to Perfect: Imitating desired behavior from large multi-agent data
par: Franzmeyer, Tim, et autres
Publié: (2024)
par: Franzmeyer, Tim, et autres
Publié: (2024)
Multi-Agent Systems in Emergency Departments: Validation Study on a ED Digital Twin
par: Wenzel, Markus, et autres
Publié: (2026)
par: Wenzel, Markus, et autres
Publié: (2026)
The Danger Of Arrogance: Welfare Equilibra As A Solution To Stackelberg Self-Play In Non-Coincidental Games
par: Levi, Jake, et autres
Publié: (2024)
par: Levi, Jake, et autres
Publié: (2024)
Resilient Charging Infrastructure via Decentralized Coordination of Electric Vehicles at Scale
par: Qin, Chuhao, et autres
Publié: (2025)
par: Qin, Chuhao, et autres
Publié: (2025)
ROTATE: Regret-driven Open-ended Training for Ad Hoc Teamwork
par: Wang, Caroline, et autres
Publié: (2025)
par: Wang, Caroline, et autres
Publié: (2025)
Heterogeneous Mixed Traffic Control and Coordination
par: Islam, Iftekharul, et autres
Publié: (2024)
par: Islam, Iftekharul, et autres
Publié: (2024)
Documents similaires
-
Expected Return Symmetries
par: Muglich, Darius, et autres
Publié: (2025) -
OvercookedV2: Rethinking Overcooked for Zero-Shot Coordination
par: Gessler, Tobias, et autres
Publié: (2025) -
The Yokai Learning Environment: Tracking Beliefs Over Space and Time
par: Ruhdorfer, Constantin, et autres
Publié: (2025) -
The Decrypto Benchmark for Multi-Agent Reasoning and Theory of Mind
par: Lupu, Andrei, et autres
Publié: (2025) -
High entropy leads to symmetry equivariant policies in Dec-POMDPs
par: Forkel, Johannes, et autres
Publié: (2025)