Multi-agent cooperation through in-context co-player inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Weis, Marissa A., Wołczyk, Maciej, Nasser, Rajai, Saurous, Rif A., Arcas, Blaise Agüera y, Sacramento, João, Meulemans, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Embedded Universal Predictive Intelligence: a coherent framework for multi-agent learning
par: Meulemans, Alexander, et autres
Publié: (2025)
par: Meulemans, Alexander, et autres
Publié: (2025)
Multi-agent cooperation through learning-aware policy gradients
par: Meulemans, Alexander, et autres
Publié: (2024)
par: Meulemans, Alexander, et autres
Publié: (2024)
Emergent temporal abstractions in autoregressive models enable hierarchical reinforcement learning
par: Kobayashi, Seijin, et autres
Publié: (2025)
par: Kobayashi, Seijin, et autres
Publié: (2025)
The unreasonable effectiveness of pattern matching
par: Lupyan, Gary, et autres
Publié: (2026)
par: Lupyan, Gary, et autres
Publié: (2026)
MesaNet: Sequence Modeling by Locally Optimal Test-Time Training
par: von Oswald, Johannes, et autres
Publié: (2025)
par: von Oswald, Johannes, et autres
Publié: (2025)
Agentic AI and the next intelligence explosion
par: Evans, James, et autres
Publié: (2026)
par: Evans, James, et autres
Publié: (2026)
All Random Features Representations are Equivalent
par: Sernau, Luke, et autres
Publié: (2024)
par: Sernau, Luke, et autres
Publié: (2024)
What Lives? A meta-analysis of diverse opinions on the definition of life
par: Bender, Reed, et autres
Publié: (2025)
par: Bender, Reed, et autres
Publié: (2025)
State Soup: In-Context Skill Learning, Retrieval and Mixing
par: Pióro, Maciej, et autres
Publié: (2024)
par: Pióro, Maciej, et autres
Publié: (2024)
Uncovering mesa-optimization algorithms in Transformers
par: von Oswald, Johannes, et autres
Publié: (2023)
par: von Oswald, Johannes, et autres
Publié: (2023)
Reasoning Models Generate Societies of Thought
par: Kim, Junsol, et autres
Publié: (2026)
par: Kim, Junsol, et autres
Publié: (2026)
Can LLMs get help from other LLMs without revealing private information?
par: Hartmann, Florian, et autres
Publié: (2024)
par: Hartmann, Florian, et autres
Publié: (2024)
Social Learning: Towards Collaborative Learning with Large Language Models
par: Mohtashami, Amirkeivan, et autres
Publié: (2023)
par: Mohtashami, Amirkeivan, et autres
Publié: (2023)
Computational Life: How Well-formed, Self-replicating Programs Emerge from Simple Interaction
par: Arcas, Blaise Agüera y, et autres
Publié: (2024)
par: Arcas, Blaise Agüera y, et autres
Publié: (2024)
Scalable Spatiotemporal Prediction with Bayesian Neural Fields
par: Saad, Feras, et autres
Publié: (2024)
par: Saad, Feras, et autres
Publié: (2024)
Robust Inverse Graphics via Probabilistic Inference
par: Le, Tuan Anh, et autres
Publié: (2024)
par: Le, Tuan Anh, et autres
Publié: (2024)
Multi-View Stochastic Block Models
par: Cohen-Addad, Vincent, et autres
Publié: (2024)
par: Cohen-Addad, Vincent, et autres
Publié: (2024)
Discovering modular solutions that generalize compositionally
par: Schug, Simon, et autres
Publié: (2023)
par: Schug, Simon, et autres
Publié: (2023)
When Chain of Thought is Necessary, Language Models Struggle to Evade Monitors
par: Emmons, Scott, et autres
Publié: (2025)
par: Emmons, Scott, et autres
Publié: (2025)
Towards a future space-based, highly scalable AI infrastructure system design
par: Arcas, Blaise Agüera y, et autres
Publié: (2025)
par: Arcas, Blaise Agüera y, et autres
Publié: (2025)
Seeing Through Their Eyes: Evaluating Visual Perspective Taking in Vision Language Models
par: Góral, Gracjan, et autres
Publié: (2024)
par: Góral, Gracjan, et autres
Publié: (2024)
Can LLMs make trade-offs involving stipulated pain and pleasure states?
par: Keeling, Geoff, et autres
Publié: (2024)
par: Keeling, Geoff, et autres
Publié: (2024)
The challenges of education in contexts of increasing migratory diversity: (mis)adjustments, adaptative practices and creativity in Portuguese schools
par: Octávio Sacramento
Publié: (2023)
par: Octávio Sacramento
Publié: (2023)
MNIST-Nd: a set of naturalistic datasets to benchmark clustering across dimensions
par: Turishcheva, Polina, et autres
Publié: (2024)
par: Turishcheva, Polina, et autres
Publié: (2024)
Interactive inference: a multi-agent model of cooperative joint actions
par: Maisto, Domenico, et autres
Publié: (2022)
par: Maisto, Domenico, et autres
Publié: (2022)
Formal Conjectures: An Open and Evolving Benchmark for Verified Discovery in Mathematics
par: Firsching, Moritz, et autres
Publié: (2026)
par: Firsching, Moritz, et autres
Publié: (2026)
LLMs achieve adult human performance on higher-order theory of mind tasks
par: Street, Winnie, et autres
Publié: (2024)
par: Street, Winnie, et autres
Publié: (2024)
Pushing Frontiers for Proteoglycans
par: Marissa L. Maciej‐Hulme
Publié: (2026)
par: Marissa L. Maciej‐Hulme
Publié: (2026)
Hierarchical clustering with maximum density paths and mixture models
par: Ritzert, Martin, et autres
Publié: (2025)
par: Ritzert, Martin, et autres
Publié: (2025)
FlySearch: Exploring how vision-language models explore
par: Pardyl, Adam, et autres
Publié: (2025)
par: Pardyl, Adam, et autres
Publié: (2025)
Beyond Recognition: Evaluating Visual Perspective Taking in Vision Language Models
par: Góral, Gracjan, et autres
Publié: (2025)
par: Góral, Gracjan, et autres
Publié: (2025)
AdaGlimpse: Active Visual Exploration with Arbitrary Glimpse Position and Scale
par: Pardyl, Adam, et autres
Publié: (2024)
par: Pardyl, Adam, et autres
Publié: (2024)
Sustainable cooperation on the hybrid pollution-control game with heterogeneous players
par: Wu, Yilun, et autres
Publié: (2025)
par: Wu, Yilun, et autres
Publié: (2025)
Charge‐Mediated Interactions Affect Enzymatic Reactions in Peptide Condensates
par: Rif Harris, et autres
Publié: (2024)
par: Rif Harris, et autres
Publié: (2024)
Can LLM-Augmented autonomous agents cooperate?, An evaluation of their cooperative capabilities through Melting Pot
par: Mosquera, Manuel, et autres
Publié: (2024)
par: Mosquera, Manuel, et autres
Publié: (2024)
Els Massaguer de Torroella: precursors de la fotografia a Girona
par: Dolors Agüera
Publié: (2025)
par: Dolors Agüera
Publié: (2025)
Comparación de rasgos de personalidad entre pacientes con trastorno de la conducta alimentaria y sus hermanas sanas
par: Zaida Agüera
Publié: (2011)
par: Zaida Agüera
Publié: (2011)
A logic of co-valuations
par: Malicki, Maciej
Publié: (2025)
par: Malicki, Maciej
Publié: (2025)
NMDA antagonists use in bipolar depression: A case report
par: Kirolos Ibrahim, et autres
Publié: (2024)
par: Kirolos Ibrahim, et autres
Publié: (2024)
Multi-agent Optimization of Non-cooperative Multimodal Mobility Systems
par: Rafi, Md Nafees Fuad, et autres
Publié: (2026)
par: Rafi, Md Nafees Fuad, et autres
Publié: (2026)
Documents similaires
-
Embedded Universal Predictive Intelligence: a coherent framework for multi-agent learning
par: Meulemans, Alexander, et autres
Publié: (2025) -
Multi-agent cooperation through learning-aware policy gradients
par: Meulemans, Alexander, et autres
Publié: (2024) -
Emergent temporal abstractions in autoregressive models enable hierarchical reinforcement learning
par: Kobayashi, Seijin, et autres
Publié: (2025) -
The unreasonable effectiveness of pattern matching
par: Lupyan, Gary, et autres
Publié: (2026) -
MesaNet: Sequence Modeling by Locally Optimal Test-Time Training
par: von Oswald, Johannes, et autres
Publié: (2025)