Learning Multi-Agent Communication with Contrastive Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lo, Yat Long, Sengupta, Biswa, Foerster, Jakob, Noukhovitch, Michael |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Representation Without Reward: A JEPA Audit for LLM Fine-Tuning
par: Sengupta, Biswa
Publié: (2026)
par: Sengupta, Biswa
Publié: (2026)
HARBOR: Automated Harness Optimization
par: Sengupta, Biswa, et autres
Publié: (2026)
par: Sengupta, Biswa, et autres
Publié: (2026)
JPmHC Dynamical Isometry via Orthogonal Hyper-Connections
par: Sengupta, Biswa, et autres
Publié: (2026)
par: Sengupta, Biswa, et autres
Publié: (2026)
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem
par: Barde, Paul, et autres
Publié: (2023)
par: Barde, Paul, et autres
Publié: (2023)
Goal-Conditioned Agents that Learn Everything All at Once
par: Matthews, Michael, et autres
Publié: (2026)
par: Matthews, Michael, et autres
Publié: (2026)
Kinetix: Investigating the Training of General Agents through Open-Ended Physics-Based Control Tasks
par: Matthews, Michael, et autres
Publié: (2024)
par: Matthews, Michael, et autres
Publié: (2024)
Gradient Regularization Prevents Reward Hacking in Reinforcement Learning from Human Feedback and Verifiable Rewards
par: Ackermann, Johannes, et autres
Publié: (2026)
par: Ackermann, Johannes, et autres
Publié: (2026)
JaxUED: A simple and useable UED library in Jax
par: Coward, Samuel, et autres
Publié: (2024)
par: Coward, Samuel, et autres
Publié: (2024)
Mirror Learning: A Unifying Framework of Policy Optimisation
par: Kuba, Jakub Grudzien, et autres
Publié: (2022)
par: Kuba, Jakub Grudzien, et autres
Publié: (2022)
The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
par: Sims, Anya, et autres
Publié: (2024)
par: Sims, Anya, et autres
Publié: (2024)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
par: Wibault, Clarisse, et autres
Publié: (2026)
par: Wibault, Clarisse, et autres
Publié: (2026)
How Should We Meta-Learn Reinforcement Learning Algorithms?
par: Goldie, Alexander David, et autres
Publié: (2025)
par: Goldie, Alexander David, et autres
Publié: (2025)
DITTO: Offline Imitation Learning with World Models
par: DeMoss, Branton, et autres
Publié: (2023)
par: DeMoss, Branton, et autres
Publié: (2023)
Can Learned Optimization Make Reinforcement Learning Less Difficult?
par: Goldie, Alexander David, et autres
Publié: (2024)
par: Goldie, Alexander David, et autres
Publié: (2024)
Recurrent Reinforcement Learning with Memoroids
par: Morad, Steven, et autres
Publié: (2024)
par: Morad, Steven, et autres
Publié: (2024)
Meta-Learning Objectives for Preference Optimization
par: Alfano, Carlo, et autres
Publié: (2024)
par: Alfano, Carlo, et autres
Publié: (2024)
SOReL and TOReL: Two Methods for Fully Offline Reinforcement Learning
par: Fellows, Mattie, et autres
Publié: (2025)
par: Fellows, Mattie, et autres
Publié: (2025)
Learning to Reason at the Frontier of Learnability
par: Foster, Thomas, et autres
Publié: (2025)
par: Foster, Thomas, et autres
Publié: (2025)
Compositional Discrete Latent Code for High Fidelity, Productive Diffusion Models
par: Lavoie, Samuel, et autres
Publié: (2025)
par: Lavoie, Samuel, et autres
Publié: (2025)
Rethinking Out-of-Distribution Detection for Reinforcement Learning: Advancing Methods for Evaluation and Detection
par: Nasvytis, Linas, et autres
Publié: (2024)
par: Nasvytis, Linas, et autres
Publié: (2024)
A Clean Slate for Offline Reinforcement Learning
par: Jackson, Matthew Thomas, et autres
Publié: (2025)
par: Jackson, Matthew Thomas, et autres
Publié: (2025)
The Yokai Learning Environment: Tracking Beliefs Over Space and Time
par: Ruhdorfer, Constantin, et autres
Publié: (2025)
par: Ruhdorfer, Constantin, et autres
Publié: (2025)
Discovering Temporally-Aware Reinforcement Learning Algorithms
par: Jackson, Matthew Thomas, et autres
Publié: (2024)
par: Jackson, Matthew Thomas, et autres
Publié: (2024)
From Translation to Superset: Benchmark-Driven Evolution of a Production AI Agent from Rust to Python
par: Wang, Jinhua, et autres
Publié: (2026)
par: Wang, Jinhua, et autres
Publié: (2026)
Dual-Kernel Graph Community Contrastive Learning
par: Chen, Xiang, et autres
Publié: (2025)
par: Chen, Xiang, et autres
Publié: (2025)
Multi-Agent Deep Reinforcement Learning Under Constrained Communications
par: Shaik, Shahil, et autres
Publié: (2026)
par: Shaik, Shahil, et autres
Publié: (2026)
Generative Image as Action Models
par: Shridhar, Mohit, et autres
Publié: (2024)
par: Shridhar, Mohit, et autres
Publié: (2024)
Active Learning for Communication Structure Optimization in LLM-Based Multi-Agent Systems
par: Yang, Huchen, et autres
Publié: (2026)
par: Yang, Huchen, et autres
Publié: (2026)
Why the Agent Made that Decision: Contrastive Explanation Learning for Reinforcement Learning
par: Zuo, Rui, et autres
Publié: (2024)
par: Zuo, Rui, et autres
Publié: (2024)
Learning Representations in Video Game Agents with Supervised Contrastive Imitation Learning
par: Celemin, Carlos, et autres
Publié: (2025)
par: Celemin, Carlos, et autres
Publié: (2025)
Refining Minimax Regret for Unsupervised Environment Design
par: Beukman, Michael, et autres
Publié: (2024)
par: Beukman, Michael, et autres
Publié: (2024)
ProtoECGNet: Case-Based Interpretable Deep Learning for Multi-Label ECG Classification with Contrastive Learning
par: Sethi, Sahil, et autres
Publié: (2025)
par: Sethi, Sahil, et autres
Publié: (2025)
Tensor-Fused Multi-View Graph Contrastive Learning
par: Wu, Yujia, et autres
Publié: (2024)
par: Wu, Yujia, et autres
Publié: (2024)
Positive Unlabeled Contrastive Learning
par: Acharya, Anish, et autres
Publié: (2022)
par: Acharya, Anish, et autres
Publié: (2022)
Symmetry-Breaking Augmentations for Ad Hoc Teamwork
par: Hammond, Ravi, et autres
Publié: (2024)
par: Hammond, Ravi, et autres
Publié: (2024)
Advancing Wildfire Risk Prediction via Morphology-Aware Curriculum Contrastive Learning
par: Scudo, Fabrizio Lo, et autres
Publié: (2025)
par: Scudo, Fabrizio Lo, et autres
Publié: (2025)
Pun Intended: Multi-Agent Translation of Wordplay with Contrastive Learning and Phonetic-Semantic Embeddings
par: Taylor, Russell, et autres
Publié: (2025)
par: Taylor, Russell, et autres
Publié: (2025)
Asynchronous RLHF: Faster and More Efficient Off-Policy RL for Language Models
par: Noukhovitch, Michael, et autres
Publié: (2024)
par: Noukhovitch, Michael, et autres
Publié: (2024)
Behaviour Distillation
par: Lupu, Andrei, et autres
Publié: (2024)
par: Lupu, Andrei, et autres
Publié: (2024)
Learning to Communicate Locally for Large-Scale Multi-Agent Pathfinding
par: Vyaltsev, Valeriy, et autres
Publié: (2026)
par: Vyaltsev, Valeriy, et autres
Publié: (2026)
Documents similaires
-
Representation Without Reward: A JEPA Audit for LLM Fine-Tuning
par: Sengupta, Biswa
Publié: (2026) -
HARBOR: Automated Harness Optimization
par: Sengupta, Biswa, et autres
Publié: (2026) -
JPmHC Dynamical Isometry via Orthogonal Hyper-Connections
par: Sengupta, Biswa, et autres
Publié: (2026) -
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem
par: Barde, Paul, et autres
Publié: (2023) -
Goal-Conditioned Agents that Learn Everything All at Once
par: Matthews, Michael, et autres
Publié: (2026)