An Efficient Open World Environment for Multi-Agent Social Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ye, Eric, Tao, Ren, Jaques, Natasha |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi Agent Reinforcement Learning for Sequential Satellite Assignment Problems
par: Holder, Joshua, et autres
Publié: (2024)
par: Holder, Joshua, et autres
Publié: (2024)
Multi-Agent Reinforcement Learning for Sample-Efficient Deep Neural Network Mapping
par: Krishnan, Srivatsan, et autres
Publié: (2025)
par: Krishnan, Srivatsan, et autres
Publié: (2025)
Generative Modeling for Robust Deep Reinforcement Learning on the Traveling Salesman Problem
par: Li, Michael, et autres
Publié: (2025)
par: Li, Michael, et autres
Publié: (2025)
Learning to Cooperate with Humans using Generative Agents
par: Liang, Yancheng, et autres
Publié: (2024)
par: Liang, Yancheng, et autres
Publié: (2024)
Modeling Others' Minds as Code
par: Jha, Kunal, et autres
Publié: (2025)
par: Jha, Kunal, et autres
Publié: (2025)
Maximizing Mutual Information Between Prompt and Response Improves LLM Performance With No Additional Data
par: Nam, Hyunji, et autres
Publié: (2026)
par: Nam, Hyunji, et autres
Publié: (2026)
Self-Initiated Open World Learning for Autonomous AI Agents
par: Liu, Bing, et autres
Publié: (2021)
par: Liu, Bing, et autres
Publié: (2021)
Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning
par: Poddar, Sriyash, et autres
Publié: (2024)
par: Poddar, Sriyash, et autres
Publié: (2024)
Impossibility Theorems for Feature Attribution
par: Bilodeau, Blair, et autres
Publié: (2022)
par: Bilodeau, Blair, et autres
Publié: (2022)
Learning to summarize user information for personalized reinforcement learning from human feedback
par: Nam, Hyunji, et autres
Publié: (2025)
par: Nam, Hyunji, et autres
Publié: (2025)
Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning
par: Deihim, Azad, et autres
Publié: (2025)
par: Deihim, Azad, et autres
Publié: (2025)
Robust Agents in Open-Ended Worlds
par: Samvelyan, Mikayel
Publié: (2025)
par: Samvelyan, Mikayel
Publié: (2025)
SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
par: Liu, Bo, et autres
Publié: (2025)
par: Liu, Bo, et autres
Publié: (2025)
Evaluating & Reducing Deceptive Dialogue From Language Models with Multi-turn RL
par: Abdulhai, Marwa, et autres
Publié: (2025)
par: Abdulhai, Marwa, et autres
Publié: (2025)
Novelty-Guided Data Reuse for Efficient and Diversified Multi-Agent Reinforcement Learning
par: Chen, Yangkun, et autres
Publié: (2024)
par: Chen, Yangkun, et autres
Publié: (2024)
Cross-environment Cooperation Enables Zero-shot Multi-agent Coordination
par: Jha, Kunal, et autres
Publié: (2025)
par: Jha, Kunal, et autres
Publié: (2025)
Sample-Efficient Robust Multi-Agent Reinforcement Learning in the Face of Environmental Uncertainty
par: Shi, Laixi, et autres
Publié: (2024)
par: Shi, Laixi, et autres
Publié: (2024)
Mini Honor of Kings: A Lightweight Environment for Multi-Agent Reinforcement Learning
par: Liu, Lin, et autres
Publié: (2024)
par: Liu, Lin, et autres
Publié: (2024)
RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive Verifiable Environments
par: Zeng, Zhiyuan, et autres
Publié: (2025)
par: Zeng, Zhiyuan, et autres
Publié: (2025)
Leveraging Genetic Algorithms for Efficient Demonstration Generation in Real-World Reinforcement Learning Environments
par: Maus, Tom, et autres
Publié: (2025)
par: Maus, Tom, et autres
Publié: (2025)
APT: Architectural Planning and Text-to-Blueprint Construction Using Large Language Models for Open-World Agents
par: Chen, Jun Yu, et autres
Publié: (2024)
par: Chen, Jun Yu, et autres
Publié: (2024)
Infer Human's Intentions Before Following Natural Language Instructions
par: Wan, Yanming, et autres
Publié: (2024)
par: Wan, Yanming, et autres
Publié: (2024)
Multi-Agent Craftax: Benchmarking Open-Ended Multi-Agent Reinforcement Learning at the Hyperscale
par: Omari, Bassel Al, et autres
Publié: (2025)
par: Omari, Bassel Al, et autres
Publié: (2025)
FutureWorld: A Live Reinforcement Learning Environment for Predictive Agents with Real-World Outcome Rewards
par: Han, Zhixin, et autres
Publié: (2026)
par: Han, Zhixin, et autres
Publié: (2026)
MABL: Bi-Level Latent-Variable World Model for Sample-Efficient Multi-Agent Reinforcement Learning
par: Venugopal, Aravind, et autres
Publié: (2023)
par: Venugopal, Aravind, et autres
Publié: (2023)
InvestESG: A multi-agent reinforcement learning benchmark for studying climate investment as a social dilemma
par: Hou, Xiaoxuan, et autres
Publié: (2024)
par: Hou, Xiaoxuan, et autres
Publié: (2024)
Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning
par: Wang, Zhaoyang, et autres
Publié: (2026)
par: Wang, Zhaoyang, et autres
Publié: (2026)
Foundation World Models for Agents that Learn, Verify, and Adapt Reliably Beyond Static Environments
par: Delgrange, Florent
Publié: (2026)
par: Delgrange, Florent
Publié: (2026)
Learning Emergence of Interaction Patterns across Independent RL Agents in Multi-Agent Environments
par: Baddam, Vasanth Reddy, et autres
Publié: (2024)
par: Baddam, Vasanth Reddy, et autres
Publié: (2024)
MIR: Efficient Exploration in Episodic Multi-Agent Reinforcement Learning via Mutual Intrinsic Reward
par: Chen, Kesheng, et autres
Publié: (2025)
par: Chen, Kesheng, et autres
Publié: (2025)
Towards Robust Multimodal Learning in the Open World
par: Huo, Fushuo
Publié: (2025)
par: Huo, Fushuo
Publié: (2025)
Mars: Situated Inductive Reasoning in an Open-World Environment
par: Tang, Xiaojuan, et autres
Publié: (2024)
par: Tang, Xiaojuan, et autres
Publié: (2024)
Graph Condensation for Open-World Graph Learning
par: Gao, Xinyi, et autres
Publié: (2024)
par: Gao, Xinyi, et autres
Publié: (2024)
Chasing Moving Targets with Online Self-Play Reinforcement Learning for Safer Language Models
par: Liu, Mickel, et autres
Publié: (2025)
par: Liu, Mickel, et autres
Publié: (2025)
Learning Multi-Agent Communication from Graph Modeling Perspective
par: Hu, Shengchao, et autres
Publié: (2024)
par: Hu, Shengchao, et autres
Publié: (2024)
Learning Equilibria from Data: Provably Efficient Multi-Agent Imitation Learning
par: Freihaut, Till, et autres
Publié: (2025)
par: Freihaut, Till, et autres
Publié: (2025)
AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents
par: Rawles, Christopher, et autres
Publié: (2024)
par: Rawles, Christopher, et autres
Publié: (2024)
Bridging the Gap: Learning Pace Synchronization for Open-World Semi-Supervised Learning
par: Ye, Bo, et autres
Publié: (2023)
par: Ye, Bo, et autres
Publié: (2023)
RADE: Learning Risk-Adjustable Driving Environment via Multi-Agent Conditional Diffusion
par: Wang, Jiawei, et autres
Publié: (2025)
par: Wang, Jiawei, et autres
Publié: (2025)
Multi-Agent Reinforcement Learning-Based UAV Pathfinding for Obstacle Avoidance in Stochastic Environment
par: Wu, Qizhen, et autres
Publié: (2023)
par: Wu, Qizhen, et autres
Publié: (2023)
Documents similaires
-
Multi Agent Reinforcement Learning for Sequential Satellite Assignment Problems
par: Holder, Joshua, et autres
Publié: (2024) -
Multi-Agent Reinforcement Learning for Sample-Efficient Deep Neural Network Mapping
par: Krishnan, Srivatsan, et autres
Publié: (2025) -
Generative Modeling for Robust Deep Reinforcement Learning on the Traveling Salesman Problem
par: Li, Michael, et autres
Publié: (2025) -
Learning to Cooperate with Humans using Generative Agents
par: Liang, Yancheng, et autres
Publié: (2024) -
Modeling Others' Minds as Code
par: Jha, Kunal, et autres
Publié: (2025)