JaxMARL: Multi-Agent RL Environments and Algorithms in JAX
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rutherford, Alexander, Ellis, Benjamin, Gallici, Matteo, Cook, Jonathan, Lupu, Andrei, Ingvarsson, Gardar, Willi, Timon, Hammond, Ravi, Khan, Akbir, de Witt, Christian Schroeder, Souly, Alexandra, Bandyopadhyay, Saptarashmi, Samvelyan, Mikayel, Jiang, Minqi, Lange, Robert Tjarko, Whiteson, Shimon, Lacerda, Bruno, Hawes, Nick, Rocktaschel, Tim, Lu, Chris, Foerster, Jakob Nicolaus |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Agent Diagnostics for Robustness via Illuminated Diversity
par: Samvelyan, Mikayel, et autres
Publié: (2024)
par: Samvelyan, Mikayel, et autres
Publié: (2024)
JaxMARL-HFT: GPU-Accelerated Large-Scale Multi-Agent Reinforcement Learning for High-Frequency Trading
par: Mohl, Valentin, et autres
Publié: (2025)
par: Mohl, Valentin, et autres
Publié: (2025)
Robust Agents in Open-Ended Worlds
par: Samvelyan, Mikayel
Publié: (2025)
par: Samvelyan, Mikayel
Publié: (2025)
The Decrypto Benchmark for Multi-Agent Reasoning and Theory of Mind
par: Lupu, Andrei, et autres
Publié: (2025)
par: Lupu, Andrei, et autres
Publié: (2025)
Scaling Opponent Shaping to High Dimensional Games
par: Khan, Akbir, et autres
Publié: (2023)
par: Khan, Akbir, et autres
Publié: (2023)
No Regrets: Investigating and Improving Regret Approximations for Curriculum Discovery
par: Rutherford, Alexander, et autres
Publié: (2024)
par: Rutherford, Alexander, et autres
Publié: (2024)
minimax: Efficient Baselines for Autocurricula in JAX
par: Jiang, Minqi, et autres
Publié: (2023)
par: Jiang, Minqi, et autres
Publié: (2023)
Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts
par: Samvelyan, Mikayel, et autres
Publié: (2024)
par: Samvelyan, Mikayel, et autres
Publié: (2024)
Discovering Temporally-Aware Reinforcement Learning Algorithms
par: Jackson, Matthew Thomas, et autres
Publié: (2024)
par: Jackson, Matthew Thomas, et autres
Publié: (2024)
JaxUED: A simple and useable UED library in Jax
par: Coward, Samuel, et autres
Publié: (2024)
par: Coward, Samuel, et autres
Publié: (2024)
Adam on Local Time: Addressing Nonstationarity in RL with Relative Adam Timesteps
par: Ellis, Benjamin, et autres
Publié: (2024)
par: Ellis, Benjamin, et autres
Publié: (2024)
JaxSGMC: Modular stochastic gradient MCMC in JAX
par: Thaler, Stephan, et autres
Publié: (2025)
par: Thaler, Stephan, et autres
Publié: (2025)
SPARQ: Synthetic Problem Generation for Reasoning via Quality-Diversity Algorithms
par: Havrilla, Alex, et autres
Publié: (2025)
par: Havrilla, Alex, et autres
Publié: (2025)
Craftax: A Lightning-Fast Benchmark for Open-Ended Reinforcement Learning
par: Matthews, Michael, et autres
Publié: (2024)
par: Matthews, Michael, et autres
Publié: (2024)
Behaviour Distillation
par: Lupu, Andrei, et autres
Publié: (2024)
par: Lupu, Andrei, et autres
Publié: (2024)
Equivariant Networks for Zero-Shot Coordination
par: Muglich, Darius, et autres
Publié: (2022)
par: Muglich, Darius, et autres
Publié: (2022)
The Danger Of Arrogance: Welfare Equilibra As A Solution To Stackelberg Self-Play In Non-Coincidental Games
par: Levi, Jake, et autres
Publié: (2024)
par: Levi, Jake, et autres
Publié: (2024)
Programming by Backprop: An Instruction is Worth 100 Examples When Finetuning LLMs
par: Cook, Jonathan, et autres
Publié: (2025)
par: Cook, Jonathan, et autres
Publié: (2025)
Counterfactual Multi-Agent Policy Gradients
par: Foerster, Jakob, et autres
Publié: (2017)
par: Foerster, Jakob, et autres
Publié: (2017)
GoalLadder: Incremental Goal Discovery with Vision-Language Models
par: Zakharov, Alexey, et autres
Publié: (2025)
par: Zakharov, Alexey, et autres
Publié: (2025)
DéjàQ: Open-Ended Evolution of Diverse, Learnable and Verifiable Problems
par: Röpke, Willem, et autres
Publié: (2026)
par: Röpke, Willem, et autres
Publié: (2026)
JaxLife: An Open-Ended Agentic Simulator
par: Lu, Chris, et autres
Publié: (2024)
par: Lu, Chris, et autres
Publié: (2024)
Bayesian Exploration Networks
par: Fellows, Mattie, et autres
Publié: (2023)
par: Fellows, Mattie, et autres
Publié: (2023)
JaxWildfire: A GPU-Accelerated Wildfire Simulator for Reinforcement Learning
par: Çakır, Ufuk, et autres
Publié: (2025)
par: Çakır, Ufuk, et autres
Publié: (2025)
JaxARC: A High-Performance JAX-based Environment for Abstraction and Reasoning Research
par: Aadam, et autres
Publié: (2026)
par: Aadam, et autres
Publié: (2026)
Social Cooperation in Conversational AI Agents
par: Çelikok, Mustafa Mert, et autres
Publié: (2025)
par: Çelikok, Mustafa Mert, et autres
Publié: (2025)
On the Complexity of Learning to Cooperate with Populations of Socially Rational Agents
par: Loftin, Robert, et autres
Publié: (2024)
par: Loftin, Robert, et autres
Publié: (2024)
HyperVLA: Efficient Inference in Vision-Language-Action Models via Hypernetworks
par: Xiong, Zheng, et autres
Publié: (2025)
par: Xiong, Zheng, et autres
Publié: (2025)
How Should We Meta-Learn Reinforcement Learning Algorithms?
par: Goldie, Alexander David, et autres
Publié: (2025)
par: Goldie, Alexander David, et autres
Publié: (2025)
A Clean Slate for Offline Reinforcement Learning
par: Jackson, Matthew Thomas, et autres
Publié: (2025)
par: Jackson, Matthew Thomas, et autres
Publié: (2025)
Bootstrapping Task Spaces for Self-Improvement
par: Jiang, Minqi, et autres
Publié: (2025)
par: Jiang, Minqi, et autres
Publié: (2025)
Can Learned Optimization Make Reinforcement Learning Less Difficult?
par: Goldie, Alexander David, et autres
Publié: (2024)
par: Goldie, Alexander David, et autres
Publié: (2024)
NAVIX: Scaling MiniGrid Environments with JAX
par: Pignatelli, Eduardo, et autres
Publié: (2024)
par: Pignatelli, Eduardo, et autres
Publié: (2024)
Policy-Guided Diffusion
par: Jackson, Matthew Thomas, et autres
Publié: (2024)
par: Jackson, Matthew Thomas, et autres
Publié: (2024)
Analysing the Sample Complexity of Opponent Shaping
par: Fung, Kitty, et autres
Publié: (2024)
par: Fung, Kitty, et autres
Publié: (2024)
Mixture of Experts in a Mixture of RL settings
par: Willi, Timon, et autres
Publié: (2024)
par: Willi, Timon, et autres
Publié: (2024)
EconoJax: A Fast & Scalable Economic Simulation in Jax
par: Ponse, Koen, et autres
Publié: (2024)
par: Ponse, Koen, et autres
Publié: (2024)
IGDrivSim: A Benchmark for the Imitation Gap in Autonomous Driving
par: Grislain, Clémence, et autres
Publié: (2024)
par: Grislain, Clémence, et autres
Publié: (2024)
Rate-Informed Discovery via Bayesian Adaptive Multifidelity Sampling
par: Sinha, Aman, et autres
Publié: (2024)
par: Sinha, Aman, et autres
Publié: (2024)
Learning to Drive in New Cities Without Human Demonstrations
par: Wang, Zilin, et autres
Publié: (2026)
par: Wang, Zilin, et autres
Publié: (2026)
Documents similaires
-
Multi-Agent Diagnostics for Robustness via Illuminated Diversity
par: Samvelyan, Mikayel, et autres
Publié: (2024) -
JaxMARL-HFT: GPU-Accelerated Large-Scale Multi-Agent Reinforcement Learning for High-Frequency Trading
par: Mohl, Valentin, et autres
Publié: (2025) -
Robust Agents in Open-Ended Worlds
par: Samvelyan, Mikayel
Publié: (2025) -
The Decrypto Benchmark for Multi-Agent Reasoning and Theory of Mind
par: Lupu, Andrei, et autres
Publié: (2025) -
Scaling Opponent Shaping to High Dimensional Games
par: Khan, Akbir, et autres
Publié: (2023)