MEAL: A Benchmark for Continual Multi-Agent Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Tomilin, Tristan, Boogaard, Luka van den, Garcin, Samuel, Grooten, Bram, Fang, Meng, Du, Yali, Pechenizkiy, Mykola |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
HASARD: A Benchmark for Vision-Based Safe Reinforcement Learning in Embodied Agents
por: Tomilin, Tristan, et al.
Publicado: (2025)
por: Tomilin, Tristan, et al.
Publicado: (2025)
PillagerBench: Benchmarking LLM-Based Agents in Competitive Minecraft Team Environments
por: Schipper, Olivier, et al.
Publicado: (2025)
por: Schipper, Olivier, et al.
Publicado: (2025)
SocialJax: An Evaluation Suite for Multi-agent Reinforcement Learning in Sequential Social Dilemmas
por: Guo, Zihao, et al.
Publicado: (2025)
por: Guo, Zihao, et al.
Publicado: (2025)
Safe Multi-agent Reinforcement Learning with Natural Language Constraints
por: Wang, Ziyan, et al.
Publicado: (2024)
por: Wang, Ziyan, et al.
Publicado: (2024)
Benchmarking Foundation Models with Retrieval-Augmented Generation in Olympic-Level Physics Problem Solving
por: Zheng, Shunfeng, et al.
Publicado: (2025)
por: Zheng, Shunfeng, et al.
Publicado: (2025)
Are There Exceptions to Goodhart's Law? On the Moral Justification of Fairness-Aware Machine Learning
por: Weerts, Hilde, et al.
Publicado: (2022)
por: Weerts, Hilde, et al.
Publicado: (2022)
One Model for All: Multi-Objective Controllable Language Models
por: He, Qiang, et al.
Publicado: (2026)
por: He, Qiang, et al.
Publicado: (2026)
Task Adaptation from Skills: Information Geometry, Disentanglement, and New Objectives for Unsupervised Reinforcement Learning
por: Yang, Yucheng, et al.
Publicado: (2025)
por: Yang, Yucheng, et al.
Publicado: (2025)
NeuroTrails: Training with Dynamic Sparse Heads as the Key to Effective Ensembling
por: Grooten, Bram, et al.
Publicado: (2025)
por: Grooten, Bram, et al.
Publicado: (2025)
One-Shot Federated Learning with Bayesian Pseudocoresets
por: d'Hondt, Tim, et al.
Publicado: (2024)
por: d'Hondt, Tim, et al.
Publicado: (2024)
Nerva: a Truly Sparse Implementation of Neural Networks
por: Wesselink, Wieger, et al.
Publicado: (2024)
por: Wesselink, Wieger, et al.
Publicado: (2024)
Beyond Discriminant Patterns: On the Robustness of Decision Rule Ensembles
por: Du, Xin, et al.
Publicado: (2021)
por: Du, Xin, et al.
Publicado: (2021)
Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?
por: Zhang, Yudi, et al.
Publicado: (2025)
por: Zhang, Yudi, et al.
Publicado: (2025)
M3HF: Multi-agent Reinforcement Learning from Multi-phase Human Feedback of Mixed Quality
por: Wang, Ziyan, et al.
Publicado: (2025)
por: Wang, Ziyan, et al.
Publicado: (2025)
On Adversarial Robustness of Language Models in Transfer Learning
por: Turbal, Bohdan, et al.
Publicado: (2024)
por: Turbal, Bohdan, et al.
Publicado: (2024)
Boosting Robustness in Preference-Based Reinforcement Learning with Dynamic Sparsity
por: Muslimani, Calarina, et al.
Publicado: (2024)
por: Muslimani, Calarina, et al.
Publicado: (2024)
Large Language Models Are Neurosymbolic Reasoners
por: Fang, Meng, et al.
Publicado: (2024)
por: Fang, Meng, et al.
Publicado: (2024)
STAS: Spatial-Temporal Return Decomposition for Multi-agent Reinforcement Learning
por: Chen, Sirui, et al.
Publicado: (2023)
por: Chen, Sirui, et al.
Publicado: (2023)
Out-of-Distribution Generalization with a SPARC: Racing 100 Unseen Vehicles with a Single Policy
por: Grooten, Bram, et al.
Publicado: (2025)
por: Grooten, Bram, et al.
Publicado: (2025)
RuAG: Learned-rule-augmented Generation for Large Language Models
por: Zhang, Yudi, et al.
Publicado: (2024)
por: Zhang, Yudi, et al.
Publicado: (2024)
ATLaS: Agent Tuning via Learning Critical Steps
por: Chen, Zhixun, et al.
Publicado: (2025)
por: Chen, Zhixun, et al.
Publicado: (2025)
Multi-Agent Reinforcement Learning for Autonomous Driving: A Survey
por: Zhang, Ruiqi, et al.
Publicado: (2024)
por: Zhang, Ruiqi, et al.
Publicado: (2024)
Scalable Safe Multi-Agent Reinforcement Learning for Multi-Agent System
por: Du, Haikuo, et al.
Publicado: (2025)
por: Du, Haikuo, et al.
Publicado: (2025)
DRED: Zero-Shot Transfer in Reinforcement Learning via Data-Regularised Environment Design
por: Garcin, Samuel, et al.
Publicado: (2024)
por: Garcin, Samuel, et al.
Publicado: (2024)
Batch Matrix-form Equations and Implementation of Multilayer Perceptrons
por: Wesselink, Wieger, et al.
Publicado: (2025)
por: Wesselink, Wieger, et al.
Publicado: (2025)
(PASS) Visual Prompt Locates Good Structure Sparsity through a Recurrent HyperNetwork
por: Huang, Tianjin, et al.
Publicado: (2024)
por: Huang, Tianjin, et al.
Publicado: (2024)
The Neutrality Fallacy: When Algorithmic Fairness Interventions are (Not) Positive Action
por: Weerts, Hilde, et al.
Publicado: (2024)
por: Weerts, Hilde, et al.
Publicado: (2024)
Enhancing Adversarial Training via Reweighting Optimization Trajectory
por: Huang, Tianjin, et al.
Publicado: (2023)
por: Huang, Tianjin, et al.
Publicado: (2023)
Studying the Interplay Between the Actor and Critic Representations in Reinforcement Learning
por: Garcin, Samuel, et al.
Publicado: (2025)
por: Garcin, Samuel, et al.
Publicado: (2025)
Learning to Discuss Strategically: A Case Study on One Night Ultimate Werewolf
por: Jin, Xuanfa, et al.
Publicado: (2024)
por: Jin, Xuanfa, et al.
Publicado: (2024)
Unveiling the Power of Sparse Neural Networks for Feature Selection
por: Atashgahi, Zahra, et al.
Publicado: (2024)
por: Atashgahi, Zahra, et al.
Publicado: (2024)
Intrinsic Memory Agents: Heterogeneous Multi-Agent LLM Systems through Structured Contextual Memory
por: Yuen, Sizhe, et al.
Publicado: (2025)
por: Yuen, Sizhe, et al.
Publicado: (2025)
Comprehend, Divide, and Conquer: Feature Subspace Exploration via Multi-Agent Hierarchical Reinforcement Learning
por: Zhang, Weiliang, et al.
Publicado: (2025)
por: Zhang, Weiliang, et al.
Publicado: (2025)
TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
por: Lou, Xingzhou, et al.
Publicado: (2023)
por: Lou, Xingzhou, et al.
Publicado: (2023)
BenchMARL: Benchmarking Multi-Agent Reinforcement Learning
por: Bettini, Matteo, et al.
Publicado: (2023)
por: Bettini, Matteo, et al.
Publicado: (2023)
LiMTR: Time Series Motion Prediction for Diverse Road Users through Multimodal Feature Integration
por: Oerlemans, Camiel, et al.
Publicado: (2024)
por: Oerlemans, Camiel, et al.
Publicado: (2024)
Learning Efficient and Fair Policies for Uncertainty-Aware Collaborative Human-Robot Order Picking
por: Smit, Igor G., et al.
Publicado: (2024)
por: Smit, Igor G., et al.
Publicado: (2024)
MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages
por: Han, Wenhan, et al.
Publicado: (2025)
por: Han, Wenhan, et al.
Publicado: (2025)
Reinforcing the World's Edge: A Continual Learning Problem in the Multi-Agent-World Boundary
por: Malenfant, Dane
Publicado: (2026)
por: Malenfant, Dane
Publicado: (2026)
Safe Reinforcement Learning in a Simulated Robotic Arm
por: Kovač, Luka, et al.
Publicado: (2023)
por: Kovač, Luka, et al.
Publicado: (2023)
Ejemplares similares
-
HASARD: A Benchmark for Vision-Based Safe Reinforcement Learning in Embodied Agents
por: Tomilin, Tristan, et al.
Publicado: (2025) -
PillagerBench: Benchmarking LLM-Based Agents in Competitive Minecraft Team Environments
por: Schipper, Olivier, et al.
Publicado: (2025) -
SocialJax: An Evaluation Suite for Multi-agent Reinforcement Learning in Sequential Social Dilemmas
por: Guo, Zihao, et al.
Publicado: (2025) -
Safe Multi-agent Reinforcement Learning with Natural Language Constraints
por: Wang, Ziyan, et al.
Publicado: (2024) -
Benchmarking Foundation Models with Retrieval-Augmented Generation in Olympic-Level Physics Problem Solving
por: Zheng, Shunfeng, et al.
Publicado: (2025)