How much can change in a year? Revisiting Evaluation in Multi-Agent Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Singh, Siddarth, Mahjoub, Omayma, de Kock, Ruan, Khlifi, Wiem, Vall, Abidine, Tessera, Kale-ab, Pretorius, Arnu |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficiently Quantifying Individual Agent Importance in Cooperative MARL
par: Mahjoub, Omayma, et autres
Publié: (2023)
par: Mahjoub, Omayma, et autres
Publié: (2023)
Multi-Agent Reinforcement Learning with Selective State-Space Models
par: Daniel, Jemma, et autres
Publié: (2024)
par: Daniel, Jemma, et autres
Publié: (2024)
Making High-Level AI Design Decisions Explicit Using a Binary Stream System-Designation Approach
par: Mossbridge, Julia
Publié: (2024)
par: Mossbridge, Julia
Publié: (2024)
Right-to-Act: A Pre-Execution Non-Compensatory Decision Protocol for AI Systems
par: Lavi, Gadi
Publié: (2026)
par: Lavi, Gadi
Publié: (2026)
Super-additive Cooperation in Language Model Agents
par: Tonini, Filippo, et autres
Publié: (2025)
par: Tonini, Filippo, et autres
Publié: (2025)
Generating Causal Explanations of Vehicular Agent Behavioural Interactions with Learnt Reward Profiles
par: Howard, Rhys, et autres
Publié: (2025)
par: Howard, Rhys, et autres
Publié: (2025)
Personality-Driven Decision-Making in LLM-Based Autonomous Agents
par: Newsham, Lewis, et autres
Publié: (2025)
par: Newsham, Lewis, et autres
Publié: (2025)
Adaptive Latent-Space Constraints in Personalized Federated Learning
par: Ayromlou, Sana, et autres
Publié: (2025)
par: Ayromlou, Sana, et autres
Publié: (2025)
Automated Deep Learning Optimization via DSL-Based Source Code Transformation
par: Wang, Ruixin, et autres
Publié: (2024)
par: Wang, Ruixin, et autres
Publié: (2024)
DM$^2$: Decentralized Multi-Agent Reinforcement Learning for Distribution Matching
par: Wang, Caroline, et autres
Publié: (2022)
par: Wang, Caroline, et autres
Publié: (2022)
Characterizing MARL for Energy Control: A Multi-KPI Benchmark on the CityLearn Environment
par: Khouja, Aymen, et autres
Publié: (2026)
par: Khouja, Aymen, et autres
Publié: (2026)
AI Agentic workflows and Enterprise APIs: Adapting API architectures for the age of AI agents
par: Tupe, Vaibhav, et autres
Publié: (2025)
par: Tupe, Vaibhav, et autres
Publié: (2025)
Prompt Readiness Levels (PRL): a maturity scale and scoring framework for production grade prompt assets
par: Guinard, Sebastien
Publié: (2026)
par: Guinard, Sebastien
Publié: (2026)
Knowledge-Aware Iterative Retrieval for Multi-Agent Systems
par: Song, Seyoung
Publié: (2025)
par: Song, Seyoung
Publié: (2025)
A Pattern Language for Resilient Visual Agents
par: Gidey, Habtom Kahsay, et autres
Publié: (2026)
par: Gidey, Habtom Kahsay, et autres
Publié: (2026)
The Efficiency Attenuation Phenomenon: A Computational Challenge to the Language of Thought Hypothesis
par: Zhang, Di
Publié: (2026)
par: Zhang, Di
Publié: (2026)
EBIC: an open source software for high-dimensional and big data biclustering analyses
par: Orzechowski, Patryk, et autres
Publié: (2018)
par: Orzechowski, Patryk, et autres
Publié: (2018)
Strategic Reflectivism In Intelligent Systems
par: Byrd, Nick
Publié: (2025)
par: Byrd, Nick
Publié: (2025)
Semantic Commit: Helping Users Update Intent Specifications for AI Memory at Scale
par: Vaithilingam, Priyan, et autres
Publié: (2025)
par: Vaithilingam, Priyan, et autres
Publié: (2025)
Inside the Scaffold: A Source-Code Taxonomy of Coding Agent Architectures
par: Rombaut, Benjamin
Publié: (2026)
par: Rombaut, Benjamin
Publié: (2026)
Cooperation in Human and Machine Agents: Promise Theory Considerations
par: Burgess, M.
Publié: (2026)
par: Burgess, M.
Publié: (2026)
DIsoN: Decentralized Isolation Networks for Out-of-Distribution Detection in Medical Imaging
par: Wagner, Felix, et autres
Publié: (2025)
par: Wagner, Felix, et autres
Publié: (2025)
Designing Digital Humans with Ambient Intelligence
par: Chen, Mengyu, et autres
Publié: (2026)
par: Chen, Mengyu, et autres
Publié: (2026)
Agentic, Context-Aware Risk Intelligence in the Internet of Value
par: Magableh, Basel, et autres
Publié: (2026)
par: Magableh, Basel, et autres
Publié: (2026)
Rewarding Beliefs, Not Actions: Consistency-Guided Credit Assignment for Long-Horizon Agents
par: Tang, Wenjie, et autres
Publié: (2026)
par: Tang, Wenjie, et autres
Publié: (2026)
MLOps with Microservices: A Case Study on the Maritime Domain
par: Ferreira, Renato Cordeiro, et autres
Publié: (2025)
par: Ferreira, Renato Cordeiro, et autres
Publié: (2025)
Reusability in MLOps: Leveraging Ports and Adapters to Build a Microservices Architecture for the Maritime Domain
par: Ferreira, Renato Cordeiro, et autres
Publié: (2025)
par: Ferreira, Renato Cordeiro, et autres
Publié: (2025)
Transforming Computer Security and Public Trust Through the Exploration of Fine-Tuning Large Language Models
par: Crumrine, Garrett, et autres
Publié: (2024)
par: Crumrine, Garrett, et autres
Publié: (2024)
Genflow Ad Studio: A Compound AI Architecture for Brand-Aligned, Self-Correcting Video Generation
par: Das, Debanshu, et autres
Publié: (2026)
par: Das, Debanshu, et autres
Publié: (2026)
Futurity as Infrastructure: A Techno-Philosophical Interpretation of the AI Lifecycle
par: Cote, Mark, et autres
Publié: (2025)
par: Cote, Mark, et autres
Publié: (2025)
Memory-Augmented State Machine Prompting: A Novel LLM Agent Framework for Real-Time Strategy Games
par: Qi, Runnan, et autres
Publié: (2025)
par: Qi, Runnan, et autres
Publié: (2025)
PARNESS: A Paper Harness for End-to-End Automated Scientific Research with Dynamic Workflows, Full-Text Indexing, and Cross-Run Knowledge Accumulation
par: Wang, Yuchen, et autres
Publié: (2026)
par: Wang, Yuchen, et autres
Publié: (2026)
Evaluating Large Language Models for Causal Modeling
par: Razouk, Houssam, et autres
Publié: (2024)
par: Razouk, Houssam, et autres
Publié: (2024)
CoMoCAVs: Cohesive Decision-Guided Motion Planning for Connected and Autonomous Vehicles with Multi-Policy Reinforcement Learning
par: Hu, Pan
Publié: (2025)
par: Hu, Pan
Publié: (2025)
A Tale of Two Systems: Characterizing Architectural Complexity on Machine Learning-Enabled Systems
par: Ferreira, Renato Cordeiro
Publié: (2025)
par: Ferreira, Renato Cordeiro
Publié: (2025)
A Metrics-Oriented Architectural Model to Characterize Complexity on Machine Learning-Enabled Systems
par: Ferreira, Renato Cordeiro
Publié: (2025)
par: Ferreira, Renato Cordeiro
Publié: (2025)
Structural Plasticity as Active Inference: A Biologically-Inspired Architecture for Homeostatic Control
par: Hill, Brennen A.
Publié: (2025)
par: Hill, Brennen A.
Publié: (2025)
Multi-Agent Object Detection Framework Based on Raspberry Pi YOLO Detector and Slack-Ollama Natural Language Interface
par: Kalušev, Vladimir, et autres
Publié: (2026)
par: Kalušev, Vladimir, et autres
Publié: (2026)
Analysing Factorizations of Action-Value Networks for Cooperative Multi-Agent Reinforcement Learning
par: Castellini, Jacopo, et autres
Publié: (2019)
par: Castellini, Jacopo, et autres
Publié: (2019)
Feasibility of Federated Learning from Client Databases with Different Brain Diseases and MRI Modalities
par: Wagner, Felix, et autres
Publié: (2024)
par: Wagner, Felix, et autres
Publié: (2024)
Documents similaires
-
Efficiently Quantifying Individual Agent Importance in Cooperative MARL
par: Mahjoub, Omayma, et autres
Publié: (2023) -
Multi-Agent Reinforcement Learning with Selective State-Space Models
par: Daniel, Jemma, et autres
Publié: (2024) -
Making High-Level AI Design Decisions Explicit Using a Binary Stream System-Designation Approach
par: Mossbridge, Julia
Publié: (2024) -
Right-to-Act: A Pre-Execution Non-Compensatory Decision Protocol for AI Systems
par: Lavi, Gadi
Publié: (2026) -
Super-additive Cooperation in Language Model Agents
par: Tonini, Filippo, et autres
Publié: (2025)