Individual Contributions as Intrinsic Exploration Scaffolds for Multi-agent Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Xinran, Liu, Zifan, Chen, Shibo, Zhang, Jun |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Principle of Targeted Intervention for Multi-Agent Reinforcement Learning
by: Liu, Anjie, et al.
Published: (2025)
by: Liu, Anjie, et al.
Published: (2025)
Analysing Factorizations of Action-Value Networks for Cooperative Multi-Agent Reinforcement Learning
by: Castellini, Jacopo, et al.
Published: (2019)
by: Castellini, Jacopo, et al.
Published: (2019)
When Agents Disagree: The Selection Bottleneck in Multi-Agent LLM Pipelines
by: Maryanskyy, Artem
Published: (2026)
by: Maryanskyy, Artem
Published: (2026)
QTypeMix: Enhancing Multi-Agent Cooperative Strategies through Heterogeneous and Homogeneous Value Decomposition
by: Fu, Songchen, et al.
Published: (2024)
by: Fu, Songchen, et al.
Published: (2024)
Risk-Sensitive Multi-Agent Reinforcement Learning in Network Aggregative Markov Games
by: Ghaemi, Hafez, et al.
Published: (2024)
by: Ghaemi, Hafez, et al.
Published: (2024)
Enhancing Heterogeneous Multi-Agent Cooperation in Decentralized MARL via GNN-driven Intrinsic Rewards
by: Monon, Jahir Sadik, et al.
Published: (2024)
by: Monon, Jahir Sadik, et al.
Published: (2024)
Decentralized Aerial Manipulation of a Cable-Suspended Load using Multi-Agent Reinforcement Learning
by: Zeng, Jack, et al.
Published: (2025)
by: Zeng, Jack, et al.
Published: (2025)
Policy Search, Retrieval, and Composition via Task Similarity in Collaborative Agentic Systems
by: Nath, Saptarshi, et al.
Published: (2025)
by: Nath, Saptarshi, et al.
Published: (2025)
Bimanual Robot Manipulation via Multi-Agent In-Context Learning
by: Palma, Alessio, et al.
Published: (2026)
by: Palma, Alessio, et al.
Published: (2026)
Collaboration Promotes Group Resilience in Multi-Agent RL
by: Shraga, Ilai, et al.
Published: (2021)
by: Shraga, Ilai, et al.
Published: (2021)
Representational Collapse in Multi-Agent LLM Committees: Measurement and Diversity-Aware Consensus
by: Patel, Dipkumar
Published: (2026)
by: Patel, Dipkumar
Published: (2026)
AdaptOrch: Task-Adaptive Multi-Agent Orchestration in the Era of LLM Performance Convergence
by: Yu, Geunbin
Published: (2026)
by: Yu, Geunbin
Published: (2026)
PillagerBench: Benchmarking LLM-Based Agents in Competitive Minecraft Team Environments
by: Schipper, Olivier, et al.
Published: (2025)
by: Schipper, Olivier, et al.
Published: (2025)
Dynamic Attentional Context Scoping: Agent-Triggered Focus Sessions for Isolated Per-Agent Steering in Multi-Agent LLM Orchestration
by: Patel, Nickson
Published: (2026)
by: Patel, Nickson
Published: (2026)
Networked Agents in the Dark: Team Value Learning under Partial Observability
by: Varela, Guilherme S., et al.
Published: (2025)
by: Varela, Guilherme S., et al.
Published: (2025)
Towards General Negotiation Strategies with End-to-End Reinforcement Learning
by: Renting, Bram M., et al.
Published: (2024)
by: Renting, Bram M., et al.
Published: (2024)
Knowledge Equivalence in Digital Twins of Intelligent Systems
by: Zhang, Nan, et al.
Published: (2022)
by: Zhang, Nan, et al.
Published: (2022)
Distributed Value Decomposition Networks with Networked Agents
by: Varela, Guilherme S., et al.
Published: (2025)
by: Varela, Guilherme S., et al.
Published: (2025)
MindGames Arena Generalization Track: In2AI Solution with Delayed Per-Step Reward Attribution
by: Korshuk, Aliaksei, et al.
Published: (2026)
by: Korshuk, Aliaksei, et al.
Published: (2026)
SPIRAL: Self-Play Incremental Racing Algorithm for Learning in Multi-Drone Competitions
by: Akgün, Onur
Published: (2025)
by: Akgün, Onur
Published: (2025)
Centrally Coordinated Multi-Agent Reinforcement Learning for Power Grid Topology Control
by: de Mol, Barbera, et al.
Published: (2025)
by: de Mol, Barbera, et al.
Published: (2025)
Curriculum-Based Iterative Self-Play for Scalable Multi-Drone Racing
by: Akgün, Onur
Published: (2025)
by: Akgün, Onur
Published: (2025)
Characterizing MARL for Energy Control: A Multi-KPI Benchmark on the CityLearn Environment
by: Khouja, Aymen, et al.
Published: (2026)
by: Khouja, Aymen, et al.
Published: (2026)
ROTATE: Regret-driven Open-ended Training for Ad Hoc Teamwork
by: Wang, Caroline, et al.
Published: (2025)
by: Wang, Caroline, et al.
Published: (2025)
Learning Approximate Nash Equilibria in Cooperative Multi-Agent Reinforcement Learning via Mean-Field Subsampling
by: Anand, Emile, et al.
Published: (2026)
by: Anand, Emile, et al.
Published: (2026)
Difference Rewards Policy Gradients
by: Castellini, Jacopo, et al.
Published: (2020)
by: Castellini, Jacopo, et al.
Published: (2020)
Optimally Solving Simultaneous-Move Dec-POMDPs: The Sequential Central Planning Approach
by: Peralez, Johan, et al.
Published: (2024)
by: Peralez, Johan, et al.
Published: (2024)
EcoNet: Multiagent Planning and Control Of Household Energy Resources Using Active Inference
by: Boik, John C., et al.
Published: (2025)
by: Boik, John C., et al.
Published: (2025)
Differentiable Model Predictive Safety for Heterogeneous Mobility at Urban Intersections
by: Song, Wenzhe, et al.
Published: (2026)
by: Song, Wenzhe, et al.
Published: (2026)
A Systematic Study of Multi-Agent Deep Reinforcement Learning for Safe and Robust Autonomous Highway Ramp Entry
by: Schester, Larry, et al.
Published: (2024)
by: Schester, Larry, et al.
Published: (2024)
David vs. Goliath: Verifiable Agent-to-Agent Jailbreaking via Reinforcement Learning
by: Nellessen, Samuel, et al.
Published: (2026)
by: Nellessen, Samuel, et al.
Published: (2026)
Generating Causal Explanations of Vehicular Agent Behavioural Interactions with Learnt Reward Profiles
by: Howard, Rhys, et al.
Published: (2025)
by: Howard, Rhys, et al.
Published: (2025)
From Safety Risk to Design Principle: Peer-Preservation in Multi-Agent LLM Systems and Its Implications for Orchestrated Democratic Discourse Analysis
by: Dietrich, Juergen
Published: (2026)
by: Dietrich, Juergen
Published: (2026)
Learning to Communicate Across Modalities: Perceptual Heterogeneity in Multi-Agent Systems
by: Pitzer, Naomi, et al.
Published: (2026)
by: Pitzer, Naomi, et al.
Published: (2026)
Robust and Diverse Multi-Agent Learning via Rational Policy Gradient
by: Lauffer, Niklas, et al.
Published: (2025)
by: Lauffer, Niklas, et al.
Published: (2025)
On Convex Optimal Value Functions For POSGs
by: Cunha, Rafael F., et al.
Published: (2023)
by: Cunha, Rafael F., et al.
Published: (2023)
Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning
by: Yoo, Byunghyun, et al.
Published: (2025)
by: Yoo, Byunghyun, et al.
Published: (2025)
Mean-Field Reinforcement Learning without Synchrony
by: Yang, Shan
Published: (2026)
by: Yang, Shan
Published: (2026)
Integrating Anomaly Detection into Agentic AI for Proactive Risk Management in Human Activity
by: Zorriassatine, Farbod, et al.
Published: (2026)
by: Zorriassatine, Farbod, et al.
Published: (2026)
PRIMA: Operational Patterns for Resilient Multi-Agent Research with Verifiable Identity and Convergent Feedback
by: Annapureddy, Sasank
Published: (2026)
by: Annapureddy, Sasank
Published: (2026)
Similar Items
-
A Principle of Targeted Intervention for Multi-Agent Reinforcement Learning
by: Liu, Anjie, et al.
Published: (2025) -
Analysing Factorizations of Action-Value Networks for Cooperative Multi-Agent Reinforcement Learning
by: Castellini, Jacopo, et al.
Published: (2019) -
When Agents Disagree: The Selection Bottleneck in Multi-Agent LLM Pipelines
by: Maryanskyy, Artem
Published: (2026) -
QTypeMix: Enhancing Multi-Agent Cooperative Strategies through Heterogeneous and Homogeneous Value Decomposition
by: Fu, Songchen, et al.
Published: (2024) -
Risk-Sensitive Multi-Agent Reinforcement Learning in Network Aggregative Markov Games
by: Ghaemi, Hafez, et al.
Published: (2024)