Combining Diverse Information for Coordinated Action: Stochastic Bandit Algorithms for Heterogeneous Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gordon, Lucia, Rolf, Esther, Tambe, Milind |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Balancing Act: Prioritization Strategies for LLM-Designed Restless Bandit Rewards
par: Verma, Shresth, et autres
Publié: (2024)
par: Verma, Shresth, et autres
Publié: (2024)
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks
par: Biswas, Arpita, et autres
Publié: (2023)
par: Biswas, Arpita, et autres
Publié: (2023)
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
par: Behari, Nikhil, et autres
Publié: (2024)
par: Behari, Nikhil, et autres
Publié: (2024)
Improving Health Information Access in the World's Largest Maternal Mobile Health Program via Bandit Algorithms
par: Lalan, Arshika, et autres
Publié: (2024)
par: Lalan, Arshika, et autres
Publié: (2024)
Multilinguality in LLM-Designed Reward Functions for Restless Bandits: Effects on Task Performance and Fairness
par: Parthasarathy, Ambreesh, et autres
Publié: (2025)
par: Parthasarathy, Ambreesh, et autres
Publié: (2025)
Heterogeneous Information-Bottleneck Coordination Graphs for Multi-Agent Reinforcement Learning
par: Duan, Wei, et autres
Publié: (2026)
par: Duan, Wei, et autres
Publié: (2026)
The Bandit Whisperer: Communication Learning for Restless Bandits
par: Zhao, Yunfan, et autres
Publié: (2024)
par: Zhao, Yunfan, et autres
Publié: (2024)
Generative AI Against Poaching: Latent Composite Flow Matching for Wildlife Conservation
par: Kong, Lingkai, et autres
Publié: (2025)
par: Kong, Lingkai, et autres
Publié: (2025)
System Neural Diversity: Measuring Behavioral Heterogeneity in Multi-Agent Learning
par: Bettini, Matteo, et autres
Publié: (2023)
par: Bettini, Matteo, et autres
Publié: (2023)
Heterogeneous Multi-Agent Bandits with Parsimonious Hints
par: Mirfakhar, Amirmahdi, et autres
Publié: (2025)
par: Mirfakhar, Amirmahdi, et autres
Publié: (2025)
Finite-Horizon Single-Pull Restless Bandits: An Efficient Index Policy For Scarce Resource Allocation
par: Xiong, Guojun, et autres
Publié: (2025)
par: Xiong, Guojun, et autres
Publié: (2025)
CAMAR: Continuous Actions Multi-Agent Routing
par: Pshenitsyn, Artem, et autres
Publié: (2025)
par: Pshenitsyn, Artem, et autres
Publié: (2025)
Group-Aware Coordination Graph for Multi-Agent Reinforcement Learning
par: Duan, Wei, et autres
Publié: (2024)
par: Duan, Wei, et autres
Publié: (2024)
Settling Decentralized Multi-Agent Coordinated Exploration by Novelty Sharing
par: Jiang, Haobin, et autres
Publié: (2024)
par: Jiang, Haobin, et autres
Publié: (2024)
Language-Driven Coordination and Learning in Multi-Agent Simulation Environments
par: Li, Zhengyang, et autres
Publié: (2025)
par: Li, Zhengyang, et autres
Publié: (2025)
Coordination Matters: Evaluation of Cooperative Multi-Agent Reinforcement Learning
par: Cardei, Maria Ana, et autres
Publié: (2026)
par: Cardei, Maria Ana, et autres
Publié: (2026)
Embodiment-Induced Coordination Regimes in Tabular Multi-Agent Q-Learning
par: Atif, Muhammad Ahmed, et autres
Publié: (2026)
par: Atif, Muhammad Ahmed, et autres
Publié: (2026)
Distributed Multi-Agent Coordination Using Multi-Modal Foundation Models
par: Mahmud, Saaduddin, et autres
Publié: (2025)
par: Mahmud, Saaduddin, et autres
Publié: (2025)
Multi-Agent Diagnostics for Robustness via Illuminated Diversity
par: Samvelyan, Mikayel, et autres
Publié: (2024)
par: Samvelyan, Mikayel, et autres
Publié: (2024)
When Is Diversity Rewarded in Cooperative Multi-Agent Learning?
par: Amir, Michael, et autres
Publié: (2025)
par: Amir, Michael, et autres
Publié: (2025)
Evaluating Collaborative and Autonomous Agents in Data-Stream-Supported Coordination of Mobile Crowdsourcing
par: Bruns, Ralf, et autres
Publié: (2024)
par: Bruns, Ralf, et autres
Publié: (2024)
Reducing Redundant Computation in Multi-Agent Coordination through Locally Centralized Execution
par: Bai, Yidong, et autres
Publié: (2024)
par: Bai, Yidong, et autres
Publié: (2024)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
par: Hu, Kun, et autres
Publié: (2025)
par: Hu, Kun, et autres
Publié: (2025)
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem
par: Barde, Paul, et autres
Publié: (2023)
par: Barde, Paul, et autres
Publié: (2023)
Deep Reinforcement Learning for Multi-Agent Coordination
par: Aina, Kehinde O., et autres
Publié: (2025)
par: Aina, Kehinde O., et autres
Publié: (2025)
Adaptively Coordinating with Novel Partners via Learned Latent Strategies
par: Li, Benjamin, et autres
Publié: (2025)
par: Li, Benjamin, et autres
Publié: (2025)
Federated Combinatorial Multi-Agent Multi-Armed Bandits
par: Fourati, Fares, et autres
Publié: (2024)
par: Fourati, Fares, et autres
Publié: (2024)
JaxMARL: Multi-Agent RL Environments and Algorithms in JAX
par: Rutherford, Alexander, et autres
Publié: (2023)
par: Rutherford, Alexander, et autres
Publié: (2023)
Simultaneously Achieving Group Exposure Fairness and Within-Group Meritocracy in Stochastic Bandits
par: Pokhriyal, Subham, et autres
Publié: (2024)
par: Pokhriyal, Subham, et autres
Publié: (2024)
In-Context Curiosity: Distilling Exploration for Decision-Pretrained Transformers on Bandit Tasks
par: Yang, Huitao, et autres
Publié: (2025)
par: Yang, Huitao, et autres
Publié: (2025)
MESA: Cooperative Meta-Exploration in Multi-Agent Learning through Exploiting State-Action Space Structure
par: Zhang, Zhicheng, et autres
Publié: (2024)
par: Zhang, Zhicheng, et autres
Publié: (2024)
QSIM: Mitigating Overestimation in Multi-Agent Reinforcement Learning via Action Similarity Weighted Q-Learning
par: Li, Yuanjun, et autres
Publié: (2026)
par: Li, Yuanjun, et autres
Publié: (2026)
Meritocratic Fairness in Budgeted Combinatorial Multi-armed Bandits via Shapley Values
par: Sharma, Shradha, et autres
Publié: (2026)
par: Sharma, Shradha, et autres
Publié: (2026)
Evaluating and Improving Graph-based Explanation Methods for Multi-Agent Coordination
par: Kailas, Siva, et autres
Publié: (2025)
par: Kailas, Siva, et autres
Publié: (2025)
Controlling Behavioral Diversity in Multi-Agent Reinforcement Learning
par: Bettini, Matteo, et autres
Publié: (2024)
par: Bettini, Matteo, et autres
Publié: (2024)
Coordination Failure in Cooperative Offline MARL
par: Tilbury, Callum Rhys, et autres
Publié: (2024)
par: Tilbury, Callum Rhys, et autres
Publié: (2024)
Mixture-of-Models: Unifying Heterogeneous Agents via N-Way Self-Evaluating Deliberation
par: Pecerskis, Tims, et autres
Publié: (2026)
par: Pecerskis, Tims, et autres
Publié: (2026)
Decentralizing Multi-Agent Reinforcement Learning with Temporal Causal Information
par: Corazza, Jan, et autres
Publié: (2025)
par: Corazza, Jan, et autres
Publié: (2025)
Reliable and Efficient Multi-Agent Coordination via Graph Neural Network Variational Autoencoders
par: Meng, Yue, et autres
Publié: (2025)
par: Meng, Yue, et autres
Publié: (2025)
Shaping Zero-Shot Coordination via State Blocking
par: Kang, Mingu, et autres
Publié: (2026)
par: Kang, Mingu, et autres
Publié: (2026)
Documents similaires
-
Balancing Act: Prioritization Strategies for LLM-Designed Restless Bandit Rewards
par: Verma, Shresth, et autres
Publié: (2024) -
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks
par: Biswas, Arpita, et autres
Publié: (2023) -
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
par: Behari, Nikhil, et autres
Publié: (2024) -
Improving Health Information Access in the World's Largest Maternal Mobile Health Program via Bandit Algorithms
par: Lalan, Arshika, et autres
Publié: (2024) -
Multilinguality in LLM-Designed Reward Functions for Restless Bandits: Effects on Task Performance and Fairness
par: Parthasarathy, Ambreesh, et autres
Publié: (2025)