Balancing Act: Prioritization Strategies for LLM-Designed Restless Bandit Rewards
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Verma, Shresth, Boehmer, Niclas, Kong, Lingkai, Tambe, Milind |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Multilinguality in LLM-Designed Reward Functions for Restless Bandits: Effects on Task Performance and Fairness
von: Parthasarathy, Ambreesh, et al.
Veröffentlicht: (2025)
von: Parthasarathy, Ambreesh, et al.
Veröffentlicht: (2025)
Finite-Horizon Single-Pull Restless Bandits: An Efficient Index Policy For Scarce Resource Allocation
von: Xiong, Guojun, et al.
Veröffentlicht: (2025)
von: Xiong, Guojun, et al.
Veröffentlicht: (2025)
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks
von: Biswas, Arpita, et al.
Veröffentlicht: (2023)
von: Biswas, Arpita, et al.
Veröffentlicht: (2023)
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
von: Behari, Nikhil, et al.
Veröffentlicht: (2024)
von: Behari, Nikhil, et al.
Veröffentlicht: (2024)
The Bandit Whisperer: Communication Learning for Restless Bandits
von: Zhao, Yunfan, et al.
Veröffentlicht: (2024)
von: Zhao, Yunfan, et al.
Veröffentlicht: (2024)
Combining Diverse Information for Coordinated Action: Stochastic Bandit Algorithms for Heterogeneous Agents
von: Gordon, Lucia, et al.
Veröffentlicht: (2024)
von: Gordon, Lucia, et al.
Veröffentlicht: (2024)
Generative AI Against Poaching: Latent Composite Flow Matching for Wildlife Conservation
von: Kong, Lingkai, et al.
Veröffentlicht: (2025)
von: Kong, Lingkai, et al.
Veröffentlicht: (2025)
Improving Health Information Access in the World's Largest Maternal Mobile Health Program via Bandit Algorithms
von: Lalan, Arshika, et al.
Veröffentlicht: (2024)
von: Lalan, Arshika, et al.
Veröffentlicht: (2024)
Decisions and Deployment: The Five-Year SAHELI Project (2020-2025) on Restless Multi-Armed Bandits for Improving Maternal and Child Health
von: Verma, Shresth, et al.
Veröffentlicht: (2026)
von: Verma, Shresth, et al.
Veröffentlicht: (2026)
Incorporating Human Flexibility through Reward Preferences in Human-AI Teaming
von: Bhambri, Siddhant, et al.
Veröffentlicht: (2023)
von: Bhambri, Siddhant, et al.
Veröffentlicht: (2023)
Talk Structurally, Act Hierarchically: A Collaborative Framework for LLM Multi-Agent Systems
von: Wang, Zhao, et al.
Veröffentlicht: (2025)
von: Wang, Zhao, et al.
Veröffentlicht: (2025)
LERO: LLM-driven Evolutionary framework with Hybrid Rewards and Enhanced Observation for Multi-Agent Reinforcement Learning
von: Wei, Yuan, et al.
Veröffentlicht: (2025)
von: Wei, Yuan, et al.
Veröffentlicht: (2025)
Large Language Model-Based Reward Design for Deep Reinforcement Learning-Driven Autonomous Cyber Defense
von: Mukherjee, Sayak, et al.
Veröffentlicht: (2025)
von: Mukherjee, Sayak, et al.
Veröffentlicht: (2025)
Ensembling Prioritized Hybrid Policies for Multi-agent Pathfinding
von: Tang, Huijie, et al.
Veröffentlicht: (2024)
von: Tang, Huijie, et al.
Veröffentlicht: (2024)
LoopBench: Discovering Emergent Symmetry Breaking Strategies with LLM Swarms
von: Parsaee, Ali, et al.
Veröffentlicht: (2025)
von: Parsaee, Ali, et al.
Veröffentlicht: (2025)
In-Context Curiosity: Distilling Exploration for Decision-Pretrained Transformers on Bandit Tasks
von: Yang, Huitao, et al.
Veröffentlicht: (2025)
von: Yang, Huitao, et al.
Veröffentlicht: (2025)
Meritocratic Fairness in Budgeted Combinatorial Multi-armed Bandits via Shapley Values
von: Sharma, Shradha, et al.
Veröffentlicht: (2026)
von: Sharma, Shradha, et al.
Veröffentlicht: (2026)
Value Internalization: Learning and Generalizing from Social Reward
von: Rong, Frieda, et al.
Veröffentlicht: (2024)
von: Rong, Frieda, et al.
Veröffentlicht: (2024)
When Is Diversity Rewarded in Cooperative Multi-Agent Learning?
von: Amir, Michael, et al.
Veröffentlicht: (2025)
von: Amir, Michael, et al.
Veröffentlicht: (2025)
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines
von: Zheng, Xuejing, et al.
Veröffentlicht: (2024)
von: Zheng, Xuejing, et al.
Veröffentlicht: (2024)
Reward-Independent Messaging for Decentralized Multi-Agent Reinforcement Learning
von: Yoshida, Naoto, et al.
Veröffentlicht: (2025)
von: Yoshida, Naoto, et al.
Veröffentlicht: (2025)
EngiAI: A Multi-Agent Framework and Benchmark Suite for LLM-Driven Engineering Design
von: Molinari, Gioele, et al.
Veröffentlicht: (2026)
von: Molinari, Gioele, et al.
Veröffentlicht: (2026)
Improving the Prediction of Individual Engagement in Recommendations Using Cognitive Models
von: Seow, Roderick, et al.
Veröffentlicht: (2024)
von: Seow, Roderick, et al.
Veröffentlicht: (2024)
Achieving Optimal Tissue Repair Through MARL with Reward Shaping and Curriculum Learning
von: Khan, Muhammad Al-Zafar, et al.
Veröffentlicht: (2025)
von: Khan, Muhammad Al-Zafar, et al.
Veröffentlicht: (2025)
Improve Value Estimation of Q Function and Reshape Reward with Monte Carlo Tree Search
von: Li, Jiamian
Veröffentlicht: (2024)
von: Li, Jiamian
Veröffentlicht: (2024)
Mathematical Framework for Custom Reward Functions in Job Application Evaluation using Reinforcement Learning
von: Jain, Shreyansh, et al.
Veröffentlicht: (2025)
von: Jain, Shreyansh, et al.
Veröffentlicht: (2025)
Learning Individual Intrinsic Reward in Multi-Agent Reinforcement Learning via Incorporating Generalized Human Expertise
von: Wu, Xuefei, et al.
Veröffentlicht: (2025)
von: Wu, Xuefei, et al.
Veröffentlicht: (2025)
IRL for Restless Multi-Armed Bandits with Applications in Maternal and Child Health
von: Jain, Gauri, et al.
Veröffentlicht: (2024)
von: Jain, Gauri, et al.
Veröffentlicht: (2024)
Reward Shaping for Inference-Time Alignment: A Stackelberg Game Perspective
von: Wang, Haichuan, et al.
Veröffentlicht: (2026)
von: Wang, Haichuan, et al.
Veröffentlicht: (2026)
Learning Strategy Representation for Imitation Learning in Multi-Agent Games
von: Lei, Shiqi, et al.
Veröffentlicht: (2024)
von: Lei, Shiqi, et al.
Veröffentlicht: (2024)
Breaking the Performance Ceiling in Reinforcement Learning requires Inference Strategies
von: Chalumeau, Felix, et al.
Veröffentlicht: (2025)
von: Chalumeau, Felix, et al.
Veröffentlicht: (2025)
Adaptively Coordinating with Novel Partners via Learned Latent Strategies
von: Li, Benjamin, et al.
Veröffentlicht: (2025)
von: Li, Benjamin, et al.
Veröffentlicht: (2025)
Federated Combinatorial Multi-Agent Multi-Armed Bandits
von: Fourati, Fares, et al.
Veröffentlicht: (2024)
von: Fourati, Fares, et al.
Veröffentlicht: (2024)
Redistributing Rewards Across Time and Agents for Multi-Agent Reinforcement Learning
von: Kapoor, Aditya, et al.
Veröffentlicht: (2025)
von: Kapoor, Aditya, et al.
Veröffentlicht: (2025)
Role Play: Learning Adaptive Role-Specific Strategies in Multi-Agent Interactions
von: Long, Weifan, et al.
Veröffentlicht: (2024)
von: Long, Weifan, et al.
Veröffentlicht: (2024)
Assigning Credit with Partial Reward Decoupling in Multi-Agent Proximal Policy Optimization
von: Kapoor, Aditya, et al.
Veröffentlicht: (2024)
von: Kapoor, Aditya, et al.
Veröffentlicht: (2024)
CleanAgent: Automating Data Standardization with LLM-based Agents
von: Qi, Danrui, et al.
Veröffentlicht: (2024)
von: Qi, Danrui, et al.
Veröffentlicht: (2024)
SPIRAL: Symbolic LLM Planning via Grounded and Reflective Search
von: Zhang, Yifan, et al.
Veröffentlicht: (2025)
von: Zhang, Yifan, et al.
Veröffentlicht: (2025)
LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning
von: Bae, Sangjun, et al.
Veröffentlicht: (2026)
von: Bae, Sangjun, et al.
Veröffentlicht: (2026)
Carbon Market Simulation with Adaptive Mechanism Design
von: Wang, Han, et al.
Veröffentlicht: (2024)
von: Wang, Han, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Multilinguality in LLM-Designed Reward Functions for Restless Bandits: Effects on Task Performance and Fairness
von: Parthasarathy, Ambreesh, et al.
Veröffentlicht: (2025) -
Finite-Horizon Single-Pull Restless Bandits: An Efficient Index Policy For Scarce Resource Allocation
von: Xiong, Guojun, et al.
Veröffentlicht: (2025) -
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks
von: Biswas, Arpita, et al.
Veröffentlicht: (2023) -
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
von: Behari, Nikhil, et al.
Veröffentlicht: (2024) -
The Bandit Whisperer: Communication Learning for Restless Bandits
von: Zhao, Yunfan, et al.
Veröffentlicht: (2024)