Finite-Horizon Single-Pull Restless Bandits: An Efficient Index Policy For Scarce Resource Allocation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiong, Guojun, Wang, Haichuan, Pan, Yuqi, Mandal, Saptarshi, Shah, Sanket, Boehmer, Niclas, Tambe, Milind |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Balancing Act: Prioritization Strategies for LLM-Designed Restless Bandit Rewards
par: Verma, Shresth, et autres
Publié: (2024)
par: Verma, Shresth, et autres
Publié: (2024)
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks
par: Biswas, Arpita, et autres
Publié: (2023)
par: Biswas, Arpita, et autres
Publié: (2023)
The Bandit Whisperer: Communication Learning for Restless Bandits
par: Zhao, Yunfan, et autres
Publié: (2024)
par: Zhao, Yunfan, et autres
Publié: (2024)
Evaluating the Effectiveness of Index-Based Treatment Allocation
par: Boehmer, Niclas, et autres
Publié: (2024)
par: Boehmer, Niclas, et autres
Publié: (2024)
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
par: Behari, Nikhil, et autres
Publié: (2024)
par: Behari, Nikhil, et autres
Publié: (2024)
Multilinguality in LLM-Designed Reward Functions for Restless Bandits: Effects on Task Performance and Fairness
par: Parthasarathy, Ambreesh, et autres
Publié: (2025)
par: Parthasarathy, Ambreesh, et autres
Publié: (2025)
Optimizing Vital Sign Monitoring in Resource-Constrained Maternal Care: An RL-Based Restless Bandit Approach
par: Boehmer, Niclas, et autres
Publié: (2024)
par: Boehmer, Niclas, et autres
Publié: (2024)
Combining Diverse Information for Coordinated Action: Stochastic Bandit Algorithms for Heterogeneous Agents
par: Gordon, Lucia, et autres
Publié: (2024)
par: Gordon, Lucia, et autres
Publié: (2024)
Rule-Bottleneck Reinforcement Learning: Joint Explanation and Decision Optimization for Resource Allocation with Language Agents
par: Tec, Mauricio, et autres
Publié: (2025)
par: Tec, Mauricio, et autres
Publié: (2025)
Generative AI Against Poaching: Latent Composite Flow Matching for Wildlife Conservation
par: Kong, Lingkai, et autres
Publié: (2025)
par: Kong, Lingkai, et autres
Publié: (2025)
Improving the Prediction of Individual Engagement in Recommendations Using Cognitive Models
par: Seow, Roderick, et autres
Publié: (2024)
par: Seow, Roderick, et autres
Publié: (2024)
Resource Allocation with Karma Mechanisms
par: Riehl, Kevin, et autres
Publié: (2024)
par: Riehl, Kevin, et autres
Publié: (2024)
VORTEX: Aligning Task Utility and Human Preferences through LLM-Guided Reward Shaping
par: Xiong, Guojun, et autres
Publié: (2025)
par: Xiong, Guojun, et autres
Publié: (2025)
Improving Health Information Access in the World's Largest Maternal Mobile Health Program via Bandit Algorithms
par: Lalan, Arshika, et autres
Publié: (2024)
par: Lalan, Arshika, et autres
Publié: (2024)
Escape Sensing Games: Detection-vs-Evasion in Security Applications
par: Boehmer, Niclas, et autres
Publié: (2024)
par: Boehmer, Niclas, et autres
Publié: (2024)
Towards Foundation-model-based Multiagent System to Accelerate AI for Social Impact
par: Zhao, Yunfan, et autres
Publié: (2024)
par: Zhao, Yunfan, et autres
Publié: (2024)
MARLIN: Multi-Agent Reinforcement Learning with Murmuration Intelligence and LLM Guidance for Reservoir Management
par: Fu, Heming, et autres
Publié: (2025)
par: Fu, Heming, et autres
Publié: (2025)
Dynamic Adversarial Resource Allocation: the dDAB Game
par: Guan, Yue, et autres
Publié: (2023)
par: Guan, Yue, et autres
Publié: (2023)
Adaptive Multi-Round Allocation with Stochastic Arrivals
par: Pan, Yuqi, et autres
Publié: (2026)
par: Pan, Yuqi, et autres
Publié: (2026)
Composite Flow Matching for Reinforcement Learning with Shifted-Dynamics Data
par: Kong, Lingkai, et autres
Publié: (2025)
par: Kong, Lingkai, et autres
Publié: (2025)
Multi-Topic Projected Opinion Dynamics for Resource Allocation
par: Wankhede, Prashil, et autres
Publié: (2025)
par: Wankhede, Prashil, et autres
Publié: (2025)
Federated Gaussian Process Learning via Pseudo-Representations for Large-Scale Multi-Robot Systems
par: Salunkhe, Sanket A., et autres
Publié: (2026)
par: Salunkhe, Sanket A., et autres
Publié: (2026)
Analyzing Cost-Sensitive Surrogate Losses via $\mathcal{H}$-calibration
par: Shah, Sanket, et autres
Publié: (2025)
par: Shah, Sanket, et autres
Publié: (2025)
LegalSim: Multi-Agent Simulation of Legal Systems for Discovering Procedural Exploits
par: Badhe, Sanket
Publié: (2025)
par: Badhe, Sanket
Publié: (2025)
Lagrangian Index Policy for Restless Bandits with Average Reward
par: Avrachenkov, Konstantin, et autres
Publié: (2024)
par: Avrachenkov, Konstantin, et autres
Publié: (2024)
HASHIRU: Hierarchical Agent System for Hybrid Intelligent Resource Utilization
par: Pai, Kunal, et autres
Publié: (2025)
par: Pai, Kunal, et autres
Publié: (2025)
Resource Allocation with Population Dynamics
par: Epperlein, Jonathan, et autres
Publié: (2016)
par: Epperlein, Jonathan, et autres
Publié: (2016)
Learning Policies for Dynamic Coalition Formation in Multi-Robot Task Allocation
par: Bezerra, Lucas C. D., et autres
Publié: (2024)
par: Bezerra, Lucas C. D., et autres
Publié: (2024)
From Global Policies to Local Strategies: Multi-Objective Optimization of Resource-Specific Handover Policies
par: Kirchdorfer, Lukas, et autres
Publié: (2026)
par: Kirchdorfer, Lukas, et autres
Publié: (2026)
Adversarial Bandit over Bandits: Hierarchical Bandits for Online Configuration Management
par: Avin, Chen, et autres
Publié: (2025)
par: Avin, Chen, et autres
Publié: (2025)
Self-Organizing Agent Network for LLM-based Workflow Automation
par: Xiong, Yiming, et autres
Publié: (2025)
par: Xiong, Yiming, et autres
Publié: (2025)
Drawing a Map of Elections
par: Szufa, Stanisław, et autres
Publié: (2025)
par: Szufa, Stanisław, et autres
Publié: (2025)
ScamAgents: How AI Agents Can Simulate Human-Level Scam Calls
par: Badhe, Sanket
Publié: (2025)
par: Badhe, Sanket
Publié: (2025)
On Sequential Fault-Intolerant Process Planning
par: Kaczmarczyk, Andrzej, et autres
Publié: (2025)
par: Kaczmarczyk, Andrzej, et autres
Publié: (2025)
Asymmetric-Information Resource Allocation Games: An LP Approach to Purposeful Deception
par: Pan, Longxu, et autres
Publié: (2026)
par: Pan, Longxu, et autres
Publié: (2026)
Cooperative Flexibility Exchange: Fair and Comfort-Aware Decentralized Resource Allocation
par: Khalid, Rabiya, et autres
Publié: (2025)
par: Khalid, Rabiya, et autres
Publié: (2025)
Context in Public Health for Underserved Communities: A Bayesian Approach to Online Restless Bandits
par: Liang, Biyonka, et autres
Publié: (2024)
par: Liang, Biyonka, et autres
Publié: (2024)
Task Placement and Resource Allocation for Edge Machine Learning: A GNN-based Multi-Agent Reinforcement Learning Paradigm
par: Li, Yihong, et autres
Publié: (2023)
par: Li, Yihong, et autres
Publié: (2023)
Multi-UAV Enabled MEC Networks: Optimizing Delay through Intelligent 3D Trajectory Planning and Resource Allocation
par: Wang, Zhiying, et autres
Publié: (2024)
par: Wang, Zhiying, et autres
Publié: (2024)
IRL for Restless Multi-Armed Bandits with Applications in Maternal and Child Health
par: Jain, Gauri, et autres
Publié: (2024)
par: Jain, Gauri, et autres
Publié: (2024)
Documents similaires
-
Balancing Act: Prioritization Strategies for LLM-Designed Restless Bandit Rewards
par: Verma, Shresth, et autres
Publié: (2024) -
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks
par: Biswas, Arpita, et autres
Publié: (2023) -
The Bandit Whisperer: Communication Learning for Restless Bandits
par: Zhao, Yunfan, et autres
Publié: (2024) -
Evaluating the Effectiveness of Index-Based Treatment Allocation
par: Boehmer, Niclas, et autres
Publié: (2024) -
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
par: Behari, Nikhil, et autres
Publié: (2024)