Enregistré dans:
| Auteurs principaux: | Zamir, Nida, Hou, I-Hong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2408.07205 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Restless Bandits with Individual Penalty Constraints: Near-Optimal Indices and Deep Reinforcement Learning
par: Zamir, Nida, et autres
Publié: (2026)
par: Zamir, Nida, et autres
Publié: (2026)
Neural Index Policies for Restless Multi-Action Bandits with Heterogeneous Budgets
par: Pandey, Himadri S., et autres
Publié: (2025)
par: Pandey, Himadri S., et autres
Publié: (2025)
GINO-Q: Learning an Asymptotically Optimal Index Policy for Restless Multi-armed Bandits
par: Chen, Gongpu, et autres
Publié: (2024)
par: Chen, Gongpu, et autres
Publié: (2024)
Lagrangian Index Policy for Restless Bandits with Average Reward
par: Avrachenkov, Konstantin, et autres
Publié: (2024)
par: Avrachenkov, Konstantin, et autres
Publié: (2024)
Finite-Horizon Single-Pull Restless Bandits: An Efficient Index Policy For Scarce Resource Allocation
par: Xiong, Guojun, et autres
Publié: (2025)
par: Xiong, Guojun, et autres
Publié: (2025)
IRL for Restless Multi-Armed Bandits with Applications in Maternal and Child Health
par: Jain, Gauri, et autres
Publié: (2024)
par: Jain, Gauri, et autres
Publié: (2024)
Fairness of Exposure in Online Restless Multi-armed Bandits
par: Sood, Archit, et autres
Publié: (2024)
par: Sood, Archit, et autres
Publié: (2024)
Global Rewards in Restless Multi-Armed Bandits
par: Raman, Naveen, et autres
Publié: (2024)
par: Raman, Naveen, et autres
Publié: (2024)
Networked Restless Multi-Arm Bandits with Reinforcement Learning
par: Zhang, Hanmo, et autres
Publié: (2025)
par: Zhang, Hanmo, et autres
Publié: (2025)
Lagrangian Relaxation for Multi-Action Partially Observable Restless Bandits: Heuristic Policies and Indexability
par: Meshram, Rahul, et autres
Publié: (2025)
par: Meshram, Rahul, et autres
Publié: (2025)
MARBLE: Multi-Armed Restless Bandits in Latent Markovian Environment
par: Amiri, Mohsen, et autres
Publié: (2025)
par: Amiri, Mohsen, et autres
Publié: (2025)
Non-Stationary Restless Multi-Armed Bandits with Provable Guarantee
par: Hung, Yu-Heng, et autres
Publié: (2025)
par: Hung, Yu-Heng, et autres
Publié: (2025)
Whittle Index Learning Algorithms for Restless Bandits with Constant Stepsizes
par: Mittal, Vishesh, et autres
Publié: (2024)
par: Mittal, Vishesh, et autres
Publié: (2024)
Restless Linear Bandits
par: Khaleghi, Azadeh
Publié: (2024)
par: Khaleghi, Azadeh
Publié: (2024)
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks
par: Biswas, Arpita, et autres
Publié: (2023)
par: Biswas, Arpita, et autres
Publié: (2023)
The Bandit Whisperer: Communication Learning for Restless Bandits
par: Zhao, Yunfan, et autres
Publié: (2024)
par: Zhao, Yunfan, et autres
Publié: (2024)
Distributed No-Regret Learning for Multi-Stage Systems with End-to-End Bandit Feedback
par: Hou, I-Hong
Publié: (2024)
par: Hou, I-Hong
Publié: (2024)
A Federated Online Restless Bandit Framework for Cooperative Resource Allocation
par: Tong, Jingwen, et autres
Publié: (2024)
par: Tong, Jingwen, et autres
Publié: (2024)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
par: Xiong, Guojun, et autres
Publié: (2024)
par: Xiong, Guojun, et autres
Publié: (2024)
Optimal Control of Fluid Restless Multi-armed Bandits: A Machine Learning Approach
par: Bertsimas, Dimitris, et autres
Publié: (2025)
par: Bertsimas, Dimitris, et autres
Publié: (2025)
Towards a Pretrained Model for Restless Bandits via Multi-arm Generalization
par: Zhao, Yunfan, et autres
Publié: (2023)
par: Zhao, Yunfan, et autres
Publié: (2023)
ContextWIN: Whittle Index Based Mixture-of-Experts Neural Model For Restless Bandits Via Deep RL
par: Guo, Zhanqiu, et autres
Publié: (2024)
par: Guo, Zhanqiu, et autres
Publié: (2024)
Model Predictive Control is almost Optimal for Heterogeneous Restless Multi-armed Bandits
par: Narasimha, Dheeraj, et autres
Publié: (2025)
par: Narasimha, Dheeraj, et autres
Publié: (2025)
Contextual Restless Multi-Armed Bandits with Application to Demand Response Decision-Making
par: Chen, Xin, et autres
Publié: (2024)
par: Chen, Xin, et autres
Publié: (2024)
Faster Q-Learning Algorithms for Restless Bandits
par: Kakarapalli, Parvish, et autres
Publié: (2024)
par: Kakarapalli, Parvish, et autres
Publié: (2024)
Bridging Rested and Restless Bandits with Graph-Triggering: Rising and Rotting
par: Genalti, Gianmarco, et autres
Publié: (2024)
par: Genalti, Gianmarco, et autres
Publié: (2024)
General Formulation and PCL-Analysis for Restless Bandits with Limited Observability
par: Liu, Keqin, et autres
Publié: (2023)
par: Liu, Keqin, et autres
Publié: (2023)
A Modularized Framework for Piecewise-Stationary Restless Bandits
par: Li, Kuan-Ta, et autres
Publié: (2026)
par: Li, Kuan-Ta, et autres
Publié: (2026)
Low-Complexity Algorithm for Restless Bandits with Imperfect Observations
par: Liu, Keqin, et autres
Publié: (2021)
par: Liu, Keqin, et autres
Publié: (2021)
Model Predictive Control is Almost Optimal for Restless Bandit
par: Gast, Nicolas, et autres
Publié: (2024)
par: Gast, Nicolas, et autres
Publié: (2024)
Adapter-Augmented Bandits for Online Multi-Constrained Multi-Modal Inference Scheduling
par: Zhang, Xianzhi, et autres
Publié: (2026)
par: Zhang, Xianzhi, et autres
Publié: (2026)
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
par: Behari, Nikhil, et autres
Publié: (2024)
par: Behari, Nikhil, et autres
Publié: (2024)
Optimal Best Arm Identification with Fixed Confidence in Restless Bandits
par: Karthik, P. N., et autres
Publié: (2023)
par: Karthik, P. N., et autres
Publié: (2023)
Multi-Action Restless Bandits with Weakly Coupled Constraints: Simultaneous Learning and Control
par: Fu, Jing, et autres
Publié: (2024)
par: Fu, Jing, et autres
Publié: (2024)
Restless Bandits with Average Reward: Breaking the Uniform Global Attractor Assumption
par: Hong, Yige, et autres
Publié: (2023)
par: Hong, Yige, et autres
Publié: (2023)
Online Learning of Whittle Indices for Restless Bandits with Non-Stationary Transition Kernels
par: Shisher, Md Kamran Chowdhury, et autres
Publié: (2025)
par: Shisher, Md Kamran Chowdhury, et autres
Publié: (2025)
From Restless to Contextual: A Thresholding Bandit Reformulation For Finite-horizon Improvement
par: Xu, Jiamin, et autres
Publié: (2025)
par: Xu, Jiamin, et autres
Publié: (2025)
DOPL: Direct Online Preference Learning for Restless Bandits with Preference Feedback
par: Xiong, Guojun, et autres
Publié: (2024)
par: Xiong, Guojun, et autres
Publié: (2024)
Decisions and Deployment: The Five-Year SAHELI Project (2020-2025) on Restless Multi-Armed Bandits for Improving Maternal and Child Health
par: Verma, Shresth, et autres
Publié: (2026)
par: Verma, Shresth, et autres
Publié: (2026)
Distributed Learning in Markovian Restless Bandits over Interference Graphs for Stable Spectrum Sharing
par: Didi, Liad Lea, et autres
Publié: (2025)
par: Didi, Liad Lea, et autres
Publié: (2025)
Documents similaires
-
Restless Bandits with Individual Penalty Constraints: Near-Optimal Indices and Deep Reinforcement Learning
par: Zamir, Nida, et autres
Publié: (2026) -
Neural Index Policies for Restless Multi-Action Bandits with Heterogeneous Budgets
par: Pandey, Himadri S., et autres
Publié: (2025) -
GINO-Q: Learning an Asymptotically Optimal Index Policy for Restless Multi-armed Bandits
par: Chen, Gongpu, et autres
Publié: (2024) -
Lagrangian Index Policy for Restless Bandits with Average Reward
par: Avrachenkov, Konstantin, et autres
Publié: (2024) -
Finite-Horizon Single-Pull Restless Bandits: An Efficient Index Policy For Scarce Resource Allocation
par: Xiong, Guojun, et autres
Publié: (2025)