Global Rewards in Restless Multi-Armed Bandits
Fuente:
arXiv
Salvato in:
| Autori principali: | Raman, Naveen, Shi, Zheyuan Ryan, Fang, Fei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Contextual Budget Bandit for Food Rescue Volunteer Engagement
di: Tang, Ariana, et al.
Pubblicazione: (2025)
di: Tang, Ariana, et al.
Pubblicazione: (2025)
Healthcare LLM Benchmarks Are Only as Good as Their Explicit Assumptions
di: Raman, Naveen, et al.
Pubblicazione: (2026)
di: Raman, Naveen, et al.
Pubblicazione: (2026)
IRL for Restless Multi-Armed Bandits with Applications in Maternal and Child Health
di: Jain, Gauri, et al.
Pubblicazione: (2024)
di: Jain, Gauri, et al.
Pubblicazione: (2024)
Optimizing Urban Service Allocation with Time-Constrained Restless Bandits
di: Mao, Yi, et al.
Pubblicazione: (2025)
di: Mao, Yi, et al.
Pubblicazione: (2025)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
RescueLens: LLM-Powered Triage and Action on Volunteer Feedback for Food Rescue
di: Raman, Naveen, et al.
Pubblicazione: (2025)
di: Raman, Naveen, et al.
Pubblicazione: (2025)
Hierarchical Multi-Armed Bandits for the Concurrent Intelligent Tutoring of Concepts and Problems of Varying Difficulty Levels
di: Castleman, Blake, et al.
Pubblicazione: (2024)
di: Castleman, Blake, et al.
Pubblicazione: (2024)
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
di: Behari, Nikhil, et al.
Pubblicazione: (2024)
di: Behari, Nikhil, et al.
Pubblicazione: (2024)
Decisions and Deployment: The Five-Year SAHELI Project (2020-2025) on Restless Multi-Armed Bandits for Improving Maternal and Child Health
di: Verma, Shresth, et al.
Pubblicazione: (2026)
di: Verma, Shresth, et al.
Pubblicazione: (2026)
Lagrangian Index Policy for Restless Bandits with Average Reward
di: Avrachenkov, Konstantin, et al.
Pubblicazione: (2024)
di: Avrachenkov, Konstantin, et al.
Pubblicazione: (2024)
Flickering Multi-Armed Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
Multilinguality in LLM-Designed Reward Functions for Restless Bandits: Effects on Task Performance and Fairness
di: Parthasarathy, Ambreesh, et al.
Pubblicazione: (2025)
di: Parthasarathy, Ambreesh, et al.
Pubblicazione: (2025)
Networked Restless Multi-Arm Bandits with Reinforcement Learning
di: Zhang, Hanmo, et al.
Pubblicazione: (2025)
di: Zhang, Hanmo, et al.
Pubblicazione: (2025)
Selecting Decision-Relevant Concepts in Reinforcement Learning
di: Raman, Naveen, et al.
Pubblicazione: (2026)
di: Raman, Naveen, et al.
Pubblicazione: (2026)
Balancing Act: Prioritization Strategies for LLM-Designed Restless Bandit Rewards
di: Verma, Shresth, et al.
Pubblicazione: (2024)
di: Verma, Shresth, et al.
Pubblicazione: (2024)
Multi-Armed Bandits With Best-Action Queries
di: Bacchiocchi, Francesco, et al.
Pubblicazione: (2026)
di: Bacchiocchi, Francesco, et al.
Pubblicazione: (2026)
The Cost of Local and Global Fairness in Federated Learning
di: Duan, Yuying, et al.
Pubblicazione: (2025)
di: Duan, Yuying, et al.
Pubblicazione: (2025)
Introduction to Multi-Armed Bandits
di: Slivkins, Aleksandrs
Pubblicazione: (2019)
di: Slivkins, Aleksandrs
Pubblicazione: (2019)
Fair Algorithms with Probing for Multi-Agent Multi-Armed Bandits
di: Xu, Tianyi, et al.
Pubblicazione: (2025)
di: Xu, Tianyi, et al.
Pubblicazione: (2025)
Large Language Model-Enhanced Multi-Armed Bandits
di: Sun, Jiahang, et al.
Pubblicazione: (2025)
di: Sun, Jiahang, et al.
Pubblicazione: (2025)
Multi-Armed Bandits-Based Optimization of Decision Trees
di: Shanto, Hasibul Karim, et al.
Pubblicazione: (2025)
di: Shanto, Hasibul Karim, et al.
Pubblicazione: (2025)
Towards a Pretrained Model for Restless Bandits via Multi-arm Generalization
di: Zhao, Yunfan, et al.
Pubblicazione: (2023)
di: Zhao, Yunfan, et al.
Pubblicazione: (2023)
Interpretable Graph-Language Modeling for Detecting Youth Illicit Drug Use
di: Li, Yiyang, et al.
Pubblicazione: (2025)
di: Li, Yiyang, et al.
Pubblicazione: (2025)
United States Road Accident Prediction using Random Forest Predictor
di: Yamarthi, Dominic Parosh, et al.
Pubblicazione: (2025)
di: Yamarthi, Dominic Parosh, et al.
Pubblicazione: (2025)
Using Adaptive Bandit Experiments to Increase and Investigate Engagement in Mental Health
di: Kumar, Harsh, et al.
Pubblicazione: (2023)
di: Kumar, Harsh, et al.
Pubblicazione: (2023)
Compute Allocation in Evolutionary Search: From Depth-Breadth to Multi-Armed Bandits
di: Xing, Sixue, et al.
Pubblicazione: (2026)
di: Xing, Sixue, et al.
Pubblicazione: (2026)
Thresholding Data Shapley for Data Cleansing Using Multi-Armed Bandits
di: Namba, Hiroyuki, et al.
Pubblicazione: (2024)
di: Namba, Hiroyuki, et al.
Pubblicazione: (2024)
Reward Models Inherit Value Biases from Pretraining
di: Christian, Brian, et al.
Pubblicazione: (2026)
di: Christian, Brian, et al.
Pubblicazione: (2026)
Improving Consistency in Retrieval-Augmented Systems with Group Similarity Rewards
di: Hamman, Faisal, et al.
Pubblicazione: (2025)
di: Hamman, Faisal, et al.
Pubblicazione: (2025)
Towards Automated Scoping of AI for Social Good Projects
di: Emmerson, Jacob, et al.
Pubblicazione: (2025)
di: Emmerson, Jacob, et al.
Pubblicazione: (2025)
Simultaneously Achieving Group Exposure Fairness and Within-Group Meritocracy in Stochastic Bandits
di: Pokhriyal, Subham, et al.
Pubblicazione: (2024)
di: Pokhriyal, Subham, et al.
Pubblicazione: (2024)
Towards Large Language Models that Benefit for All: Benchmarking Group Fairness in Reward Models
di: Song, Kefan, et al.
Pubblicazione: (2025)
di: Song, Kefan, et al.
Pubblicazione: (2025)
Learning to Assist Humans without Inferring Rewards
di: Myers, Vivek, et al.
Pubblicazione: (2024)
di: Myers, Vivek, et al.
Pubblicazione: (2024)
GLOCALFAIR: Jointly Improving Global and Local Group Fairness in Federated Learning
di: Meerza, Syed Irfan Ali, et al.
Pubblicazione: (2024)
di: Meerza, Syed Irfan Ali, et al.
Pubblicazione: (2024)
Annealed Softmax Greedy in Many-Armed Bayesian Bandits
di: Overman, William, et al.
Pubblicazione: (2026)
di: Overman, William, et al.
Pubblicazione: (2026)
Globalizing Fairness Attributes in Machine Learning: A Case Study on Health in Africa
di: Asiedu, Mercy Nyamewaa, et al.
Pubblicazione: (2023)
di: Asiedu, Mercy Nyamewaa, et al.
Pubblicazione: (2023)
Near-Optimal Regret for KL-Regularized Multi-Armed Bandits
di: Ji, Kaixuan, et al.
Pubblicazione: (2026)
di: Ji, Kaixuan, et al.
Pubblicazione: (2026)
On the Benefits of Free Exploration for Regret Minimization in Multi-Armed Bandits
di: Hou, Yunlong, et al.
Pubblicazione: (2026)
di: Hou, Yunlong, et al.
Pubblicazione: (2026)
A Multi-LLM Debiasing Framework
di: Owens, Deonna M., et al.
Pubblicazione: (2024)
di: Owens, Deonna M., et al.
Pubblicazione: (2024)
Federated Combinatorial Multi-Agent Multi-Armed Bandits
di: Fourati, Fares, et al.
Pubblicazione: (2024)
di: Fourati, Fares, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Contextual Budget Bandit for Food Rescue Volunteer Engagement
di: Tang, Ariana, et al.
Pubblicazione: (2025) -
Healthcare LLM Benchmarks Are Only as Good as Their Explicit Assumptions
di: Raman, Naveen, et al.
Pubblicazione: (2026) -
IRL for Restless Multi-Armed Bandits with Applications in Maternal and Child Health
di: Jain, Gauri, et al.
Pubblicazione: (2024) -
Optimizing Urban Service Allocation with Time-Constrained Restless Bandits
di: Mao, Yi, et al.
Pubblicazione: (2025) -
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
di: Xiong, Guojun, et al.
Pubblicazione: (2024)