MARBLE: Multi-Armed Restless Bandits in Latent Markovian Environment
Fuente:
arXiv
Salvato in:
| Autori principali: | Amiri, Mohsen, Avrachenkov, Konstantin, Mimouni, Ibtihal El, Magnússon, Sindri |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Challenger-Based Combinatorial Bandits for Subcarrier Selection in OFDM Systems
di: Amiri, Mohsen, et al.
Pubblicazione: (2025)
di: Amiri, Mohsen, et al.
Pubblicazione: (2025)
Reinforcement Learning in Switching Non-Stationary Markov Decision Processes: Algorithms and Convergence Analysis
di: Amiri, Mohsen, et al.
Pubblicazione: (2025)
di: Amiri, Mohsen, et al.
Pubblicazione: (2025)
Adaptive Budgeted Multi-Armed Bandits for IoT with Dynamic Resource Constraints
di: Vaishnav, Shubham, et al.
Pubblicazione: (2025)
di: Vaishnav, Shubham, et al.
Pubblicazione: (2025)
Lagrangian Index Policy for Restless Bandits with Average Reward
di: Avrachenkov, Konstantin, et al.
Pubblicazione: (2024)
di: Avrachenkov, Konstantin, et al.
Pubblicazione: (2024)
PriPG-RL: Privileged Planner-Guided Reinforcement Learning for Partially Observable Systems with Anytime-Feasible MPC
di: Amiri, Mohsen, et al.
Pubblicazione: (2026)
di: Amiri, Mohsen, et al.
Pubblicazione: (2026)
Global Rewards in Restless Multi-Armed Bandits
di: Raman, Naveen, et al.
Pubblicazione: (2024)
di: Raman, Naveen, et al.
Pubblicazione: (2024)
Non-Stationary Restless Multi-Armed Bandits with Provable Guarantee
di: Hung, Yu-Heng, et al.
Pubblicazione: (2025)
di: Hung, Yu-Heng, et al.
Pubblicazione: (2025)
IRL for Restless Multi-Armed Bandits with Applications in Maternal and Child Health
di: Jain, Gauri, et al.
Pubblicazione: (2024)
di: Jain, Gauri, et al.
Pubblicazione: (2024)
Human-Inspired Framework to Accelerate Reinforcement Learning
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2023)
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2023)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
Parallel Momentum Methods Under Biased Gradient Estimations
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2024)
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2024)
The Unreasonable Effectiveness of Greedy Algorithms in Multi-Armed Bandit with Many Arms
di: Bayati, Mohsen, et al.
Pubblicazione: (2020)
di: Bayati, Mohsen, et al.
Pubblicazione: (2020)
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
di: Behari, Nikhil, et al.
Pubblicazione: (2024)
di: Behari, Nikhil, et al.
Pubblicazione: (2024)
Distributed Learning in Markovian Restless Bandits over Interference Graphs for Stable Spectrum Sharing
di: Didi, Liad Lea, et al.
Pubblicazione: (2025)
di: Didi, Liad Lea, et al.
Pubblicazione: (2025)
Annealed Softmax Greedy in Many-Armed Bayesian Bandits
di: Overman, William, et al.
Pubblicazione: (2026)
di: Overman, William, et al.
Pubblicazione: (2026)
Multi-Armed Bandits with Interference
di: Jia, Su, et al.
Pubblicazione: (2024)
di: Jia, Su, et al.
Pubblicazione: (2024)
Imprecise Multi-Armed Bandits
di: Kosoy, Vanessa
Pubblicazione: (2024)
di: Kosoy, Vanessa
Pubblicazione: (2024)
On the Convergence of Federated Learning Algorithms without Data Similarity
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2024)
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2024)
Restless Linear Bandits
di: Khaleghi, Azadeh
Pubblicazione: (2024)
di: Khaleghi, Azadeh
Pubblicazione: (2024)
Fairness of Exposure in Online Restless Multi-armed Bandits
di: Sood, Archit, et al.
Pubblicazione: (2024)
di: Sood, Archit, et al.
Pubblicazione: (2024)
Collaborative Value Function Estimation Under Model Mismatch: A Federated Temporal Difference Analysis
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2025)
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2025)
Decisions and Deployment: The Five-Year SAHELI Project (2020-2025) on Restless Multi-Armed Bandits for Improving Maternal and Child Health
di: Verma, Shresth, et al.
Pubblicazione: (2026)
di: Verma, Shresth, et al.
Pubblicazione: (2026)
Multi-Armed Bandits with Minimum Aggregated Revenue Constraints
di: Yahmed, Ahmed Ben, et al.
Pubblicazione: (2025)
di: Yahmed, Ahmed Ben, et al.
Pubblicazione: (2025)
Compressed Federated Reinforcement Learning with a Generative Model
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2024)
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2024)
Dynamic and Distributed Routing in IoT Networks based on Multi-Objective Q-Learning
di: Vaishnav, Shubham, et al.
Pubblicazione: (2025)
di: Vaishnav, Shubham, et al.
Pubblicazione: (2025)
Flickering Multi-Armed Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
The Bandit Whisperer: Communication Learning for Restless Bandits
di: Zhao, Yunfan, et al.
Pubblicazione: (2024)
di: Zhao, Yunfan, et al.
Pubblicazione: (2024)
Networked Restless Multi-Arm Bandits with Reinforcement Learning
di: Zhang, Hanmo, et al.
Pubblicazione: (2025)
di: Zhang, Hanmo, et al.
Pubblicazione: (2025)
Multi-Armed Bandits with Network Interference
di: Agarwal, Abhineet, et al.
Pubblicazione: (2024)
di: Agarwal, Abhineet, et al.
Pubblicazione: (2024)
Asynchronous Distributed Optimization with Delay-free Parameters
di: Wu, Xuyang, et al.
Pubblicazione: (2023)
di: Wu, Xuyang, et al.
Pubblicazione: (2023)
On the Regularity and Fairness of Combinatorial Multi-Armed Bandit
di: Wu, Xiaoyi, et al.
Pubblicazione: (2025)
di: Wu, Xiaoyi, et al.
Pubblicazione: (2025)
Rising Multi-Armed Bandits with Known Horizons
di: Song, Seockbean, et al.
Pubblicazione: (2026)
di: Song, Seockbean, et al.
Pubblicazione: (2026)
Collaborating in Multi-Armed Bandits with Strategic Agents
di: Barnea, Idan, et al.
Pubblicazione: (2026)
di: Barnea, Idan, et al.
Pubblicazione: (2026)
Optimal Streaming Algorithms for Multi-Armed Bandits
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
Neural Index Policies for Restless Multi-Action Bandits with Heterogeneous Budgets
di: Pandey, Himadri S., et al.
Pubblicazione: (2025)
di: Pandey, Himadri S., et al.
Pubblicazione: (2025)
Introduction to Multi-Armed Bandits
di: Slivkins, Aleksandrs
Pubblicazione: (2019)
di: Slivkins, Aleksandrs
Pubblicazione: (2019)
Autonomous Drug Design with Multi-Armed Bandits
di: Svensson, Hampus Gummesson, et al.
Pubblicazione: (2022)
di: Svensson, Hampus Gummesson, et al.
Pubblicazione: (2022)
Distributed Algorithms for Multi-Agent Multi-Armed Bandits with Collision
di: Zhou, Daoyuan, et al.
Pubblicazione: (2025)
di: Zhou, Daoyuan, et al.
Pubblicazione: (2025)
Stochastic Multi-Armed Bandits with Limited Control Variates
di: Verma, Arun, et al.
Pubblicazione: (2026)
di: Verma, Arun, et al.
Pubblicazione: (2026)
Optimism in the Face of Ambiguity Principle for Multi-Armed Bandits
di: Li, Mengmeng, et al.
Pubblicazione: (2024)
di: Li, Mengmeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Challenger-Based Combinatorial Bandits for Subcarrier Selection in OFDM Systems
di: Amiri, Mohsen, et al.
Pubblicazione: (2025) -
Reinforcement Learning in Switching Non-Stationary Markov Decision Processes: Algorithms and Convergence Analysis
di: Amiri, Mohsen, et al.
Pubblicazione: (2025) -
Adaptive Budgeted Multi-Armed Bandits for IoT with Dynamic Resource Constraints
di: Vaishnav, Shubham, et al.
Pubblicazione: (2025) -
Lagrangian Index Policy for Restless Bandits with Average Reward
di: Avrachenkov, Konstantin, et al.
Pubblicazione: (2024) -
PriPG-RL: Privileged Planner-Guided Reinforcement Learning for Partially Observable Systems with Anytime-Feasible MPC
di: Amiri, Mohsen, et al.
Pubblicazione: (2026)