Graph Feedback Bandits with Similar Arms
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qi, Han, Fei, Guo, Zhu, Li |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Graph Feedback Bandits on Similar Arms: With and Without Graph Structures
par: Qi, Han, et autres
Publié: (2025)
par: Qi, Han, et autres
Publié: (2025)
Contextual Combinatorial Bandits with Probabilistically Triggered Arms
par: Liu, Xutong, et autres
Publié: (2023)
par: Liu, Xutong, et autres
Publié: (2023)
Blessings of Multiple Good Arms in Multi-Objective Linear Bandits
par: Ann, Heesang, et autres
Publié: (2026)
par: Ann, Heesang, et autres
Publié: (2026)
Hybrid Combinatorial Multi-armed Bandits with Probabilistically Triggered Arms
par: Zhou, Kongchang, et autres
Publié: (2025)
par: Zhou, Kongchang, et autres
Publié: (2025)
Efficient Contextual Bandits with Uninformed Feedback Graphs
par: Zhang, Mengxiao, et autres
Publié: (2024)
par: Zhang, Mengxiao, et autres
Publié: (2024)
Identifying All ε-Best Arms in (Misspecified) Linear Bandits
par: Li, Zhekai, et autres
Publié: (2025)
par: Li, Zhekai, et autres
Publié: (2025)
Batch-Size Independent Regret Bounds for Combinatorial Semi-Bandits with Probabilistically Triggered Arms or Independent Arms
par: Liu, Xutong, et autres
Publié: (2022)
par: Liu, Xutong, et autres
Publié: (2022)
The Unreasonable Effectiveness of Greedy Algorithms in Multi-Armed Bandit with Many Arms
par: Bayati, Mohsen, et autres
Publié: (2020)
par: Bayati, Mohsen, et autres
Publié: (2020)
On-line Learning in Tree MDPs by Treating Policies as Bandit Arms
par: Shah, Anvay, et autres
Publié: (2026)
par: Shah, Anvay, et autres
Publié: (2026)
Quick-Draw Bandits: Quickly Optimizing in Nonstationary Environments with Extremely Many Arms
par: Everett, Derek, et autres
Publié: (2025)
par: Everett, Derek, et autres
Publié: (2025)
Meet Me at the Arm: The Cooperative Multi-Armed Bandits Problem with Shareable Arms
par: Hu, Xinyi, et autres
Publié: (2025)
par: Hu, Xinyi, et autres
Publié: (2025)
Speed Up the Cold-Start Learning in Two-Sided Bandits with Many Arms
par: Bayati, Mohsen, et autres
Publié: (2022)
par: Bayati, Mohsen, et autres
Publié: (2022)
Improved Algorithm for Adversarial Linear Mixture MDPs with Bandit Feedback and Unknown Transition
par: Li, Long-Fei, et autres
Publié: (2024)
par: Li, Long-Fei, et autres
Publié: (2024)
Adversarial Bandits with Multi-User Delayed Feedback: Theory and Application
par: Li, Yandi, et autres
Publié: (2023)
par: Li, Yandi, et autres
Publié: (2023)
Nearest Neighbour with Bandit Feedback
par: Pasteris, Stephen, et autres
Publié: (2023)
par: Pasteris, Stephen, et autres
Publié: (2023)
Biased Dueling Bandits with Stochastic Delayed Feedback
par: Yi, Bongsoo, et autres
Publié: (2024)
par: Yi, Bongsoo, et autres
Publié: (2024)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
par: Goyal, Tanmay, et autres
Publié: (2025)
par: Goyal, Tanmay, et autres
Publié: (2025)
Constrained Feedback Learning for Non-Stationary Multi-Armed Bandits
par: Li, Shaoang, et autres
Publié: (2025)
par: Li, Shaoang, et autres
Publié: (2025)
Queueing Matching Bandits with Preference Feedback
par: Kim, Jung-hun, et autres
Publié: (2024)
par: Kim, Jung-hun, et autres
Publié: (2024)
Nonparametric Kernel Clustering with Bandit Feedback
par: Thuot, Victor, et autres
Publié: (2026)
par: Thuot, Victor, et autres
Publié: (2026)
Lipschitz Bandits with Stochastic Delayed Feedback
par: Liu, Zhongxuan, et autres
Publié: (2025)
par: Liu, Zhongxuan, et autres
Publié: (2025)
Optimal Clustering with Bandit Feedback
par: Yang, Junwen, et autres
Publié: (2022)
par: Yang, Junwen, et autres
Publié: (2022)
Uncertainty of Joint Neural Contextual Bandit
par: Guo, Hongbo, et autres
Publié: (2024)
par: Guo, Hongbo, et autres
Publié: (2024)
Stochastic $k$-Submodular Bandits with Full Bandit Feedback
par: Nie, Guanyu, et autres
Publié: (2024)
par: Nie, Guanyu, et autres
Publié: (2024)
Cascading Bandits With Feedback
par: Prakash, R Sri, et autres
Publié: (2025)
par: Prakash, R Sri, et autres
Publié: (2025)
Learning to Schedule Online Tasks with Bandit Feedback
par: Xu, Yongxin, et autres
Publié: (2024)
par: Xu, Yongxin, et autres
Publié: (2024)
Constrained Pareto Set Identification with Bandit Feedback
par: Kone, Cyrille, et autres
Publié: (2025)
par: Kone, Cyrille, et autres
Publié: (2025)
Beyond Bandit Feedback in Online Multiclass Classification
par: van der Hoeven, Dirk, et autres
Publié: (2021)
par: van der Hoeven, Dirk, et autres
Publié: (2021)
Does Feedback Help in Bandits with Arm Erasures?
par: Karakas, Merve, et autres
Publié: (2025)
par: Karakas, Merve, et autres
Publié: (2025)
Bandit and Delayed Feedback in Online Structured Prediction
par: Shibukawa, Yuki, et autres
Publié: (2025)
par: Shibukawa, Yuki, et autres
Publié: (2025)
Learning Equilibria in Matching Games with Bandit Feedback
par: Athanasopoulos, Andreas, et autres
Publié: (2025)
par: Athanasopoulos, Andreas, et autres
Publié: (2025)
Multiclass Online Learnability under Bandit Feedback
par: Raman, Ananth, et autres
Publié: (2023)
par: Raman, Ananth, et autres
Publié: (2023)
Pure Exploration for a Good Policy in Reinforcement Learning with Bandit Feedback
par: Li, Zitian, et autres
Publié: (2026)
par: Li, Zitian, et autres
Publié: (2026)
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks
par: Biswas, Arpita, et autres
Publié: (2023)
par: Biswas, Arpita, et autres
Publié: (2023)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
par: Xiong, Guojun, et autres
Publié: (2024)
par: Xiong, Guojun, et autres
Publié: (2024)
Stochastic Online Conformal Prediction with Semi-Bandit Feedback
par: Ge, Haosen, et autres
Publié: (2024)
par: Ge, Haosen, et autres
Publié: (2024)
Efficient Online Set-valued Classification with Bandit Feedback
par: Wang, Zhou, et autres
Publié: (2024)
par: Wang, Zhou, et autres
Publié: (2024)
Bandit-Feedback Online Multiclass Classification: Variants and Tradeoffs
par: Filmus, Yuval, et autres
Publié: (2024)
par: Filmus, Yuval, et autres
Publié: (2024)
Improved Regret for Bandit Convex Optimization with Delayed Feedback
par: Wan, Yuanyu, et autres
Publié: (2024)
par: Wan, Yuanyu, et autres
Publié: (2024)
Information Capacity Regret Bounds for Bandits with Mediator Feedback
par: Eldowa, Khaled, et autres
Publié: (2024)
par: Eldowa, Khaled, et autres
Publié: (2024)
Documents similaires
-
Graph Feedback Bandits on Similar Arms: With and Without Graph Structures
par: Qi, Han, et autres
Publié: (2025) -
Contextual Combinatorial Bandits with Probabilistically Triggered Arms
par: Liu, Xutong, et autres
Publié: (2023) -
Blessings of Multiple Good Arms in Multi-Objective Linear Bandits
par: Ann, Heesang, et autres
Publié: (2026) -
Hybrid Combinatorial Multi-armed Bandits with Probabilistically Triggered Arms
par: Zhou, Kongchang, et autres
Publié: (2025) -
Efficient Contextual Bandits with Uninformed Feedback Graphs
par: Zhang, Mengxiao, et autres
Publié: (2024)