Worst-Case Regret Bounds for Combinatorial Thompson Sampling in Sleeping Semi-Bandits
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Zhiming, Hu, Bingshan, Pan, Jianping |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Connecting Thompson Sampling and UCB: Towards More Efficient Trade-offs Between Privacy and Regret
di: Hu, Bingshan, et al.
Pubblicazione: (2025)
di: Hu, Bingshan, et al.
Pubblicazione: (2025)
Thompson Sampling For Combinatorial Bandits: Polynomial Regret and Mismatched Sampling Paradox
di: Zhang, Raymond, et al.
Pubblicazione: (2024)
di: Zhang, Raymond, et al.
Pubblicazione: (2024)
Efficient and Adaptive Posterior Sampling Algorithms for Bandits
di: Hu, Bingshan, et al.
Pubblicazione: (2024)
di: Hu, Bingshan, et al.
Pubblicazione: (2024)
On Regret Bounds of Thompson Sampling for Bayesian Optimization
di: Takeno, Shion, et al.
Pubblicazione: (2026)
di: Takeno, Shion, et al.
Pubblicazione: (2026)
Near-optimal Per-Action Regret Bounds for Sleeping Bandits
di: Nguyen, Quan, et al.
Pubblicazione: (2024)
di: Nguyen, Quan, et al.
Pubblicazione: (2024)
Near-Optimal Regret for Efficient Stochastic Combinatorial Semi-Bandits
di: Ye, Zichun, et al.
Pubblicazione: (2025)
di: Ye, Zichun, et al.
Pubblicazione: (2025)
Batch-Size Independent Regret Bounds for Combinatorial Semi-Bandits with Probabilistically Triggered Arms or Independent Arms
di: Liu, Xutong, et al.
Pubblicazione: (2022)
di: Liu, Xutong, et al.
Pubblicazione: (2022)
Thompson Sampling for Stochastic Bandits with Noisy Contexts: An Information-Theoretic Regret Analysis
di: Jose, Sharu Theresa, et al.
Pubblicazione: (2024)
di: Jose, Sharu Theresa, et al.
Pubblicazione: (2024)
Modified Meta-Thompson Sampling for Linear Bandits and Its Bayes Regret Analysis
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Improved Bayesian Regret Bounds for Thompson Sampling in Reinforcement Learning
di: Moradipari, Ahmadreza, et al.
Pubblicazione: (2023)
di: Moradipari, Ahmadreza, et al.
Pubblicazione: (2023)
Efficient Swap Regret Minimization in Combinatorial Bandits
di: Kontogiannis, Andreas, et al.
Pubblicazione: (2026)
di: Kontogiannis, Andreas, et al.
Pubblicazione: (2026)
Beyond Worst-Case Online Classification: VC-Based Regret Bounds for Relaxed Benchmarks
di: Montasser, Omar, et al.
Pubblicazione: (2025)
di: Montasser, Omar, et al.
Pubblicazione: (2025)
Worst-Case Regret Bounds for Exploration via Randomized Value Functions
di: Russo, Daniel
Pubblicazione: (2019)
di: Russo, Daniel
Pubblicazione: (2019)
Regret Analysis of Sleeping Competing Bandits
di: Uba, Shinnosuke, et al.
Pubblicazione: (2026)
di: Uba, Shinnosuke, et al.
Pubblicazione: (2026)
Order Optimal Regret Bounds for Sharpe Ratio Optimization under Thompson Sampling
di: Shah, Mohammad Taha, et al.
Pubblicazione: (2025)
di: Shah, Mohammad Taha, et al.
Pubblicazione: (2025)
Oracle-Efficient Combinatorial Semi-Bandits
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
Near-Optimal Algorithms for Differentially Private Online Learning in a Stochastic Environment
di: Hu, Bingshan, et al.
Pubblicazione: (2021)
di: Hu, Bingshan, et al.
Pubblicazione: (2021)
Improved Regret Bounds for Bandits with Expert Advice
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
Thompson Sampling in Partially Observable Contextual Bandits
di: Park, Hongju, et al.
Pubblicazione: (2024)
di: Park, Hongju, et al.
Pubblicazione: (2024)
Multi-Play Combinatorial Semi-Bandit Problem
di: Nakamura, Shintaro, et al.
Pubblicazione: (2025)
di: Nakamura, Shintaro, et al.
Pubblicazione: (2025)
From Contextual Combinatorial Semi-Bandits to Bandit List Classification: Improved Sample Complexity with Sparse Rewards
di: Erez, Liad, et al.
Pubblicazione: (2025)
di: Erez, Liad, et al.
Pubblicazione: (2025)
Queue Length Regret Bounds for Contextual Queueing Bandits
di: Bae, Seoungbin, et al.
Pubblicazione: (2026)
di: Bae, Seoungbin, et al.
Pubblicazione: (2026)
Information Capacity Regret Bounds for Bandits with Mediator Feedback
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)
di: Eldowa, Khaled, et al.
Pubblicazione: (2024)
Thompson Sampling for Multi-Objective Linear Contextual Bandit
di: Park, Somangchan, et al.
Pubblicazione: (2025)
di: Park, Somangchan, et al.
Pubblicazione: (2025)
An Information-Theoretic Analysis of Thompson Sampling for Logistic Bandits
di: Gouverneur, Amaury, et al.
Pubblicazione: (2024)
di: Gouverneur, Amaury, et al.
Pubblicazione: (2024)
Thompson Sampling-like Algorithms for Stochastic Rising Bandits
di: Fiandri, Marco, et al.
Pubblicazione: (2025)
di: Fiandri, Marco, et al.
Pubblicazione: (2025)
Improved Regret Bounds of (Multinomial) Logistic Bandits via Regret-to-Confidence-Set Conversion
di: Lee, Junghyun, et al.
Pubblicazione: (2023)
di: Lee, Junghyun, et al.
Pubblicazione: (2023)
Graph-Dependent Regret Bounds in Multi-Armed Bandits with Interference
di: Jamshidi, Fateme, et al.
Pubblicazione: (2025)
di: Jamshidi, Fateme, et al.
Pubblicazione: (2025)
Provably Efficient Exploration in Quantum Reinforcement Learning with Logarithmic Worst-Case Regret
di: Zhong, Han, et al.
Pubblicazione: (2023)
di: Zhong, Han, et al.
Pubblicazione: (2023)
Adaptive Prior Selection in Gaussian Process Bandits with Thompson Sampling
di: Sandberg, Jack, et al.
Pubblicazione: (2025)
di: Sandberg, Jack, et al.
Pubblicazione: (2025)
FedRTS: Federated Robust Pruning via Combinatorial Thompson Sampling
di: Huang, Hong, et al.
Pubblicazione: (2025)
di: Huang, Hong, et al.
Pubblicazione: (2025)
Multimodal Bandits: Regret Lower Bounds and Optimal Algorithms
di: Réveillard, William, et al.
Pubblicazione: (2025)
di: Réveillard, William, et al.
Pubblicazione: (2025)
Regret Bounds for Noise-Free Cascaded Kernelized Bandits
di: Li, Zihan, et al.
Pubblicazione: (2022)
di: Li, Zihan, et al.
Pubblicazione: (2022)
Variance-Dependent Regret Lower Bounds for Contextual Bandits
di: He, Jiafan, et al.
Pubblicazione: (2025)
di: He, Jiafan, et al.
Pubblicazione: (2025)
Note on Follow-the-Perturbed-Leader in Combinatorial Semi-Bandit Problems
di: Chen, Botao, et al.
Pubblicazione: (2025)
di: Chen, Botao, et al.
Pubblicazione: (2025)
Feel-Good Thompson Sampling for Contextual Dueling Bandits
di: Li, Xuheng, et al.
Pubblicazione: (2024)
di: Li, Xuheng, et al.
Pubblicazione: (2024)
No-Regret Thompson Sampling for Finite-Horizon Markov Decision Processes with Gaussian Processes
di: Bayrooti, Jasmine, et al.
Pubblicazione: (2025)
di: Bayrooti, Jasmine, et al.
Pubblicazione: (2025)
Optimistic Thompson Sampling for No-Regret Learning in Unknown Games
di: Li, Yingru, et al.
Pubblicazione: (2024)
di: Li, Yingru, et al.
Pubblicazione: (2024)
Variance-Dependent Regret Bounds for Non-stationary Linear Bandits
di: Wang, Zhiyong, et al.
Pubblicazione: (2024)
di: Wang, Zhiyong, et al.
Pubblicazione: (2024)
Variance-Aware Regret Bounds for Stochastic Contextual Dueling Bandits
di: Di, Qiwei, et al.
Pubblicazione: (2023)
di: Di, Qiwei, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Connecting Thompson Sampling and UCB: Towards More Efficient Trade-offs Between Privacy and Regret
di: Hu, Bingshan, et al.
Pubblicazione: (2025) -
Thompson Sampling For Combinatorial Bandits: Polynomial Regret and Mismatched Sampling Paradox
di: Zhang, Raymond, et al.
Pubblicazione: (2024) -
Efficient and Adaptive Posterior Sampling Algorithms for Bandits
di: Hu, Bingshan, et al.
Pubblicazione: (2024) -
On Regret Bounds of Thompson Sampling for Bayesian Optimization
di: Takeno, Shion, et al.
Pubblicazione: (2026) -
Near-optimal Per-Action Regret Bounds for Sleeping Bandits
di: Nguyen, Quan, et al.
Pubblicazione: (2024)