Improved Regret Bounds for Linear Bandits with Heavy-Tailed Rewards
Fuente:
arXiv
Salvato in:
| Autori principali: | Tajdini, Artin, Scarlett, Jonathan, Jamieson, Kevin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Regret Bounds for Noise-Free Cascaded Kernelized Bandits
di: Li, Zihan, et al.
Pubblicazione: (2022)
di: Li, Zihan, et al.
Pubblicazione: (2022)
Nearly Minimax Optimal Submodular Maximization with Bandit Feedback
di: Tajdini, Artin, et al.
Pubblicazione: (2023)
di: Tajdini, Artin, et al.
Pubblicazione: (2023)
Tight Regret Bounds for Bayesian Optimization in One Dimension
di: Scarlett, Jonathan
Pubblicazione: (2018)
di: Scarlett, Jonathan
Pubblicazione: (2018)
Regret Tail Characterization of Optimal Bandit Algorithms with Generic Rewards
di: Panda, Subhodip, et al.
Pubblicazione: (2026)
di: Panda, Subhodip, et al.
Pubblicazione: (2026)
Lower Bounds for Time-Varying Kernelized Bandits
di: Cai, Xu, et al.
Pubblicazione: (2024)
di: Cai, Xu, et al.
Pubblicazione: (2024)
Quantile Multi-Armed Bandits with 1-bit Feedback
di: Lau, Ivan, et al.
Pubblicazione: (2025)
di: Lau, Ivan, et al.
Pubblicazione: (2025)
Learning to Incentivize in Repeated Principal-Agent Problems with Adversarial Agent Arrivals
di: Liu, Junyan, et al.
Pubblicazione: (2025)
di: Liu, Junyan, et al.
Pubblicazione: (2025)
Batched Kernelized Bandits: Refinements and Extensions
di: Ma, Chenkai, et al.
Pubblicazione: (2026)
di: Ma, Chenkai, et al.
Pubblicazione: (2026)
Order-Optimal Sequential 1-Bit Mean Estimation in General Tail Regimes
di: Lau, Ivan, et al.
Pubblicazione: (2026)
di: Lau, Ivan, et al.
Pubblicazione: (2026)
Near-Optimal Regret in Adversarial Kernel Bandits
di: Zhang, Yu-Jie, et al.
Pubblicazione: (2026)
di: Zhang, Yu-Jie, et al.
Pubblicazione: (2026)
Corruption-Robust Linear Bandits: Minimax Optimality and Gap-Dependent Misspecification
di: Liu, Haolin, et al.
Pubblicazione: (2024)
di: Liu, Haolin, et al.
Pubblicazione: (2024)
Asymptotically and Minimax Optimal Regret Bounds for Multi-Armed Bandits with Abstention
di: Yang, Junwen, et al.
Pubblicazione: (2024)
di: Yang, Junwen, et al.
Pubblicazione: (2024)
Online Prediction of Stochastic Sequences with High Probability Regret Bounds
di: Frey, Matthias, et al.
Pubblicazione: (2026)
di: Frey, Matthias, et al.
Pubblicazione: (2026)
Improved Offline Contextual Bandits with Second-Order Bounds: Betting and Freezing
di: Ryu, J. Jon, et al.
Pubblicazione: (2025)
di: Ryu, J. Jon, et al.
Pubblicazione: (2025)
Sequential 1-bit Mean Estimation with Near-Optimal Sample Complexity
di: Lau, Ivan, et al.
Pubblicazione: (2025)
di: Lau, Ivan, et al.
Pubblicazione: (2025)
Restless Linear Bandits
di: Khaleghi, Azadeh
Pubblicazione: (2024)
di: Khaleghi, Azadeh
Pubblicazione: (2024)
Concomitant Group Testing
di: Bui, Thach V., et al.
Pubblicazione: (2023)
di: Bui, Thach V., et al.
Pubblicazione: (2023)
Optimal Regret of Bernoulli Bandits under Global Differential Privacy
di: Azize, Achraf, et al.
Pubblicazione: (2025)
di: Azize, Achraf, et al.
Pubblicazione: (2025)
On the Benefits of Free Exploration for Regret Minimization in Multi-Armed Bandits
di: Hou, Yunlong, et al.
Pubblicazione: (2026)
di: Hou, Yunlong, et al.
Pubblicazione: (2026)
Information-Theoretic Minimax Regret Bounds for Reinforcement Learning based on Duality
di: Bongole, Raghav, et al.
Pubblicazione: (2024)
di: Bongole, Raghav, et al.
Pubblicazione: (2024)
Sub-linear Regret Bounds for Bayesian Optimisation in Unknown Search Spaces
di: Tran-The, Hung, et al.
Pubblicazione: (2020)
di: Tran-The, Hung, et al.
Pubblicazione: (2020)
Conversational Dueling Bandits in Generalized Linear Models
di: Yang, Shuhua, et al.
Pubblicazione: (2024)
di: Yang, Shuhua, et al.
Pubblicazione: (2024)
A Method For Bounding Tail Probabilities
di: Zlatanov, Nikola
Pubblicazione: (2024)
di: Zlatanov, Nikola
Pubblicazione: (2024)
A General Framework for Clustering and Distribution Matching with Bandit Feedback
di: Yavas, Recep Can, et al.
Pubblicazione: (2024)
di: Yavas, Recep Can, et al.
Pubblicazione: (2024)
Statistical Mean Estimation with Coded Relayed Observations
di: Ling, Yan Hao, et al.
Pubblicazione: (2025)
di: Ling, Yan Hao, et al.
Pubblicazione: (2025)
Order Optimal Regret Bounds for Sharpe Ratio Optimization under Thompson Sampling
di: Shah, Mohammad Taha, et al.
Pubblicazione: (2025)
di: Shah, Mohammad Taha, et al.
Pubblicazione: (2025)
Data-Driven Upper Confidence Bounds with Near-Optimal Regret for Heavy-Tailed Bandits
di: Tamás, Ambrus, et al.
Pubblicazione: (2024)
di: Tamás, Ambrus, et al.
Pubblicazione: (2024)
Improved Regret Bounds for Online Fair Division with Bandit Learning
di: Schiffer, Benjamin, et al.
Pubblicazione: (2025)
di: Schiffer, Benjamin, et al.
Pubblicazione: (2025)
A Fast Binary Splitting Approach for Non-Adaptive Learning of Erdős--Rényi Graphs
di: Ta, Hoang, et al.
Pubblicazione: (2025)
di: Ta, Hoang, et al.
Pubblicazione: (2025)
Indexed Minimum Empirical Divergence-Based Algorithms for Linear Bandits
di: Bian, Jie, et al.
Pubblicazione: (2024)
di: Bian, Jie, et al.
Pubblicazione: (2024)
Optimal Variance-Dependent Regret Bounds for Infinite-Horizon MDPs
di: Zamir, Guy, et al.
Pubblicazione: (2026)
di: Zamir, Guy, et al.
Pubblicazione: (2026)
Avoiding the Price of Adaptivity: Inference in Linear Contextual Bandits via Stability
di: Praharaj, Samya, et al.
Pubblicazione: (2025)
di: Praharaj, Samya, et al.
Pubblicazione: (2025)
Multimodal Bandits: Regret Lower Bounds and Optimal Algorithms
di: Réveillard, William, et al.
Pubblicazione: (2025)
di: Réveillard, William, et al.
Pubblicazione: (2025)
A Distribution Testing Approach to Clustering Distributions
di: Kumar, Gunjan, et al.
Pubblicazione: (2025)
di: Kumar, Gunjan, et al.
Pubblicazione: (2025)
$(ε, u)$-Adaptive Regret Minimization in Heavy-Tailed Bandits
di: Genalti, Gianmarco, et al.
Pubblicazione: (2023)
di: Genalti, Gianmarco, et al.
Pubblicazione: (2023)
Assouad, Fano, and Le Cam with Interaction: A Unifying Lower Bound Framework and Characterization for Bandit Learnability
di: Chen, Fan, et al.
Pubblicazione: (2024)
di: Chen, Fan, et al.
Pubblicazione: (2024)
On the Regret of Coded Caching with Adversarial Requests
di: Nayak, Anupam, et al.
Pubblicazione: (2024)
di: Nayak, Anupam, et al.
Pubblicazione: (2024)
Best Arm Identification with Minimal Regret
di: Yang, Junwen, et al.
Pubblicazione: (2024)
di: Yang, Junwen, et al.
Pubblicazione: (2024)
Envy-Free Allocation of Indivisible Goods via Noisy Queries
di: Li, Zihan, et al.
Pubblicazione: (2026)
di: Li, Zihan, et al.
Pubblicazione: (2026)
Regret Distribution in Stochastic Bandits: Optimal Trade-off between Expectation and Tail Risk
di: Simchi-Levi, David, et al.
Pubblicazione: (2023)
di: Simchi-Levi, David, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Regret Bounds for Noise-Free Cascaded Kernelized Bandits
di: Li, Zihan, et al.
Pubblicazione: (2022) -
Nearly Minimax Optimal Submodular Maximization with Bandit Feedback
di: Tajdini, Artin, et al.
Pubblicazione: (2023) -
Tight Regret Bounds for Bayesian Optimization in One Dimension
di: Scarlett, Jonathan
Pubblicazione: (2018) -
Regret Tail Characterization of Optimal Bandit Algorithms with Generic Rewards
di: Panda, Subhodip, et al.
Pubblicazione: (2026) -
Lower Bounds for Time-Varying Kernelized Bandits
di: Cai, Xu, et al.
Pubblicazione: (2024)