Optimal Batched Linear Bandits
Fuente:
arXiv
Salvato in:
| Autori principali: | Ren, Xuanfei, Jin, Tianyuan, Xu, Pan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Batched Nonparametric Contextual Bandits
di: Jiang, Rong, et al.
Pubblicazione: (2024)
di: Jiang, Rong, et al.
Pubblicazione: (2024)
Minimax Rate-Optimal Algorithms for High-Dimensional Stochastic Linear Bandits
di: Liu, Jingyu, et al.
Pubblicazione: (2025)
di: Liu, Jingyu, et al.
Pubblicazione: (2025)
The Adaptivity Barrier in Batched Nonparametric Bandits: Sharp Characterization of the Price of Unknown Margin
di: Jiang, Rong, et al.
Pubblicazione: (2025)
di: Jiang, Rong, et al.
Pubblicazione: (2025)
Testing the Feasibility of Linear Programs with Bandit Feedback
di: Gangrade, Aditya, et al.
Pubblicazione: (2024)
di: Gangrade, Aditya, et al.
Pubblicazione: (2024)
Truncated LinUCB for Stochastic Linear Bandits
di: Song, Yanglei, et al.
Pubblicazione: (2022)
di: Song, Yanglei, et al.
Pubblicazione: (2022)
Navigating Sparsities in High-Dimensional Linear Contextual Bandits
di: Zhao, Rui, et al.
Pubblicazione: (2025)
di: Zhao, Rui, et al.
Pubblicazione: (2025)
Multimodal Bandits: Regret Lower Bounds and Optimal Algorithms
di: Réveillard, William, et al.
Pubblicazione: (2025)
di: Réveillard, William, et al.
Pubblicazione: (2025)
Asymptotically Optimal Problem-Dependent Bandit Policies for Transfer Learning
di: Prevost, Adrien, et al.
Pubblicazione: (2025)
di: Prevost, Adrien, et al.
Pubblicazione: (2025)
On Instability of Minimax Optimal Optimism-Based Bandit Algorithms
di: Praharaj, Samya, et al.
Pubblicazione: (2025)
di: Praharaj, Samya, et al.
Pubblicazione: (2025)
FLIPHAT: Joint Differential Privacy for High Dimensional Sparse Linear Bandits
di: Chakraborty, Sunrit, et al.
Pubblicazione: (2024)
di: Chakraborty, Sunrit, et al.
Pubblicazione: (2024)
Towards Efficient and Optimal Covariance-Adaptive Algorithms for Combinatorial Semi-Bandits
di: Zhou, Julien, et al.
Pubblicazione: (2024)
di: Zhou, Julien, et al.
Pubblicazione: (2024)
Batches Stabilize the Minimum Norm Risk in High Dimensional Overparameterized Linear Regression
di: Ioushua, Shahar Stein, et al.
Pubblicazione: (2023)
di: Ioushua, Shahar Stein, et al.
Pubblicazione: (2023)
Statistical Complexity and Optimal Algorithms for Non-linear Ridge Bandits
di: Rajaraman, Nived, et al.
Pubblicazione: (2023)
di: Rajaraman, Nived, et al.
Pubblicazione: (2023)
Avoiding the Price of Adaptivity: Inference in Linear Contextual Bandits via Stability
di: Praharaj, Samya, et al.
Pubblicazione: (2025)
di: Praharaj, Samya, et al.
Pubblicazione: (2025)
Multi-Armed Bandits With Machine Learning-Generated Surrogate Rewards
di: Ji, Wenlong, et al.
Pubblicazione: (2025)
di: Ji, Wenlong, et al.
Pubblicazione: (2025)
Multitask Learning and Bandits via Robust Statistics
di: Xu, Kan, et al.
Pubblicazione: (2021)
di: Xu, Kan, et al.
Pubblicazione: (2021)
A Simple and Optimal Policy Design with Safety against Heavy-Tailed Risk for Stochastic Bandits
di: Simchi-Levi, David, et al.
Pubblicazione: (2022)
di: Simchi-Levi, David, et al.
Pubblicazione: (2022)
Online Covariance Estimation in Averaged SGD: Improved Batch-Mean Rates and Minimax Optimality via Trajectory Regression
di: Ni, Yijin, et al.
Pubblicazione: (2026)
di: Ni, Yijin, et al.
Pubblicazione: (2026)
Upper Counterfactual Confidence Bounds: a New Optimism Principle for Contextual Bandits
di: Xu, Yunbei, et al.
Pubblicazione: (2020)
di: Xu, Yunbei, et al.
Pubblicazione: (2020)
Near-Optimal Regret for KL-Regularized Multi-Armed Bandits
di: Ji, Kaixuan, et al.
Pubblicazione: (2026)
di: Ji, Kaixuan, et al.
Pubblicazione: (2026)
Regret Distribution in Stochastic Bandits: Optimal Trade-off between Expectation and Tail Risk
di: Simchi-Levi, David, et al.
Pubblicazione: (2023)
di: Simchi-Levi, David, et al.
Pubblicazione: (2023)
$L^1$ Estimation: On the Optimality of Linear Estimators
di: Barnes, Leighton P., et al.
Pubblicazione: (2023)
di: Barnes, Leighton P., et al.
Pubblicazione: (2023)
Batch List-Decodable Linear Regression via Higher Moments
di: Diakonikolas, Ilias, et al.
Pubblicazione: (2025)
di: Diakonikolas, Ilias, et al.
Pubblicazione: (2025)
Optimal Regret of Bernoulli Bandits under Global Differential Privacy
di: Azize, Achraf, et al.
Pubblicazione: (2025)
di: Azize, Achraf, et al.
Pubblicazione: (2025)
The Fragility of Optimized Bandit Algorithms
di: Fan, Lin, et al.
Pubblicazione: (2021)
di: Fan, Lin, et al.
Pubblicazione: (2021)
On the Optimal Sample Complexity of Offline Multi-Armed Bandits with KL Regularization
di: Ji, Kaixuan, et al.
Pubblicazione: (2026)
di: Ji, Kaixuan, et al.
Pubblicazione: (2026)
Adaptive Smooth Non-Stationary Bandits
di: Suk, Joe
Pubblicazione: (2024)
di: Suk, Joe
Pubblicazione: (2024)
Enjoying Non-linearity in Multinomial Logistic Bandits: A Minimax-Optimal Algorithm
di: Boudart, Pierre, et al.
Pubblicazione: (2025)
di: Boudart, Pierre, et al.
Pubblicazione: (2025)
Transfer Learning for Contextual Multi-armed Bandits
di: Cai, Changxiao, et al.
Pubblicazione: (2022)
di: Cai, Changxiao, et al.
Pubblicazione: (2022)
Batched Single-Index Global Multi-Armed Bandits with Covariates
di: Arya, Sakshi, et al.
Pubblicazione: (2025)
di: Arya, Sakshi, et al.
Pubblicazione: (2025)
Optimal Excess Risk Bounds for Empirical Risk Minimization on $p$-Norm Linear Regression
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2023)
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2023)
Design Experiments to Compare Multi-armed Bandit Algorithms
di: Meng, Huiling, et al.
Pubblicazione: (2026)
di: Meng, Huiling, et al.
Pubblicazione: (2026)
Asymptotically and Minimax Optimal Regret Bounds for Multi-Armed Bandits with Abstention
di: Yang, Junwen, et al.
Pubblicazione: (2024)
di: Yang, Junwen, et al.
Pubblicazione: (2024)
High-Probability Minimax Adaptive Estimation in Besov Spaces via Online-to-Batch
di: Liautaud, Paul, et al.
Pubblicazione: (2026)
di: Liautaud, Paul, et al.
Pubblicazione: (2026)
Online Clustering of Data Sequences with Bandit Information
di: Chandran, G Dhinesh, et al.
Pubblicazione: (2025)
di: Chandran, G Dhinesh, et al.
Pubblicazione: (2025)
Optimal training-conditional regret for online conformal prediction
di: Liang, Jiadong, et al.
Pubblicazione: (2026)
di: Liang, Jiadong, et al.
Pubblicazione: (2026)
Locally Near Optimal Piecewise Linear Regression in High Dimensions via Difference of Max-Affine Functions
di: Kanj, Haitham, et al.
Pubblicazione: (2026)
di: Kanj, Haitham, et al.
Pubblicazione: (2026)
Optimal Ridge Regularization for Out-of-Distribution Prediction
di: Patil, Pratik, et al.
Pubblicazione: (2024)
di: Patil, Pratik, et al.
Pubblicazione: (2024)
The Sample Complexity of Multiple Change Point Identification under Bandit Feedback
di: Graf, Maximilian, et al.
Pubblicazione: (2026)
di: Graf, Maximilian, et al.
Pubblicazione: (2026)
Locally Optimal Fixed-Budget Best Arm Identification in Two-Armed Gaussian Bandits with Unknown Variances
di: Kato, Masahiro
Pubblicazione: (2023)
di: Kato, Masahiro
Pubblicazione: (2023)
Documenti analoghi
-
Batched Nonparametric Contextual Bandits
di: Jiang, Rong, et al.
Pubblicazione: (2024) -
Minimax Rate-Optimal Algorithms for High-Dimensional Stochastic Linear Bandits
di: Liu, Jingyu, et al.
Pubblicazione: (2025) -
The Adaptivity Barrier in Batched Nonparametric Bandits: Sharp Characterization of the Price of Unknown Margin
di: Jiang, Rong, et al.
Pubblicazione: (2025) -
Testing the Feasibility of Linear Programs with Bandit Feedback
di: Gangrade, Aditya, et al.
Pubblicazione: (2024) -
Truncated LinUCB for Stochastic Linear Bandits
di: Song, Yanglei, et al.
Pubblicazione: (2022)