Enregistré dans:
| Auteurs principaux: | Shibukawa, Yuki, Tanaka, Koichi, Saito, Yuta, Ito, Shinji |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.07005 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Effective Off-Policy Evaluation and Learning in Contextual Combinatorial Bandits
par: Shimizu, Tatsuhiro, et autres
Publié: (2024)
par: Shimizu, Tatsuhiro, et autres
Publié: (2024)
Influential Bandits: Pulling an Arm May Change the Environment
par: Sato, Ryoma, et autres
Publié: (2025)
par: Sato, Ryoma, et autres
Publié: (2025)
Bandit Max-Min Fair Allocation
par: Harada, Tsubasa, et autres
Publié: (2025)
par: Harada, Tsubasa, et autres
Publié: (2025)
Bandit and Delayed Feedback in Online Structured Prediction
par: Shibukawa, Yuki, et autres
Publié: (2025)
par: Shibukawa, Yuki, et autres
Publié: (2025)
Optimal Arm Elimination Algorithms for Combinatorial Bandits
par: Wen, Yuxiao, et autres
Publié: (2025)
par: Wen, Yuxiao, et autres
Publié: (2025)
New Classes of the Greedy-Applicable Arm Feature Distributions in the Sparse Linear Bandit Problem
par: Ichikawa, Koji, et autres
Publié: (2023)
par: Ichikawa, Koji, et autres
Publié: (2023)
Multi-Task Combinatorial Bandits for Budget Allocation
par: Ge, Lin, et autres
Publié: (2024)
par: Ge, Lin, et autres
Publié: (2024)
LC-Tsallis-INF: Generalized Best-of-Both-Worlds Linear Contextual Bandits
par: Kato, Masahiro, et autres
Publié: (2024)
par: Kato, Masahiro, et autres
Publié: (2024)
Heavy-tailed Linear Bandits: Adversarial Robustness, Best-of-both-worlds, and Beyond
par: Zhao, Canzhe, et autres
Publié: (2025)
par: Zhao, Canzhe, et autres
Publié: (2025)
Replicability is Asymptotically Free in Multi-armed Bandits
par: Komiyama, Junpei, et autres
Publié: (2024)
par: Komiyama, Junpei, et autres
Publié: (2024)
A Tight Lower Bound for Non-stochastic Multi-armed Bandits with Expert Advice
par: Chase, Zachary, et autres
Publié: (2025)
par: Chase, Zachary, et autres
Publié: (2025)
Combinatorial Multi-armed Bandits: Arm Selection via Group Testing
par: Mukherjee, Arpan, et autres
Publié: (2024)
par: Mukherjee, Arpan, et autres
Publié: (2024)
MultiScale Contextual Bandits for Long Term Objectives
par: Rastogi, Richa, et autres
Publié: (2025)
par: Rastogi, Richa, et autres
Publié: (2025)
A Perturbation Approach to Unconstrained Linear Bandits
par: Jacobsen, Andrew, et autres
Publié: (2026)
par: Jacobsen, Andrew, et autres
Publié: (2026)
Off-Policy Evaluation of Slate Bandit Policies via Optimizing Abstraction
par: Kiyohara, Haruka, et autres
Publié: (2024)
par: Kiyohara, Haruka, et autres
Publié: (2024)
Revisiting Follow-the-Perturbed-Leader with Unbounded Perturbations in Bandit Problems
par: Lee, Jongyeong, et autres
Publié: (2025)
par: Lee, Jongyeong, et autres
Publié: (2025)
Prior-Dependent Allocations for Bayesian Fixed-Budget Best-Arm Identification in Structured Bandits
par: Nguyen, Nicolas, et autres
Publié: (2024)
par: Nguyen, Nicolas, et autres
Publié: (2024)
Offline Contextual Bandits in the Presence of New Actions
par: Kishimoto, Ren, et autres
Publié: (2026)
par: Kishimoto, Ren, et autres
Publié: (2026)
Adapting to Stochastic and Adversarial Losses in Episodic MDPs with Aggregate Bandit Feedback
par: Ito, Shinji, et autres
Publié: (2025)
par: Ito, Shinji, et autres
Publié: (2025)
Combinatorial Rising Bandits
par: Song, Seockbean, et autres
Publié: (2024)
par: Song, Seockbean, et autres
Publié: (2024)
Combinatorial Logistic Bandits
par: Liu, Xutong, et autres
Publié: (2024)
par: Liu, Xutong, et autres
Publié: (2024)
Off-Policy Evaluation for Ranking Policies under Deterministic Logging Policies
par: Tanaka, Koichi, et autres
Publié: (2026)
par: Tanaka, Koichi, et autres
Publié: (2026)
Follow-the-Perturbed-Leader with Fréchet-type Tail Distributions: Optimality in Adversarial Bandits and Best-of-Both-Worlds
par: Lee, Jongyeong, et autres
Publié: (2024)
par: Lee, Jongyeong, et autres
Publié: (2024)
Data-dependent Bounds with $T$-Optimal Best-of-Both-Worlds Guarantees in Multi-Armed Bandits using Stability-Penalty Matching
par: Nguyen, Quan, et autres
Publié: (2025)
par: Nguyen, Quan, et autres
Publié: (2025)
Beyond Match Maximization and Fairness: Retention-Optimized Two-Sided Matching
par: Kishimoto, Ren, et autres
Publié: (2026)
par: Kishimoto, Ren, et autres
Publié: (2026)
Off-Policy Learning with Limited Supply
par: Tanaka, Koichi, et autres
Publié: (2026)
par: Tanaka, Koichi, et autres
Publié: (2026)
Prompt Optimization with Logged Bandit Data
par: Kiyohara, Haruka, et autres
Publié: (2025)
par: Kiyohara, Haruka, et autres
Publié: (2025)
Does Feedback Help in Bandits with Arm Erasures?
par: Karakas, Merve, et autres
Publié: (2025)
par: Karakas, Merve, et autres
Publié: (2025)
EVaR-Optimal Arm Identification in Bandits
par: Ahmadipour, Mehrasa, et autres
Publié: (2025)
par: Ahmadipour, Mehrasa, et autres
Publié: (2025)
Lasso Bandit with Compatibility Condition on Optimal Arm
par: Lee, Harin, et autres
Publié: (2024)
par: Lee, Harin, et autres
Publié: (2024)
Constrained Best Arm Identification in Grouped Bandits
par: Dharod, Sahil, et autres
Publié: (2024)
par: Dharod, Sahil, et autres
Publié: (2024)
Best Arm Identification for Stochastic Rising Bandits
par: Mussi, Marco, et autres
Publié: (2023)
par: Mussi, Marco, et autres
Publié: (2023)
Best-Arm Identification in Unimodal Bandits
par: Poiani, Riccardo, et autres
Publié: (2024)
par: Poiani, Riccardo, et autres
Publié: (2024)
Adversarial Combinatorial Bandits with Switching Costs
par: Dong, Yanyan, et autres
Publié: (2024)
par: Dong, Yanyan, et autres
Publié: (2024)
Oracle-Efficient Combinatorial Semi-Bandits
par: Kim, Jung-hun, et autres
Publié: (2025)
par: Kim, Jung-hun, et autres
Publié: (2025)
Multi-thresholding Good Arm Identification with Bandit Feedback
par: Jiang, Xuanke, et autres
Publié: (2025)
par: Jiang, Xuanke, et autres
Publié: (2025)
Combinatorial Bandit Bayesian Optimization for Tensor Outputs
par: Huang, Jingru, et autres
Publié: (2026)
par: Huang, Jingru, et autres
Publié: (2026)
Efficient Swap Regret Minimization in Combinatorial Bandits
par: Kontogiannis, Andreas, et autres
Publié: (2026)
par: Kontogiannis, Andreas, et autres
Publié: (2026)
On the Regularity and Fairness of Combinatorial Multi-Armed Bandit
par: Wu, Xiaoyi, et autres
Publié: (2025)
par: Wu, Xiaoyi, et autres
Publié: (2025)
Offline Learning for Combinatorial Multi-armed Bandits
par: Liu, Xutong, et autres
Publié: (2025)
par: Liu, Xutong, et autres
Publié: (2025)
Documents similaires
-
Effective Off-Policy Evaluation and Learning in Contextual Combinatorial Bandits
par: Shimizu, Tatsuhiro, et autres
Publié: (2024) -
Influential Bandits: Pulling an Arm May Change the Environment
par: Sato, Ryoma, et autres
Publié: (2025) -
Bandit Max-Min Fair Allocation
par: Harada, Tsubasa, et autres
Publié: (2025) -
Bandit and Delayed Feedback in Online Structured Prediction
par: Shibukawa, Yuki, et autres
Publié: (2025) -
Optimal Arm Elimination Algorithms for Combinatorial Bandits
par: Wen, Yuxiao, et autres
Publié: (2025)