Continuum-armed Bandit Optimization with Batch Pairwise Comparison Oracles
Fuente:
arXiv
Salvato in:
| Autori principali: | Chang, Xiangyu, Chen, Xi, Wang, Yining, Zeng, Zhiyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Robust Batched Bandits
di: Guo, Yunwen, et al.
Pubblicazione: (2025)
di: Guo, Yunwen, et al.
Pubblicazione: (2025)
Offline Learning for Combinatorial Multi-armed Bandits
di: Liu, Xutong, et al.
Pubblicazione: (2025)
di: Liu, Xutong, et al.
Pubblicazione: (2025)
Batched Stochastic Bandit for Nondegenerate Functions
di: Liu, Yu, et al.
Pubblicazione: (2024)
di: Liu, Yu, et al.
Pubblicazione: (2024)
GINO-Q: Learning an Asymptotically Optimal Index Policy for Restless Multi-armed Bandits
di: Chen, Gongpu, et al.
Pubblicazione: (2024)
di: Chen, Gongpu, et al.
Pubblicazione: (2024)
Oracle-Efficient Combinatorial Semi-Bandits
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
Multi-armed Bandits with Missing Outcome
di: Mahrooghi, Ilia, et al.
Pubblicazione: (2024)
di: Mahrooghi, Ilia, et al.
Pubblicazione: (2024)
Online Statistical Inference for Contextual Bandits via Stochastic Gradient Descent
di: Chang, Xiangyu, et al.
Pubblicazione: (2022)
di: Chang, Xiangyu, et al.
Pubblicazione: (2022)
Batched Kernelized Bandits: Refinements and Extensions
di: Ma, Chenkai, et al.
Pubblicazione: (2026)
di: Ma, Chenkai, et al.
Pubblicazione: (2026)
ComPO: Preference Alignment via Comparison Oracles
di: Chen, Peter, et al.
Pubblicazione: (2025)
di: Chen, Peter, et al.
Pubblicazione: (2025)
The Batch Complexity of Bandit Pure Exploration
di: Tuynman, Adrienne, et al.
Pubblicazione: (2025)
di: Tuynman, Adrienne, et al.
Pubblicazione: (2025)
Robust Decentralized Multi-armed Bandits: From Corruption-Resilience to Byzantine-Resilience
di: Hu, Zicheng, et al.
Pubblicazione: (2025)
di: Hu, Zicheng, et al.
Pubblicazione: (2025)
Replicability is Asymptotically Free in Multi-armed Bandits
di: Komiyama, Junpei, et al.
Pubblicazione: (2024)
di: Komiyama, Junpei, et al.
Pubblicazione: (2024)
Maximal Objectives in the Multi-armed Bandit with Applications
di: Ozbay, Eren, et al.
Pubblicazione: (2020)
di: Ozbay, Eren, et al.
Pubblicazione: (2020)
Batched Nonparametric Contextual Bandits
di: Jiang, Rong, et al.
Pubblicazione: (2024)
di: Jiang, Rong, et al.
Pubblicazione: (2024)
Optimal Batched Linear Bandits
di: Ren, Xuanfei, et al.
Pubblicazione: (2024)
di: Ren, Xuanfei, et al.
Pubblicazione: (2024)
Hybrid Combinatorial Multi-armed Bandits with Probabilistically Triggered Arms
di: Zhou, Kongchang, et al.
Pubblicazione: (2025)
di: Zhou, Kongchang, et al.
Pubblicazione: (2025)
Deceptive Exploration in Multi-armed Bandits
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025)
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025)
Causally Abstracted Multi-armed Bandits
di: Zennaro, Fabio Massimo, et al.
Pubblicazione: (2024)
di: Zennaro, Fabio Massimo, et al.
Pubblicazione: (2024)
Design Experiments to Compare Multi-armed Bandit Algorithms
di: Meng, Huiling, et al.
Pubblicazione: (2026)
di: Meng, Huiling, et al.
Pubblicazione: (2026)
Optimal and Practical Batched Linear Bandit Algorithm
di: Yu, Sanghoon, et al.
Pubblicazione: (2025)
di: Yu, Sanghoon, et al.
Pubblicazione: (2025)
Pairwise Elimination with Instance-Dependent Guarantees for Bandits with Cost Subsidy
di: Juneja, Ishank, et al.
Pubblicazione: (2025)
di: Juneja, Ishank, et al.
Pubblicazione: (2025)
Multi-agent Multi-armed Bandit with Fully Heavy-tailed Dynamics
di: Wang, Xingyu, et al.
Pubblicazione: (2025)
di: Wang, Xingyu, et al.
Pubblicazione: (2025)
Feedback Descent: Open-Ended Text Optimization via Pairwise Comparison
di: Lee, Yoonho, et al.
Pubblicazione: (2025)
di: Lee, Yoonho, et al.
Pubblicazione: (2025)
Fairness of Exposure in Online Restless Multi-armed Bandits
di: Sood, Archit, et al.
Pubblicazione: (2024)
di: Sood, Archit, et al.
Pubblicazione: (2024)
Federated $\mathcal{X}$-armed Bandit with Flexible Personalisation
di: Arabzadeh, Ali, et al.
Pubblicazione: (2024)
di: Arabzadeh, Ali, et al.
Pubblicazione: (2024)
Learning with Limited Shared Information in Multi-agent Multi-armed Bandit
di: Shao, Junning, et al.
Pubblicazione: (2025)
di: Shao, Junning, et al.
Pubblicazione: (2025)
Efficient and Optimal Policy Gradient Algorithm for Corrupted Multi-armed Bandits
di: Liu, Jiayuan, et al.
Pubblicazione: (2025)
di: Liu, Jiayuan, et al.
Pubblicazione: (2025)
A Two-armed Bandit Framework for A/B Testing
di: Wang, Jinjuan, et al.
Pubblicazione: (2025)
di: Wang, Jinjuan, et al.
Pubblicazione: (2025)
Heterogeneous Multi-agent Multi-armed Bandits on Stochastic Block Models
di: Xu, Mengfan, et al.
Pubblicazione: (2025)
di: Xu, Mengfan, et al.
Pubblicazione: (2025)
Transfer Learning for Contextual Multi-armed Bandits
di: Cai, Changxiao, et al.
Pubblicazione: (2022)
di: Cai, Changxiao, et al.
Pubblicazione: (2022)
Batch Ensemble for Variance Dependent Regret in Stochastic Bandits
di: Cassel, Asaf, et al.
Pubblicazione: (2024)
di: Cassel, Asaf, et al.
Pubblicazione: (2024)
Locally Private Nonparametric Contextual Multi-armed Bandits
di: Ma, Yuheng, et al.
Pubblicazione: (2025)
di: Ma, Yuheng, et al.
Pubblicazione: (2025)
Metric Learning from Limited Pairwise Preference Comparisons
di: Wang, Zhi, et al.
Pubblicazione: (2024)
di: Wang, Zhi, et al.
Pubblicazione: (2024)
Transfer in Sequential Multi-armed Bandits via Reward Samples
di: R, Rahul N, et al.
Pubblicazione: (2024)
di: R, Rahul N, et al.
Pubblicazione: (2024)
Falcon: Fair Active Learning using Multi-armed Bandits
di: Tae, Ki Hyun, et al.
Pubblicazione: (2024)
di: Tae, Ki Hyun, et al.
Pubblicazione: (2024)
Batch size invariant Adam
di: Wang, Xi, et al.
Pubblicazione: (2024)
di: Wang, Xi, et al.
Pubblicazione: (2024)
Pairwise Comparisons without Stochastic Transitivity: Model, Theory and Applications
di: Lee, Sze Ming, et al.
Pubblicazione: (2025)
di: Lee, Sze Ming, et al.
Pubblicazione: (2025)
Nearly Tight Bounds for Exploration in Streaming Multi-armed Bandits with Known Optimality Gap
di: Karpov, Nikolai, et al.
Pubblicazione: (2025)
di: Karpov, Nikolai, et al.
Pubblicazione: (2025)
Learning from Similarity/Dissimilarity and Pairwise Comparison
di: Tate, Tomoya, et al.
Pubblicazione: (2026)
di: Tate, Tomoya, et al.
Pubblicazione: (2026)
Batched Online Contextual Sparse Bandits with Sequential Inclusion of Features
di: Swiers, Rowan, et al.
Pubblicazione: (2024)
di: Swiers, Rowan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Robust Batched Bandits
di: Guo, Yunwen, et al.
Pubblicazione: (2025) -
Offline Learning for Combinatorial Multi-armed Bandits
di: Liu, Xutong, et al.
Pubblicazione: (2025) -
Batched Stochastic Bandit for Nondegenerate Functions
di: Liu, Yu, et al.
Pubblicazione: (2024) -
GINO-Q: Learning an Asymptotically Optimal Index Policy for Restless Multi-armed Bandits
di: Chen, Gongpu, et al.
Pubblicazione: (2024) -
Oracle-Efficient Combinatorial Semi-Bandits
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)