Best Arm Identification in Generalized Linear Bandits via Hybrid Feedback
Fuente:
arXiv
Guardado en:
| Autores principales: | Zeng, Qirun, Wang, Xuchuang, Shen, Jiayi, Liu, Xutong, Kong, Fang, Zuo, Jinhang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Fusing Reward and Dueling Feedback in Stochastic Bandits
por: Wang, Xuchuang, et al.
Publicado: (2025)
por: Wang, Xuchuang, et al.
Publicado: (2025)
Practical Adversarial Attacks on Stochastic Bandits via Fake Data Injection
por: Zeng, Qirun, et al.
Publicado: (2025)
por: Zeng, Qirun, et al.
Publicado: (2025)
Heterogeneous Multi-Agent Bandits with Parsimonious Hints
por: Mirfakhar, Amirmahdi, et al.
Publicado: (2025)
por: Mirfakhar, Amirmahdi, et al.
Publicado: (2025)
Best-Arm Identification in Unimodal Bandits
por: Poiani, Riccardo, et al.
Publicado: (2024)
por: Poiani, Riccardo, et al.
Publicado: (2024)
Stochastic Bandits Robust to Adversarial Attacks
por: Wang, Xuchuang, et al.
Publicado: (2024)
por: Wang, Xuchuang, et al.
Publicado: (2024)
Contextual Combinatorial Bandits with Probabilistically Triggered Arms
por: Liu, Xutong, et al.
Publicado: (2023)
por: Liu, Xutong, et al.
Publicado: (2023)
Almost Minimax Optimal Best Arm Identification in Piecewise Stationary Linear Bandits
por: Hou, Yunlong, et al.
Publicado: (2024)
por: Hou, Yunlong, et al.
Publicado: (2024)
Batch-Size Independent Regret Bounds for Combinatorial Semi-Bandits with Probabilistically Triggered Arms or Independent Arms
por: Liu, Xutong, et al.
Publicado: (2022)
por: Liu, Xutong, et al.
Publicado: (2022)
Beyond the Lower Bound: Bridging Regret Minimization and Best Arm Identification in Lexicographic Bandits
por: Xue, Bo, et al.
Publicado: (2025)
por: Xue, Bo, et al.
Publicado: (2025)
Linear and Neural Dueling Bandits with Delayed Feedback
por: Wang, Xiangyi, et al.
Publicado: (2026)
por: Wang, Xiangyi, et al.
Publicado: (2026)
The Best Instruction-Tuning Data are Those That Fit
por: Zhang, Dylan, et al.
Publicado: (2025)
por: Zhang, Dylan, et al.
Publicado: (2025)
Asymptotically Optimal Linear Best Feasible Arm Identification with Fixed Budget
por: Bian, Jie, et al.
Publicado: (2025)
por: Bian, Jie, et al.
Publicado: (2025)
Multi-Agent Stochastic Bandits Robust to Adversarial Corruptions
por: Ghaffari, Fatemeh, et al.
Publicado: (2024)
por: Ghaffari, Fatemeh, et al.
Publicado: (2024)
Fair Best Arm Identification with Fixed Confidence
por: Russo, Alessio, et al.
Publicado: (2024)
por: Russo, Alessio, et al.
Publicado: (2024)
Constrained Best Arm Identification with Tests for Feasibility
por: Cai, Ting, et al.
Publicado: (2025)
por: Cai, Ting, et al.
Publicado: (2025)
Efficient Prompt Optimization Through the Lens of Best Arm Identification
por: Shi, Chengshuai, et al.
Publicado: (2024)
por: Shi, Chengshuai, et al.
Publicado: (2024)
Best Arm Identification with Possibly Biased Offline Data
por: Yang, Le, et al.
Publicado: (2025)
por: Yang, Le, et al.
Publicado: (2025)
Generalized Neyman Allocation for Locally Minimax Optimal Best-Arm Identification
por: Kato, Masahiro
Publicado: (2024)
por: Kato, Masahiro
Publicado: (2024)
Online Multi-LLM Selection via Contextual Bandits under Unstructured Context Evolution
por: Poon, Manhin, et al.
Publicado: (2025)
por: Poon, Manhin, et al.
Publicado: (2025)
Optimal Multi-Objective Best Arm Identification with Fixed Confidence
por: Chen, Zhirui, et al.
Publicado: (2025)
por: Chen, Zhirui, et al.
Publicado: (2025)
Fixed-Budget Differentially Private Best Arm Identification
por: Chen, Zhirui, et al.
Publicado: (2024)
por: Chen, Zhirui, et al.
Publicado: (2024)
Networked Restless Multi-Arm Bandits with Reinforcement Learning
por: Zhang, Hanmo, et al.
Publicado: (2025)
por: Zhang, Hanmo, et al.
Publicado: (2025)
A Multi-Agent Conversational Bandit Approach to Online Evaluation and Selection of User-Aligned LLM Responses
por: Dai, Xiangxiang, et al.
Publicado: (2025)
por: Dai, Xiangxiang, et al.
Publicado: (2025)
Linear Contextual Bandits with Hybrid Payoff: Revisited
por: Das, Nirjhar, et al.
Publicado: (2024)
por: Das, Nirjhar, et al.
Publicado: (2024)
Multi-agent Multi-armed Bandits with Stochastic Sharable Arm Capacities
por: Xie, Hong, et al.
Publicado: (2024)
por: Xie, Hong, et al.
Publicado: (2024)
Fixed Budget is No Harder Than Fixed Confidence in Best-Arm Identification up to Logarithmic Factors
por: Balagopalan, Kapilan, et al.
Publicado: (2026)
por: Balagopalan, Kapilan, et al.
Publicado: (2026)
Multiple-play Stochastic Bandits with Prioritized Arm Capacity Sharing
por: Xie, Hong, et al.
Publicado: (2025)
por: Xie, Hong, et al.
Publicado: (2025)
Federated Contextual Cascading Bandits with Asynchronous Communication and Heterogeneous Users
por: Yang, Hantao, et al.
Publicado: (2024)
por: Yang, Hantao, et al.
Publicado: (2024)
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
por: Liu, Xutong, et al.
Publicado: (2024)
por: Liu, Xutong, et al.
Publicado: (2024)
Combinatorial Logistic Bandits
por: Liu, Xutong, et al.
Publicado: (2024)
por: Liu, Xutong, et al.
Publicado: (2024)
Influential Bandits: Pulling an Arm May Change the Environment
por: Sato, Ryoma, et al.
Publicado: (2025)
por: Sato, Ryoma, et al.
Publicado: (2025)
On The Complexity of Best-Arm Identification in Non-Stationary Linear Bandits
por: Maynard-Zhang, Leo, et al.
Publicado: (2026)
por: Maynard-Zhang, Leo, et al.
Publicado: (2026)
On the Power of Adaptivity for $\varepsilon$-Best Arm Identification in Linear Bandits
por: Maiti, Arnab, et al.
Publicado: (2026)
por: Maiti, Arnab, et al.
Publicado: (2026)
Multi-Agent Best Arm Identification in Stochastic Linear Bandits
por: Agrawal, Sanjana, et al.
Publicado: (2024)
por: Agrawal, Sanjana, et al.
Publicado: (2024)
Combinatorial Multi-armed Bandits: Arm Selection via Group Testing
por: Mukherjee, Arpan, et al.
Publicado: (2024)
por: Mukherjee, Arpan, et al.
Publicado: (2024)
Identifying All ε-Best Arms in (Misspecified) Linear Bandits
por: Li, Zhekai, et al.
Publicado: (2025)
por: Li, Zhekai, et al.
Publicado: (2025)
Identifying the Best Arm in the Presence of Global Environment Shifts
por: Srisawad, Phurinut, et al.
Publicado: (2024)
por: Srisawad, Phurinut, et al.
Publicado: (2024)
Multi-Armed Bandits With Best-Action Queries
por: Bacchiocchi, Francesco, et al.
Publicado: (2026)
por: Bacchiocchi, Francesco, et al.
Publicado: (2026)
LNUCB-TA: Linear-nonlinear Hybrid Bandit Learning with Temporal Attention
por: Khosravi, Hamed, et al.
Publicado: (2025)
por: Khosravi, Hamed, et al.
Publicado: (2025)
Online Learning to Rank under Corruption: A Robust Cascading Bandits Approach
por: Ghaffari, Fatemeh, et al.
Publicado: (2025)
por: Ghaffari, Fatemeh, et al.
Publicado: (2025)
Ejemplares similares
-
Fusing Reward and Dueling Feedback in Stochastic Bandits
por: Wang, Xuchuang, et al.
Publicado: (2025) -
Practical Adversarial Attacks on Stochastic Bandits via Fake Data Injection
por: Zeng, Qirun, et al.
Publicado: (2025) -
Heterogeneous Multi-Agent Bandits with Parsimonious Hints
por: Mirfakhar, Amirmahdi, et al.
Publicado: (2025) -
Best-Arm Identification in Unimodal Bandits
por: Poiani, Riccardo, et al.
Publicado: (2024) -
Stochastic Bandits Robust to Adversarial Attacks
por: Wang, Xuchuang, et al.
Publicado: (2024)