Best Arm Identification in Generalized Linear Bandits via Hybrid Feedback
Fuente:
arXiv
Salvato in:
| Autori principali: | Zeng, Qirun, Wang, Xuchuang, Shen, Jiayi, Liu, Xutong, Kong, Fang, Zuo, Jinhang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fusing Reward and Dueling Feedback in Stochastic Bandits
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
Practical Adversarial Attacks on Stochastic Bandits via Fake Data Injection
di: Zeng, Qirun, et al.
Pubblicazione: (2025)
di: Zeng, Qirun, et al.
Pubblicazione: (2025)
Heterogeneous Multi-Agent Bandits with Parsimonious Hints
di: Mirfakhar, Amirmahdi, et al.
Pubblicazione: (2025)
di: Mirfakhar, Amirmahdi, et al.
Pubblicazione: (2025)
Best-Arm Identification in Unimodal Bandits
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
Stochastic Bandits Robust to Adversarial Attacks
di: Wang, Xuchuang, et al.
Pubblicazione: (2024)
di: Wang, Xuchuang, et al.
Pubblicazione: (2024)
Contextual Combinatorial Bandits with Probabilistically Triggered Arms
di: Liu, Xutong, et al.
Pubblicazione: (2023)
di: Liu, Xutong, et al.
Pubblicazione: (2023)
Almost Minimax Optimal Best Arm Identification in Piecewise Stationary Linear Bandits
di: Hou, Yunlong, et al.
Pubblicazione: (2024)
di: Hou, Yunlong, et al.
Pubblicazione: (2024)
Batch-Size Independent Regret Bounds for Combinatorial Semi-Bandits with Probabilistically Triggered Arms or Independent Arms
di: Liu, Xutong, et al.
Pubblicazione: (2022)
di: Liu, Xutong, et al.
Pubblicazione: (2022)
Beyond the Lower Bound: Bridging Regret Minimization and Best Arm Identification in Lexicographic Bandits
di: Xue, Bo, et al.
Pubblicazione: (2025)
di: Xue, Bo, et al.
Pubblicazione: (2025)
Linear and Neural Dueling Bandits with Delayed Feedback
di: Wang, Xiangyi, et al.
Pubblicazione: (2026)
di: Wang, Xiangyi, et al.
Pubblicazione: (2026)
The Best Instruction-Tuning Data are Those That Fit
di: Zhang, Dylan, et al.
Pubblicazione: (2025)
di: Zhang, Dylan, et al.
Pubblicazione: (2025)
Asymptotically Optimal Linear Best Feasible Arm Identification with Fixed Budget
di: Bian, Jie, et al.
Pubblicazione: (2025)
di: Bian, Jie, et al.
Pubblicazione: (2025)
Multi-Agent Stochastic Bandits Robust to Adversarial Corruptions
di: Ghaffari, Fatemeh, et al.
Pubblicazione: (2024)
di: Ghaffari, Fatemeh, et al.
Pubblicazione: (2024)
Fair Best Arm Identification with Fixed Confidence
di: Russo, Alessio, et al.
Pubblicazione: (2024)
di: Russo, Alessio, et al.
Pubblicazione: (2024)
Constrained Best Arm Identification with Tests for Feasibility
di: Cai, Ting, et al.
Pubblicazione: (2025)
di: Cai, Ting, et al.
Pubblicazione: (2025)
Efficient Prompt Optimization Through the Lens of Best Arm Identification
di: Shi, Chengshuai, et al.
Pubblicazione: (2024)
di: Shi, Chengshuai, et al.
Pubblicazione: (2024)
Best Arm Identification with Possibly Biased Offline Data
di: Yang, Le, et al.
Pubblicazione: (2025)
di: Yang, Le, et al.
Pubblicazione: (2025)
Generalized Neyman Allocation for Locally Minimax Optimal Best-Arm Identification
di: Kato, Masahiro
Pubblicazione: (2024)
di: Kato, Masahiro
Pubblicazione: (2024)
Online Multi-LLM Selection via Contextual Bandits under Unstructured Context Evolution
di: Poon, Manhin, et al.
Pubblicazione: (2025)
di: Poon, Manhin, et al.
Pubblicazione: (2025)
Optimal Multi-Objective Best Arm Identification with Fixed Confidence
di: Chen, Zhirui, et al.
Pubblicazione: (2025)
di: Chen, Zhirui, et al.
Pubblicazione: (2025)
Fixed-Budget Differentially Private Best Arm Identification
di: Chen, Zhirui, et al.
Pubblicazione: (2024)
di: Chen, Zhirui, et al.
Pubblicazione: (2024)
Networked Restless Multi-Arm Bandits with Reinforcement Learning
di: Zhang, Hanmo, et al.
Pubblicazione: (2025)
di: Zhang, Hanmo, et al.
Pubblicazione: (2025)
A Multi-Agent Conversational Bandit Approach to Online Evaluation and Selection of User-Aligned LLM Responses
di: Dai, Xiangxiang, et al.
Pubblicazione: (2025)
di: Dai, Xiangxiang, et al.
Pubblicazione: (2025)
Linear Contextual Bandits with Hybrid Payoff: Revisited
di: Das, Nirjhar, et al.
Pubblicazione: (2024)
di: Das, Nirjhar, et al.
Pubblicazione: (2024)
Multi-agent Multi-armed Bandits with Stochastic Sharable Arm Capacities
di: Xie, Hong, et al.
Pubblicazione: (2024)
di: Xie, Hong, et al.
Pubblicazione: (2024)
Fixed Budget is No Harder Than Fixed Confidence in Best-Arm Identification up to Logarithmic Factors
di: Balagopalan, Kapilan, et al.
Pubblicazione: (2026)
di: Balagopalan, Kapilan, et al.
Pubblicazione: (2026)
Multiple-play Stochastic Bandits with Prioritized Arm Capacity Sharing
di: Xie, Hong, et al.
Pubblicazione: (2025)
di: Xie, Hong, et al.
Pubblicazione: (2025)
Federated Contextual Cascading Bandits with Asynchronous Communication and Heterogeneous Users
di: Yang, Hantao, et al.
Pubblicazione: (2024)
di: Yang, Hantao, et al.
Pubblicazione: (2024)
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
di: Liu, Xutong, et al.
Pubblicazione: (2024)
di: Liu, Xutong, et al.
Pubblicazione: (2024)
Combinatorial Logistic Bandits
di: Liu, Xutong, et al.
Pubblicazione: (2024)
di: Liu, Xutong, et al.
Pubblicazione: (2024)
Influential Bandits: Pulling an Arm May Change the Environment
di: Sato, Ryoma, et al.
Pubblicazione: (2025)
di: Sato, Ryoma, et al.
Pubblicazione: (2025)
On The Complexity of Best-Arm Identification in Non-Stationary Linear Bandits
di: Maynard-Zhang, Leo, et al.
Pubblicazione: (2026)
di: Maynard-Zhang, Leo, et al.
Pubblicazione: (2026)
On the Power of Adaptivity for $\varepsilon$-Best Arm Identification in Linear Bandits
di: Maiti, Arnab, et al.
Pubblicazione: (2026)
di: Maiti, Arnab, et al.
Pubblicazione: (2026)
Multi-Agent Best Arm Identification in Stochastic Linear Bandits
di: Agrawal, Sanjana, et al.
Pubblicazione: (2024)
di: Agrawal, Sanjana, et al.
Pubblicazione: (2024)
Combinatorial Multi-armed Bandits: Arm Selection via Group Testing
di: Mukherjee, Arpan, et al.
Pubblicazione: (2024)
di: Mukherjee, Arpan, et al.
Pubblicazione: (2024)
Identifying All ε-Best Arms in (Misspecified) Linear Bandits
di: Li, Zhekai, et al.
Pubblicazione: (2025)
di: Li, Zhekai, et al.
Pubblicazione: (2025)
Identifying the Best Arm in the Presence of Global Environment Shifts
di: Srisawad, Phurinut, et al.
Pubblicazione: (2024)
di: Srisawad, Phurinut, et al.
Pubblicazione: (2024)
Multi-Armed Bandits With Best-Action Queries
di: Bacchiocchi, Francesco, et al.
Pubblicazione: (2026)
di: Bacchiocchi, Francesco, et al.
Pubblicazione: (2026)
LNUCB-TA: Linear-nonlinear Hybrid Bandit Learning with Temporal Attention
di: Khosravi, Hamed, et al.
Pubblicazione: (2025)
di: Khosravi, Hamed, et al.
Pubblicazione: (2025)
Online Learning to Rank under Corruption: A Robust Cascading Bandits Approach
di: Ghaffari, Fatemeh, et al.
Pubblicazione: (2025)
di: Ghaffari, Fatemeh, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Fusing Reward and Dueling Feedback in Stochastic Bandits
di: Wang, Xuchuang, et al.
Pubblicazione: (2025) -
Practical Adversarial Attacks on Stochastic Bandits via Fake Data Injection
di: Zeng, Qirun, et al.
Pubblicazione: (2025) -
Heterogeneous Multi-Agent Bandits with Parsimonious Hints
di: Mirfakhar, Amirmahdi, et al.
Pubblicazione: (2025) -
Best-Arm Identification in Unimodal Bandits
di: Poiani, Riccardo, et al.
Pubblicazione: (2024) -
Stochastic Bandits Robust to Adversarial Attacks
di: Wang, Xuchuang, et al.
Pubblicazione: (2024)