Single Index Bandits: Generalized Linear Contextual Bandits with Unknown Reward Functions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kang, Yue, Liu, Mingshuo, Yi, Bongsoo, Lyu, Jing, Zhang, Zhi, Zhou, Doudou, Li, Yao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Quantum Lipschitz Bandits
par: Yi, Bongsoo, et autres
Publié: (2025)
par: Yi, Bongsoo, et autres
Publié: (2025)
Biased Dueling Bandits with Stochastic Delayed Feedback
par: Yi, Bongsoo, et autres
Publié: (2024)
par: Yi, Bongsoo, et autres
Publié: (2024)
Online Continuous Hyperparameter Optimization for Generalized Linear Contextual Bandits
par: Kang, Yue, et autres
Publié: (2023)
par: Kang, Yue, et autres
Publié: (2023)
Generalized Low-Rank Matrix Contextual Bandits with Graph Information
par: Wang, Yao, et autres
Publié: (2025)
par: Wang, Yao, et autres
Publié: (2025)
Improved Algorithm for Adversarial Linear Mixture MDPs with Bandit Feedback and Unknown Transition
par: Li, Long-Fei, et autres
Publié: (2024)
par: Li, Long-Fei, et autres
Publié: (2024)
Contextual Linear Bandits with Delay as Payoff
par: Zhang, Mengxiao, et autres
Publié: (2025)
par: Zhang, Mengxiao, et autres
Publié: (2025)
Efficient Generalized Low-Rank Tensor Contextual Bandits
par: Yi, Qianxin, et autres
Publié: (2023)
par: Yi, Qianxin, et autres
Publié: (2023)
Linear Contextual Bandits with Interference
par: Xu, Yang, et autres
Publié: (2024)
par: Xu, Yang, et autres
Publié: (2024)
Catoni Contextual Bandits are Robust to Heavy-tailed Rewards
par: Ye, Chenlu, et autres
Publié: (2025)
par: Ye, Chenlu, et autres
Publié: (2025)
Contextual Multinomial Logit Bandits with General Value Functions
par: Zhang, Mengxiao, et autres
Publié: (2024)
par: Zhang, Mengxiao, et autres
Publié: (2024)
Active Learning for Stochastic Contextual Linear Bandits
par: Brunskill, Emma, et autres
Publié: (2026)
par: Brunskill, Emma, et autres
Publié: (2026)
Safe Linear Bandits over Unknown Polytopes
par: Gangrade, Aditya, et autres
Publié: (2022)
par: Gangrade, Aditya, et autres
Publié: (2022)
Strategic Linear Contextual Bandits
par: Buening, Thomas Kleine, et autres
Publié: (2024)
par: Buening, Thomas Kleine, et autres
Publié: (2024)
Federated Linear Contextual Bandits with Heterogeneous Clients
par: Blaser, Ethan, et autres
Publié: (2024)
par: Blaser, Ethan, et autres
Publié: (2024)
Scaling Federated Linear Contextual Bandits via Sketching
par: Yang, Hantao, et autres
Publié: (2026)
par: Yang, Hantao, et autres
Publié: (2026)
Shuffle and Joint Differential Privacy for Generalized Linear Contextual Bandits
par: Sarmasarkar, Sahasrajit
Publié: (2026)
par: Sarmasarkar, Sahasrajit
Publié: (2026)
Partially Observable Contextual Bandits with Linear Payoffs
par: Zeng, Sihan, et autres
Publié: (2024)
par: Zeng, Sihan, et autres
Publié: (2024)
Linear Causal Bandits: Unknown Graph and Soft Interventions
par: Yan, Zirui, et autres
Publié: (2024)
par: Yan, Zirui, et autres
Publié: (2024)
Causal Bandits: The Pareto Optimal Frontier of Adaptivity, a Reduction to Linear Bandits, and Limitations around Unknown Marginals
par: Liu, Ziyi, et autres
Publié: (2024)
par: Liu, Ziyi, et autres
Publié: (2024)
Low-rank Matrix Bandits with Heavy-tailed Rewards
par: Kang, Yue, et autres
Publié: (2024)
par: Kang, Yue, et autres
Publié: (2024)
Optimal Regret for Single Index Bandits
par: Dey, Devdan, et autres
Publié: (2026)
par: Dey, Devdan, et autres
Publié: (2026)
Signature Approach for Contextual Bandits with Nonlinear and Path-dependent Rewards
par: Guo, Xin, et autres
Publié: (2026)
par: Guo, Xin, et autres
Publié: (2026)
Contextual Rollout Bandits for Reinforcement Learning with Verifiable Rewards
par: Lu, Xiaodong, et autres
Publié: (2026)
par: Lu, Xiaodong, et autres
Publié: (2026)
Heavy-Tailed Linear Bandits: Huber Regression with One-Pass Update
par: Wang, Jing, et autres
Publié: (2025)
par: Wang, Jing, et autres
Publié: (2025)
Weighted Sequential Bayesian Inference for Non-Stationary Linear Contextual Bandits
par: Werge, Nicklas, et autres
Publié: (2023)
par: Werge, Nicklas, et autres
Publié: (2023)
Learning with Incomplete Context: Linear Contextual Bandits with Pretrained Imputation
par: Yan, Hao, et autres
Publié: (2025)
par: Yan, Hao, et autres
Publié: (2025)
On the Optimal Regret of Locally Private Linear Contextual Bandit
par: Li, Jiachun, et autres
Publié: (2024)
par: Li, Jiachun, et autres
Publié: (2024)
Direction-Aware Offline-to-Online Learning in Linear Contextual Bandits
par: Han, Zean, et autres
Publié: (2026)
par: Han, Zean, et autres
Publié: (2026)
Conservative Contextual Bandits: Beyond Linear Representations
par: Deb, Rohan, et autres
Publié: (2024)
par: Deb, Rohan, et autres
Publié: (2024)
Linear Contextual Bandits with Hybrid Payoff: Revisited
par: Das, Nirjhar, et autres
Publié: (2024)
par: Das, Nirjhar, et autres
Publié: (2024)
Thompson Sampling for Multi-Objective Linear Contextual Bandit
par: Park, Somangchan, et autres
Publié: (2025)
par: Park, Somangchan, et autres
Publié: (2025)
Best-of-Both-Worlds Algorithms for Linear Contextual Bandits
par: Kuroki, Yuko, et autres
Publié: (2023)
par: Kuroki, Yuko, et autres
Publié: (2023)
A Reduction Algorithm for Markovian Contextual Linear Bandits
par: Buyukkalayci, Kaan, et autres
Publié: (2026)
par: Buyukkalayci, Kaan, et autres
Publié: (2026)
Distributionally Robust Policy Evaluation under General Covariate Shift in Contextual Bandits
par: Guo, Yihong, et autres
Publié: (2024)
par: Guo, Yihong, et autres
Publié: (2024)
Attack-Resistant Uniform Fairness for Linear and Smooth Contextual Bandits
par: Zhang, Qingwen, et autres
Publié: (2026)
par: Zhang, Qingwen, et autres
Publié: (2026)
High Probability Bound for Cross-Learning Contextual Bandits with Unknown Context Distributions
par: Huang, Ruiyuan, et autres
Publié: (2024)
par: Huang, Ruiyuan, et autres
Publié: (2024)
BanditQ: Fair Bandits with Guaranteed Rewards
par: Sinha, Abhishek
Publié: (2023)
par: Sinha, Abhishek
Publié: (2023)
From Contextual Combinatorial Semi-Bandits to Bandit List Classification: Improved Sample Complexity with Sparse Rewards
par: Erez, Liad, et autres
Publié: (2025)
par: Erez, Liad, et autres
Publié: (2025)
A Trainable Centrality Framework for Modern Data
par: Vu, Minh Duc, et autres
Publié: (2025)
par: Vu, Minh Duc, et autres
Publié: (2025)
Variance-Aware Linear UCB with Deep Representation for Neural Contextual Bandits
par: Bui, Ha Manh, et autres
Publié: (2024)
par: Bui, Ha Manh, et autres
Publié: (2024)
Documents similaires
-
Quantum Lipschitz Bandits
par: Yi, Bongsoo, et autres
Publié: (2025) -
Biased Dueling Bandits with Stochastic Delayed Feedback
par: Yi, Bongsoo, et autres
Publié: (2024) -
Online Continuous Hyperparameter Optimization for Generalized Linear Contextual Bandits
par: Kang, Yue, et autres
Publié: (2023) -
Generalized Low-Rank Matrix Contextual Bandits with Graph Information
par: Wang, Yao, et autres
Publié: (2025) -
Improved Algorithm for Adversarial Linear Mixture MDPs with Bandit Feedback and Unknown Transition
par: Li, Long-Fei, et autres
Publié: (2024)