Generalized Linear Bandits with Limited Adaptivity
Fuente:
arXiv
Salvato in:
| Autori principali: | Sawarni, Ayush, Das, Nirjhar, Barman, Siddharth, Sinha, Gaurav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Linear Contextual Bandits with Hybrid Payoff: Revisited
di: Das, Nirjhar, et al.
Pubblicazione: (2024)
di: Das, Nirjhar, et al.
Pubblicazione: (2024)
Causal Contextual Bandits with Adaptive Context
di: Madhavan, Rahul, et al.
Pubblicazione: (2024)
di: Madhavan, Rahul, et al.
Pubblicazione: (2024)
Achieving Limited Adaptivity for Multinomial Logistic Bandits
di: Midigeshi, Sukruta Prakash, et al.
Pubblicazione: (2025)
di: Midigeshi, Sukruta Prakash, et al.
Pubblicazione: (2025)
Welfarist Formulations for Diverse Similarity Search
di: Barman, Siddharth, et al.
Pubblicazione: (2026)
di: Barman, Siddharth, et al.
Pubblicazione: (2026)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)
Statistical Inference and Learning for Shapley Additive Explanations (SHAP)
di: Whitehouse, Justin, et al.
Pubblicazione: (2026)
di: Whitehouse, Justin, et al.
Pubblicazione: (2026)
Preference Learning with Response Time: Robust Losses and Guarantees
di: Sawarni, Ayush, et al.
Pubblicazione: (2025)
di: Sawarni, Ayush, et al.
Pubblicazione: (2025)
Policy Learning with Abstention
di: Sawarni, Ayush, et al.
Pubblicazione: (2025)
di: Sawarni, Ayush, et al.
Pubblicazione: (2025)
Inverse Reinforcement Learning With Constraint Recovery
di: Das, Nirjhar, et al.
Pubblicazione: (2023)
di: Das, Nirjhar, et al.
Pubblicazione: (2023)
Causal Bandits: The Pareto Optimal Frontier of Adaptivity, a Reduction to Linear Bandits, and Limitations around Unknown Marginals
di: Liu, Ziyi, et al.
Pubblicazione: (2024)
di: Liu, Ziyi, et al.
Pubblicazione: (2024)
BanditQ: Fair Bandits with Guaranteed Rewards
di: Sinha, Abhishek
Pubblicazione: (2023)
di: Sinha, Abhishek
Pubblicazione: (2023)
Sparsity-Agnostic Linear Bandits with Adaptive Adversaries
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
Adaptive Sample Sharing for Multi Agent Linear Bandits
di: Cherkaoui, Hamza, et al.
Pubblicazione: (2023)
di: Cherkaoui, Hamza, et al.
Pubblicazione: (2023)
LinearAPT: An Adaptive Algorithm for the Fixed-Budget Thresholding Linear Bandit Problem
di: Wu, Yun-Ang, et al.
Pubblicazione: (2024)
di: Wu, Yun-Ang, et al.
Pubblicazione: (2024)
Constrained Contextual Bandits with Adversarial Contexts
di: Sarkar, Dhruv, et al.
Pubblicazione: (2026)
di: Sarkar, Dhruv, et al.
Pubblicazione: (2026)
Offline Clustering of Linear Bandits: The Power of Clusters under Limited Data
di: Liu, Jingyuan, et al.
Pubblicazione: (2025)
di: Liu, Jingyuan, et al.
Pubblicazione: (2025)
On the Power of Adaptivity for $\varepsilon$-Best Arm Identification in Linear Bandits
di: Maiti, Arnab, et al.
Pubblicazione: (2026)
di: Maiti, Arnab, et al.
Pubblicazione: (2026)
Single Index Bandits: Generalized Linear Contextual Bandits with Unknown Reward Functions
di: Kang, Yue, et al.
Pubblicazione: (2025)
di: Kang, Yue, et al.
Pubblicazione: (2025)
Learning to Explore with Lagrangians for Bandits under Unknown Linear Constraints
di: Das, Udvas, et al.
Pubblicazione: (2024)
di: Das, Udvas, et al.
Pubblicazione: (2024)
Noise-Adaptive Confidence Sets for Linear Bandits and Application to Bayesian Optimization
di: Jun, Kwang-Sung, et al.
Pubblicazione: (2024)
di: Jun, Kwang-Sung, et al.
Pubblicazione: (2024)
Ranking In Generalized Linear Bandits
di: Shidani, Amitis, et al.
Pubblicazione: (2022)
di: Shidani, Amitis, et al.
Pubblicazione: (2022)
General Formulation and PCL-Analysis for Restless Bandits with Limited Observability
di: Liu, Keqin, et al.
Pubblicazione: (2023)
di: Liu, Keqin, et al.
Pubblicazione: (2023)
Conversational Dueling Bandits in Generalized Linear Models
di: Yang, Shuhua, et al.
Pubblicazione: (2024)
di: Yang, Shuhua, et al.
Pubblicazione: (2024)
Active Preference Optimization for Sample Efficient RLHF
di: Das, Nirjhar, et al.
Pubblicazione: (2024)
di: Das, Nirjhar, et al.
Pubblicazione: (2024)
HR-Bandit: Human-AI Collaborated Linear Recourse Bandit
di: Cao, Junyu, et al.
Pubblicazione: (2024)
di: Cao, Junyu, et al.
Pubblicazione: (2024)
Bayesian Bandit Algorithms with Approximate Inference in Stochastic Linear Bandits
di: Huang, Ziyi, et al.
Pubblicazione: (2024)
di: Huang, Ziyi, et al.
Pubblicazione: (2024)
Online Continuous Hyperparameter Optimization for Generalized Linear Contextual Bandits
di: Kang, Yue, et al.
Pubblicazione: (2023)
di: Kang, Yue, et al.
Pubblicazione: (2023)
Nonstationary Generalized Linear Bandits with Discounted Online Mirror Descent
di: Lee, Joongkyu, et al.
Pubblicazione: (2026)
di: Lee, Joongkyu, et al.
Pubblicazione: (2026)
Shuffle and Joint Differential Privacy for Generalized Linear Contextual Bandits
di: Sarmasarkar, Sahasrajit
Pubblicazione: (2026)
di: Sarmasarkar, Sahasrajit
Pubblicazione: (2026)
Optimal Thresholding Linear Bandit
di: Rivera, Eduardo Ochoa, et al.
Pubblicazione: (2024)
di: Rivera, Eduardo Ochoa, et al.
Pubblicazione: (2024)
Infrequent Exploration in Linear Bandits
di: Lee, Harin, et al.
Pubblicazione: (2025)
di: Lee, Harin, et al.
Pubblicazione: (2025)
Federated Linear Dueling Bandits
di: Huang, Xuhan, et al.
Pubblicazione: (2025)
di: Huang, Xuhan, et al.
Pubblicazione: (2025)
A Simple Reduction Scheme for Constrained Contextual Bandits with Adversarial Contexts via Regression
di: Sarkar, Dhruv, et al.
Pubblicazione: (2026)
di: Sarkar, Dhruv, et al.
Pubblicazione: (2026)
Restless Linear Bandits
di: Khaleghi, Azadeh
Pubblicazione: (2024)
di: Khaleghi, Azadeh
Pubblicazione: (2024)
The Fundamental Limits of Fraud Detection in Card Payment Networks
di: Dhama, Gaurav
Pubblicazione: (2026)
di: Dhama, Gaurav
Pubblicazione: (2026)
A Unified Confidence Sequence for Generalized Linear Models, with Applications to Bandits
di: Lee, Junghyun, et al.
Pubblicazione: (2024)
di: Lee, Junghyun, et al.
Pubblicazione: (2024)
Generalized Linear Bandits: Almost Optimal Regret with One-Pass Update
di: Zhang, Yu-Jie, et al.
Pubblicazione: (2025)
di: Zhang, Yu-Jie, et al.
Pubblicazione: (2025)
Linear Contextual Bandits with Interference
di: Xu, Yang, et al.
Pubblicazione: (2024)
di: Xu, Yang, et al.
Pubblicazione: (2024)
Performance Analysis of Support Vector Machine (SVM) on Challenging Datasets for Forest Fire Detection
di: Kar, Ankan, et al.
Pubblicazione: (2024)
di: Kar, Ankan, et al.
Pubblicazione: (2024)
Symmetric Linear Bandits with Hidden Symmetry
di: Tran, Nam Phuong, et al.
Pubblicazione: (2024)
di: Tran, Nam Phuong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Linear Contextual Bandits with Hybrid Payoff: Revisited
di: Das, Nirjhar, et al.
Pubblicazione: (2024) -
Causal Contextual Bandits with Adaptive Context
di: Madhavan, Rahul, et al.
Pubblicazione: (2024) -
Achieving Limited Adaptivity for Multinomial Logistic Bandits
di: Midigeshi, Sukruta Prakash, et al.
Pubblicazione: (2025) -
Welfarist Formulations for Diverse Similarity Search
di: Barman, Siddharth, et al.
Pubblicazione: (2026) -
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)