Conversational Dueling Bandits in Generalized Linear Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Shuhua, Yuan, Hui, Zhang, Xiaoying, Wang, Mengdi, Zhang, Hong, Wang, Huazheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Restless Linear Bandits
por: Khaleghi, Azadeh
Publicado: (2024)
por: Khaleghi, Azadeh
Publicado: (2024)
Federated Linear Dueling Bandits
por: Huang, Xuhan, et al.
Publicado: (2025)
por: Huang, Xuhan, et al.
Publicado: (2025)
Tree Search-Based Evolutionary Bandits for Protein Sequence Optimization
por: Qiu, Jiahao, et al.
Publicado: (2024)
por: Qiu, Jiahao, et al.
Publicado: (2024)
Linear and Neural Dueling Bandits with Delayed Feedback
por: Wang, Xiangyi, et al.
Publicado: (2026)
por: Wang, Xiangyi, et al.
Publicado: (2026)
Indexed Minimum Empirical Divergence-Based Algorithms for Linear Bandits
por: Bian, Jie, et al.
Publicado: (2024)
por: Bian, Jie, et al.
Publicado: (2024)
Improved Regret Bounds for Linear Bandits with Heavy-Tailed Rewards
por: Tajdini, Artin, et al.
Publicado: (2025)
por: Tajdini, Artin, et al.
Publicado: (2025)
Spectral Estimators for Structured Generalized Linear Models via Approximate Message Passing
por: Zhang, Yihan, et al.
Publicado: (2023)
por: Zhang, Yihan, et al.
Publicado: (2023)
Avoiding the Price of Adaptivity: Inference in Linear Contextual Bandits via Stability
por: Praharaj, Samya, et al.
Publicado: (2025)
por: Praharaj, Samya, et al.
Publicado: (2025)
Lipschitz Dueling Bandits over Continuous Action Spaces
por: Sharma, Mudit, et al.
Publicado: (2026)
por: Sharma, Mudit, et al.
Publicado: (2026)
Optimal Estimation in Orthogonally Invariant Generalized Linear Models: Spectral Initialization and Approximate Message Passing
por: Zhang, Yihan, et al.
Publicado: (2026)
por: Zhang, Yihan, et al.
Publicado: (2026)
Precise Asymptotics for Spectral Methods in Mixed Generalized Linear Models
por: Zhang, Yihan, et al.
Publicado: (2022)
por: Zhang, Yihan, et al.
Publicado: (2022)
Optimal Clustering with Bandit Feedback
por: Yang, Junwen, et al.
Publicado: (2022)
por: Yang, Junwen, et al.
Publicado: (2022)
Bandit Convex Optimization with Gradient Prediction Adaptivity
por: Wang, Shuche, et al.
Publicado: (2026)
por: Wang, Shuche, et al.
Publicado: (2026)
Regret Tail Characterization of Optimal Bandit Algorithms with Generic Rewards
por: Panda, Subhodip, et al.
Publicado: (2026)
por: Panda, Subhodip, et al.
Publicado: (2026)
Almost Minimax Optimal Best Arm Identification in Piecewise Stationary Linear Bandits
por: Hou, Yunlong, et al.
Publicado: (2024)
por: Hou, Yunlong, et al.
Publicado: (2024)
Asymptotically and Minimax Optimal Regret Bounds for Multi-Armed Bandits with Abstention
por: Yang, Junwen, et al.
Publicado: (2024)
por: Yang, Junwen, et al.
Publicado: (2024)
Batched Kernelized Bandits: Refinements and Extensions
por: Ma, Chenkai, et al.
Publicado: (2026)
por: Ma, Chenkai, et al.
Publicado: (2026)
Lower Bounds for Time-Varying Kernelized Bandits
por: Cai, Xu, et al.
Publicado: (2024)
por: Cai, Xu, et al.
Publicado: (2024)
Optimal Arm Elimination Algorithms for Combinatorial Bandits
por: Wen, Yuxiao, et al.
Publicado: (2025)
por: Wen, Yuxiao, et al.
Publicado: (2025)
Generative Semantic Communication for Joint Image Transmission and Segmentation
por: Yuan, Weiwen, et al.
Publicado: (2024)
por: Yuan, Weiwen, et al.
Publicado: (2024)
Competing Bandits in Matching Markets via Super Stability
por: Basu, Soumya
Publicado: (2025)
por: Basu, Soumya
Publicado: (2025)
Quantile Multi-Armed Bandits with 1-bit Feedback
por: Lau, Ivan, et al.
Publicado: (2025)
por: Lau, Ivan, et al.
Publicado: (2025)
Regret Bounds for Noise-Free Cascaded Kernelized Bandits
por: Li, Zihan, et al.
Publicado: (2022)
por: Li, Zihan, et al.
Publicado: (2022)
A Modularized Framework for Piecewise-Stationary Restless Bandits
por: Li, Kuan-Ta, et al.
Publicado: (2026)
por: Li, Kuan-Ta, et al.
Publicado: (2026)
Online Clustering of Data Sequences with Bandit Information
por: Chandran, G Dhinesh, et al.
Publicado: (2025)
por: Chandran, G Dhinesh, et al.
Publicado: (2025)
Optimal Best Arm Identification with Fixed Confidence in Restless Bandits
por: Karthik, P. N., et al.
Publicado: (2023)
por: Karthik, P. N., et al.
Publicado: (2023)
On Instability of Minimax Optimal Optimism-Based Bandit Algorithms
por: Praharaj, Samya, et al.
Publicado: (2025)
por: Praharaj, Samya, et al.
Publicado: (2025)
Improved Offline Contextual Bandits with Second-Order Bounds: Betting and Freezing
por: Ryu, J. Jon, et al.
Publicado: (2025)
por: Ryu, J. Jon, et al.
Publicado: (2025)
Generalized Derangetropy Functionals for Modeling Cyclical Information Flow
por: Ataei, Masoud, et al.
Publicado: (2025)
por: Ataei, Masoud, et al.
Publicado: (2025)
Statistical Complexity and Optimal Algorithms for Non-linear Ridge Bandits
por: Rajaraman, Nived, et al.
Publicado: (2023)
por: Rajaraman, Nived, et al.
Publicado: (2023)
Harnessing the Power of Federated Learning in Federated Contextual Bandits
por: Shi, Chengshuai, et al.
Publicado: (2023)
por: Shi, Chengshuai, et al.
Publicado: (2023)
An Elementary Approach to Scheduling in Generative Diffusion Models
por: Sun, Qiang, et al.
Publicado: (2026)
por: Sun, Qiang, et al.
Publicado: (2026)
Large Generative Model Assisted 3D Semantic Communication
por: Jiang, Feibo, et al.
Publicado: (2024)
por: Jiang, Feibo, et al.
Publicado: (2024)
Diminishing Exploration: A Minimalist Approach to Piecewise Stationary Multi-Armed Bandits
por: Li, Kuan-Ta, et al.
Publicado: (2024)
por: Li, Kuan-Ta, et al.
Publicado: (2024)
Online Clustering of Dueling Bandits
por: Wang, Zhiyong, et al.
Publicado: (2025)
por: Wang, Zhiyong, et al.
Publicado: (2025)
Ranking In Generalized Linear Bandits
por: Shidani, Amitis, et al.
Publicado: (2022)
por: Shidani, Amitis, et al.
Publicado: (2022)
Concentrated Differential Privacy for Bandits
por: Azize, Achraf, et al.
Publicado: (2023)
por: Azize, Achraf, et al.
Publicado: (2023)
Evolution of Information in Interactive Decision Making: A Case Study for Multi-Armed Bandits
por: Gu, Yuzhou, et al.
Publicado: (2025)
por: Gu, Yuzhou, et al.
Publicado: (2025)
Exact Recovery of Sparse Binary Vectors from Generalized Linear Measurements
por: Mazumdar, Arya, et al.
Publicado: (2025)
por: Mazumdar, Arya, et al.
Publicado: (2025)
Deep Generative Modeling Reshapes Compression and Transmission: From Efficiency to Resiliency
por: Dai, Jincheng, et al.
Publicado: (2024)
por: Dai, Jincheng, et al.
Publicado: (2024)
Ejemplares similares
-
Restless Linear Bandits
por: Khaleghi, Azadeh
Publicado: (2024) -
Federated Linear Dueling Bandits
por: Huang, Xuhan, et al.
Publicado: (2025) -
Tree Search-Based Evolutionary Bandits for Protein Sequence Optimization
por: Qiu, Jiahao, et al.
Publicado: (2024) -
Linear and Neural Dueling Bandits with Delayed Feedback
por: Wang, Xiangyi, et al.
Publicado: (2026) -
Indexed Minimum Empirical Divergence-Based Algorithms for Linear Bandits
por: Bian, Jie, et al.
Publicado: (2024)