Empirical Bayesian Multi-Bandit Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Xia, Zhu, Rong J. B. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Bayesian Inference of Contextual Bandit Policies via Empirical Likelihood
por: Ouyang, Jiangrong, et al.
Publicado: (2026)
por: Ouyang, Jiangrong, et al.
Publicado: (2026)
Batched Nonparametric Contextual Bandits
por: Jiang, Rong, et al.
Publicado: (2024)
por: Jiang, Rong, et al.
Publicado: (2024)
Falcon: Fair Active Learning using Multi-armed Bandits
por: Tae, Ki Hyun, et al.
Publicado: (2024)
por: Tae, Ki Hyun, et al.
Publicado: (2024)
Combinatorial Bandit Bayesian Optimization for Tensor Outputs
por: Huang, Jingru, et al.
Publicado: (2026)
por: Huang, Jingru, et al.
Publicado: (2026)
UCB Exploration for Fixed-Budget Bayesian Best Arm Identification
por: Zhu, Rong J. B., et al.
Publicado: (2024)
por: Zhu, Rong J. B., et al.
Publicado: (2024)
High dimensional Bayesian Optimization via Condensing-Expansion Projection
por: Lu, Jiaming, et al.
Publicado: (2024)
por: Lu, Jiaming, et al.
Publicado: (2024)
Bayesian Bandit Algorithms with Approximate Inference in Stochastic Linear Bandits
por: Huang, Ziyi, et al.
Publicado: (2024)
por: Huang, Ziyi, et al.
Publicado: (2024)
The Adaptivity Barrier in Batched Nonparametric Bandits: Sharp Characterization of the Price of Unknown Margin
por: Jiang, Rong, et al.
Publicado: (2025)
por: Jiang, Rong, et al.
Publicado: (2025)
Bayesian Regret Minimization in Offline Bandits
por: Petrik, Marek, et al.
Publicado: (2023)
por: Petrik, Marek, et al.
Publicado: (2023)
Minimum Empirical Divergence for Sub-Gaussian Linear Bandits
por: Balagopalan, Kapilan, et al.
Publicado: (2024)
por: Balagopalan, Kapilan, et al.
Publicado: (2024)
Offline Learning for Combinatorial Multi-armed Bandits
por: Liu, Xutong, et al.
Publicado: (2025)
por: Liu, Xutong, et al.
Publicado: (2025)
Multi-Armed Bandits With Machine Learning-Generated Surrogate Rewards
por: Ji, Wenlong, et al.
Publicado: (2025)
por: Ji, Wenlong, et al.
Publicado: (2025)
High-dimensional Linear Bandits with Knapsacks
por: Ma, Wanteng, et al.
Publicado: (2023)
por: Ma, Wanteng, et al.
Publicado: (2023)
Empirical Bound Information-Directed Sampling for Norm-Agnostic Bandits
por: Suder, Piotr M., et al.
Publicado: (2025)
por: Suder, Piotr M., et al.
Publicado: (2025)
Bandits with Stochastic Experts: Constant Regret, Empirical Experts and Episodes
por: Sharma, Nihal, et al.
Publicado: (2021)
por: Sharma, Nihal, et al.
Publicado: (2021)
Multi-thresholding Good Arm Identification with Bandit Feedback
por: Jiang, Xuanke, et al.
Publicado: (2025)
por: Jiang, Xuanke, et al.
Publicado: (2025)
Sequential Learning of the Pareto Front for Multi-objective Bandits
por: Crépon, Elise, et al.
Publicado: (2025)
por: Crépon, Elise, et al.
Publicado: (2025)
Learning Shared Representations for Multi-Task Linear Bandits
por: Lin, Jiabin, et al.
Publicado: (2026)
por: Lin, Jiabin, et al.
Publicado: (2026)
Multi-Task Representation Learning for Conservative Linear Bandits
por: Lin, Jiabin, et al.
Publicado: (2026)
por: Lin, Jiabin, et al.
Publicado: (2026)
Bandit Learning in General Open Multi-agent Systems
por: Xu, Mengfan
Publicado: (2026)
por: Xu, Mengfan
Publicado: (2026)
Learning with Limited Shared Information in Multi-agent Multi-armed Bandit
por: Shao, Junning, et al.
Publicado: (2025)
por: Shao, Junning, et al.
Publicado: (2025)
Jump Start or False Start? A Theoretical and Empirical Evaluation of LLM-initialized Bandits
por: Bayley, Adam, et al.
Publicado: (2026)
por: Bayley, Adam, et al.
Publicado: (2026)
On the Low-Complexity of Fair Learning for Combinatorial Multi-Armed Bandit
por: Wu, Xiaoyi, et al.
Publicado: (2025)
por: Wu, Xiaoyi, et al.
Publicado: (2025)
Constrained Feedback Learning for Non-Stationary Multi-Armed Bandits
por: Li, Shaoang, et al.
Publicado: (2025)
por: Li, Shaoang, et al.
Publicado: (2025)
Multi-Objective Multi-Agent Bandits: From Learning Efficiency to Fairness Optimization
por: Wang, John, et al.
Publicado: (2026)
por: Wang, John, et al.
Publicado: (2026)
Are Stochastic Multi-objective Bandits Harder than Single-objective Bandits?
por: Guan, Changkun, et al.
Publicado: (2026)
por: Guan, Changkun, et al.
Publicado: (2026)
Locally Private Nonparametric Contextual Multi-armed Bandits
por: Ma, Yuheng, et al.
Publicado: (2025)
por: Ma, Yuheng, et al.
Publicado: (2025)
Transfer Learning for Contextual Multi-armed Bandits
por: Cai, Changxiao, et al.
Publicado: (2022)
por: Cai, Changxiao, et al.
Publicado: (2022)
Multi-Armed Bandits with Interference
por: Jia, Su, et al.
Publicado: (2024)
por: Jia, Su, et al.
Publicado: (2024)
Adversarial Multi-dueling Bandits
por: Gajane, Pratik
Publicado: (2024)
por: Gajane, Pratik
Publicado: (2024)
Multi-Agent Lipschitz Bandits
por: Chakraborty, Sourav, et al.
Publicado: (2026)
por: Chakraborty, Sourav, et al.
Publicado: (2026)
Imprecise Multi-Armed Bandits
por: Kosoy, Vanessa
Publicado: (2024)
por: Kosoy, Vanessa
Publicado: (2024)
Byzantine-Resilient Decentralized Multi-Armed Bandits
por: Zhu, Jingxuan, et al.
Publicado: (2023)
por: Zhu, Jingxuan, et al.
Publicado: (2023)
Block Sparse Bayesian Learning: A Diversified Scheme
por: Zhang, Yanhao, et al.
Publicado: (2024)
por: Zhang, Yanhao, et al.
Publicado: (2024)
Bayesian Analysis of Combinatorial Gaussian Process Bandits
por: Sandberg, Jack, et al.
Publicado: (2023)
por: Sandberg, Jack, et al.
Publicado: (2023)
Adapter-Augmented Bandits for Online Multi-Constrained Multi-Modal Inference Scheduling
por: Zhang, Xianzhi, et al.
Publicado: (2026)
por: Zhang, Xianzhi, et al.
Publicado: (2026)
On the Hardness of Bandit Learning
por: Brukhim, Nataly, et al.
Publicado: (2025)
por: Brukhim, Nataly, et al.
Publicado: (2025)
Indexed Minimum Empirical Divergence-Based Algorithms for Linear Bandits
por: Bian, Jie, et al.
Publicado: (2024)
por: Bian, Jie, et al.
Publicado: (2024)
Unified Framework of Distributional Regret in Multi-Armed Bandits and Reinforcement Learning
por: Lee, Harin, et al.
Publicado: (2026)
por: Lee, Harin, et al.
Publicado: (2026)
From Weighting to Modeling: A Nonparametric Estimator for Off-Policy Evaluation
por: Zhu, Rong J. B.
Publicado: (2026)
por: Zhu, Rong J. B.
Publicado: (2026)
Ejemplares similares
-
Bayesian Inference of Contextual Bandit Policies via Empirical Likelihood
por: Ouyang, Jiangrong, et al.
Publicado: (2026) -
Batched Nonparametric Contextual Bandits
por: Jiang, Rong, et al.
Publicado: (2024) -
Falcon: Fair Active Learning using Multi-armed Bandits
por: Tae, Ki Hyun, et al.
Publicado: (2024) -
Combinatorial Bandit Bayesian Optimization for Tensor Outputs
por: Huang, Jingru, et al.
Publicado: (2026) -
UCB Exploration for Fixed-Budget Bayesian Best Arm Identification
por: Zhu, Rong J. B., et al.
Publicado: (2024)