Empirical Bayesian Multi-Bandit Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Xia, Zhu, Rong J. B. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Bayesian Inference of Contextual Bandit Policies via Empirical Likelihood
par: Ouyang, Jiangrong, et autres
Publié: (2026)
par: Ouyang, Jiangrong, et autres
Publié: (2026)
Batched Nonparametric Contextual Bandits
par: Jiang, Rong, et autres
Publié: (2024)
par: Jiang, Rong, et autres
Publié: (2024)
Falcon: Fair Active Learning using Multi-armed Bandits
par: Tae, Ki Hyun, et autres
Publié: (2024)
par: Tae, Ki Hyun, et autres
Publié: (2024)
Combinatorial Bandit Bayesian Optimization for Tensor Outputs
par: Huang, Jingru, et autres
Publié: (2026)
par: Huang, Jingru, et autres
Publié: (2026)
UCB Exploration for Fixed-Budget Bayesian Best Arm Identification
par: Zhu, Rong J. B., et autres
Publié: (2024)
par: Zhu, Rong J. B., et autres
Publié: (2024)
High dimensional Bayesian Optimization via Condensing-Expansion Projection
par: Lu, Jiaming, et autres
Publié: (2024)
par: Lu, Jiaming, et autres
Publié: (2024)
Bayesian Bandit Algorithms with Approximate Inference in Stochastic Linear Bandits
par: Huang, Ziyi, et autres
Publié: (2024)
par: Huang, Ziyi, et autres
Publié: (2024)
The Adaptivity Barrier in Batched Nonparametric Bandits: Sharp Characterization of the Price of Unknown Margin
par: Jiang, Rong, et autres
Publié: (2025)
par: Jiang, Rong, et autres
Publié: (2025)
Bayesian Regret Minimization in Offline Bandits
par: Petrik, Marek, et autres
Publié: (2023)
par: Petrik, Marek, et autres
Publié: (2023)
Minimum Empirical Divergence for Sub-Gaussian Linear Bandits
par: Balagopalan, Kapilan, et autres
Publié: (2024)
par: Balagopalan, Kapilan, et autres
Publié: (2024)
Offline Learning for Combinatorial Multi-armed Bandits
par: Liu, Xutong, et autres
Publié: (2025)
par: Liu, Xutong, et autres
Publié: (2025)
Multi-Armed Bandits With Machine Learning-Generated Surrogate Rewards
par: Ji, Wenlong, et autres
Publié: (2025)
par: Ji, Wenlong, et autres
Publié: (2025)
High-dimensional Linear Bandits with Knapsacks
par: Ma, Wanteng, et autres
Publié: (2023)
par: Ma, Wanteng, et autres
Publié: (2023)
Empirical Bound Information-Directed Sampling for Norm-Agnostic Bandits
par: Suder, Piotr M., et autres
Publié: (2025)
par: Suder, Piotr M., et autres
Publié: (2025)
Bandits with Stochastic Experts: Constant Regret, Empirical Experts and Episodes
par: Sharma, Nihal, et autres
Publié: (2021)
par: Sharma, Nihal, et autres
Publié: (2021)
Multi-thresholding Good Arm Identification with Bandit Feedback
par: Jiang, Xuanke, et autres
Publié: (2025)
par: Jiang, Xuanke, et autres
Publié: (2025)
Sequential Learning of the Pareto Front for Multi-objective Bandits
par: Crépon, Elise, et autres
Publié: (2025)
par: Crépon, Elise, et autres
Publié: (2025)
Learning Shared Representations for Multi-Task Linear Bandits
par: Lin, Jiabin, et autres
Publié: (2026)
par: Lin, Jiabin, et autres
Publié: (2026)
Multi-Task Representation Learning for Conservative Linear Bandits
par: Lin, Jiabin, et autres
Publié: (2026)
par: Lin, Jiabin, et autres
Publié: (2026)
Bandit Learning in General Open Multi-agent Systems
par: Xu, Mengfan
Publié: (2026)
par: Xu, Mengfan
Publié: (2026)
Learning with Limited Shared Information in Multi-agent Multi-armed Bandit
par: Shao, Junning, et autres
Publié: (2025)
par: Shao, Junning, et autres
Publié: (2025)
Jump Start or False Start? A Theoretical and Empirical Evaluation of LLM-initialized Bandits
par: Bayley, Adam, et autres
Publié: (2026)
par: Bayley, Adam, et autres
Publié: (2026)
On the Low-Complexity of Fair Learning for Combinatorial Multi-Armed Bandit
par: Wu, Xiaoyi, et autres
Publié: (2025)
par: Wu, Xiaoyi, et autres
Publié: (2025)
Constrained Feedback Learning for Non-Stationary Multi-Armed Bandits
par: Li, Shaoang, et autres
Publié: (2025)
par: Li, Shaoang, et autres
Publié: (2025)
Multi-Objective Multi-Agent Bandits: From Learning Efficiency to Fairness Optimization
par: Wang, John, et autres
Publié: (2026)
par: Wang, John, et autres
Publié: (2026)
Are Stochastic Multi-objective Bandits Harder than Single-objective Bandits?
par: Guan, Changkun, et autres
Publié: (2026)
par: Guan, Changkun, et autres
Publié: (2026)
Locally Private Nonparametric Contextual Multi-armed Bandits
par: Ma, Yuheng, et autres
Publié: (2025)
par: Ma, Yuheng, et autres
Publié: (2025)
Transfer Learning for Contextual Multi-armed Bandits
par: Cai, Changxiao, et autres
Publié: (2022)
par: Cai, Changxiao, et autres
Publié: (2022)
Multi-Armed Bandits with Interference
par: Jia, Su, et autres
Publié: (2024)
par: Jia, Su, et autres
Publié: (2024)
Adversarial Multi-dueling Bandits
par: Gajane, Pratik
Publié: (2024)
par: Gajane, Pratik
Publié: (2024)
Multi-Agent Lipschitz Bandits
par: Chakraborty, Sourav, et autres
Publié: (2026)
par: Chakraborty, Sourav, et autres
Publié: (2026)
Imprecise Multi-Armed Bandits
par: Kosoy, Vanessa
Publié: (2024)
par: Kosoy, Vanessa
Publié: (2024)
Byzantine-Resilient Decentralized Multi-Armed Bandits
par: Zhu, Jingxuan, et autres
Publié: (2023)
par: Zhu, Jingxuan, et autres
Publié: (2023)
Block Sparse Bayesian Learning: A Diversified Scheme
par: Zhang, Yanhao, et autres
Publié: (2024)
par: Zhang, Yanhao, et autres
Publié: (2024)
Bayesian Analysis of Combinatorial Gaussian Process Bandits
par: Sandberg, Jack, et autres
Publié: (2023)
par: Sandberg, Jack, et autres
Publié: (2023)
Adapter-Augmented Bandits for Online Multi-Constrained Multi-Modal Inference Scheduling
par: Zhang, Xianzhi, et autres
Publié: (2026)
par: Zhang, Xianzhi, et autres
Publié: (2026)
On the Hardness of Bandit Learning
par: Brukhim, Nataly, et autres
Publié: (2025)
par: Brukhim, Nataly, et autres
Publié: (2025)
Indexed Minimum Empirical Divergence-Based Algorithms for Linear Bandits
par: Bian, Jie, et autres
Publié: (2024)
par: Bian, Jie, et autres
Publié: (2024)
Unified Framework of Distributional Regret in Multi-Armed Bandits and Reinforcement Learning
par: Lee, Harin, et autres
Publié: (2026)
par: Lee, Harin, et autres
Publié: (2026)
From Weighting to Modeling: A Nonparametric Estimator for Off-Policy Evaluation
par: Zhu, Rong J. B.
Publié: (2026)
par: Zhu, Rong J. B.
Publié: (2026)
Documents similaires
-
Bayesian Inference of Contextual Bandit Policies via Empirical Likelihood
par: Ouyang, Jiangrong, et autres
Publié: (2026) -
Batched Nonparametric Contextual Bandits
par: Jiang, Rong, et autres
Publié: (2024) -
Falcon: Fair Active Learning using Multi-armed Bandits
par: Tae, Ki Hyun, et autres
Publié: (2024) -
Combinatorial Bandit Bayesian Optimization for Tensor Outputs
par: Huang, Jingru, et autres
Publié: (2026) -
UCB Exploration for Fixed-Budget Bayesian Best Arm Identification
par: Zhu, Rong J. B., et autres
Publié: (2024)