Pure Exploration for Constrained Best Mixed Arm Identification with a Fixed Budget
Fuente:
arXiv
Salvato in:
| Autori principali: | Tang, Dengwang, Jain, Rahul, Nayyar, Ashutosh, Nuzzo, Pierluigi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Posterior Sampling-based Online Learning for Episodic POMDPs
di: Tang, Dengwang, et al.
Pubblicazione: (2023)
di: Tang, Dengwang, et al.
Pubblicazione: (2023)
UCB Exploration for Fixed-Budget Bayesian Best Arm Identification
di: Zhu, Rong J. B., et al.
Pubblicazione: (2024)
di: Zhu, Rong J. B., et al.
Pubblicazione: (2024)
An Algorithm for Fixed Budget Best Arm Identification with Combinatorial Exploration
di: Parupudi, Siddhartha, et al.
Pubblicazione: (2025)
di: Parupudi, Siddhartha, et al.
Pubblicazione: (2025)
Fixed-Budget Constrained Best Arm Identification in Grouped Bandits
di: Mukherjee, Raunak, et al.
Pubblicazione: (2026)
di: Mukherjee, Raunak, et al.
Pubblicazione: (2026)
Risk-Averse Best Arm Set Identification with Fixed Budget and Fixed Confidence
di: Nonaga, Shunta, et al.
Pubblicazione: (2025)
di: Nonaga, Shunta, et al.
Pubblicazione: (2025)
Best Arm Identification with Fixed Budget: A Large Deviation Perspective
di: Wang, Po-An, et al.
Pubblicazione: (2023)
di: Wang, Po-An, et al.
Pubblicazione: (2023)
Fixed-Budget Differentially Private Best Arm Identification
di: Chen, Zhirui, et al.
Pubblicazione: (2024)
di: Chen, Zhirui, et al.
Pubblicazione: (2024)
Asymptotically Optimal Linear Best Feasible Arm Identification with Fixed Budget
di: Bian, Jie, et al.
Pubblicazione: (2025)
di: Bian, Jie, et al.
Pubblicazione: (2025)
Prior-Dependent Allocations for Bayesian Fixed-Budget Best-Arm Identification in Structured Bandits
di: Nguyen, Nicolas, et al.
Pubblicazione: (2024)
di: Nguyen, Nicolas, et al.
Pubblicazione: (2024)
Fixed Budget is No Harder Than Fixed Confidence in Best-Arm Identification up to Logarithmic Factors
di: Balagopalan, Kapilan, et al.
Pubblicazione: (2026)
di: Balagopalan, Kapilan, et al.
Pubblicazione: (2026)
When Dynamics Shift, Robust Task Inference Wins: Offline Imitation Learning with Behavior Foundation Models Revisited
di: Agrawal, Rishabh, et al.
Pubblicazione: (2026)
di: Agrawal, Rishabh, et al.
Pubblicazione: (2026)
Compositional Planning for Logically Constrained Multi-Agent Markov Decision Processes
di: Kalagarla, Krishna C., et al.
Pubblicazione: (2024)
di: Kalagarla, Krishna C., et al.
Pubblicazione: (2024)
Worst-Case Optimal Multi-Armed Gaussian Best Arm Identification with a Fixed Budget
di: Kato, Masahiro
Pubblicazione: (2023)
di: Kato, Masahiro
Pubblicazione: (2023)
Thompson Exploration with Best Challenger Rule in Best Arm Identification
di: Lee, Jongyeong, et al.
Pubblicazione: (2023)
di: Lee, Jongyeong, et al.
Pubblicazione: (2023)
Fair Best Arm Identification with Fixed Confidence
di: Russo, Alessio, et al.
Pubblicazione: (2024)
di: Russo, Alessio, et al.
Pubblicazione: (2024)
Fixed Confidence Best Arm Identification in the Bayesian Setting
di: Jang, Kyoungseok, et al.
Pubblicazione: (2024)
di: Jang, Kyoungseok, et al.
Pubblicazione: (2024)
Constrained Best Arm Identification in Grouped Bandits
di: Dharod, Sahil, et al.
Pubblicazione: (2024)
di: Dharod, Sahil, et al.
Pubblicazione: (2024)
A Bayesian Learning Algorithm for Unknown Zero-sum Stochastic Games with an Arbitrary Opponent
di: Jafarnia-Jahromi, Mehdi, et al.
Pubblicazione: (2021)
di: Jafarnia-Jahromi, Mehdi, et al.
Pubblicazione: (2021)
Equivalent and Compact Representations of Neural Network Controllers With Decision Trees
di: Chang, Kevin, et al.
Pubblicazione: (2023)
di: Chang, Kevin, et al.
Pubblicazione: (2023)
Markov Balance Satisfaction Improves Performance in Strictly Batch Offline Imitation Learning
di: Agrawal, Rishabh, et al.
Pubblicazione: (2024)
di: Agrawal, Rishabh, et al.
Pubblicazione: (2024)
Balance Equation-based Distributionally Robust Offline Imitation Learning
di: Agrawal, Rishabh, et al.
Pubblicazione: (2025)
di: Agrawal, Rishabh, et al.
Pubblicazione: (2025)
Constrained Best Arm Identification with Tests for Feasibility
di: Cai, Ting, et al.
Pubblicazione: (2025)
di: Cai, Ting, et al.
Pubblicazione: (2025)
Stochastically Constrained Best Arm Identification with Thompson Sampling
di: Yang, Le, et al.
Pubblicazione: (2025)
di: Yang, Le, et al.
Pubblicazione: (2025)
Locally Optimal Fixed-Budget Best Arm Identification in Two-Armed Gaussian Bandits with Unknown Variances
di: Kato, Masahiro
Pubblicazione: (2023)
di: Kato, Masahiro
Pubblicazione: (2023)
Optimal Control of Logically Constrained Partially Observable and Multi-Agent Markov Decision Processes
di: Kalagarla, Krishna C., et al.
Pubblicazione: (2023)
di: Kalagarla, Krishna C., et al.
Pubblicazione: (2023)
Fixed-Confidence Best Arm Identification with Decreasing Variance
di: Roychowdhury, Tamojeet, et al.
Pubblicazione: (2025)
di: Roychowdhury, Tamojeet, et al.
Pubblicazione: (2025)
Optimal Best Arm Identification with Fixed Confidence in Restless Bandits
di: Karthik, P. N., et al.
Pubblicazione: (2023)
di: Karthik, P. N., et al.
Pubblicazione: (2023)
Optimal Batched Best Arm Identification
di: Jin, Tianyuan, et al.
Pubblicazione: (2023)
di: Jin, Tianyuan, et al.
Pubblicazione: (2023)
Fixing the Loose Brake: Exponential-Tailed Stopping Time in Best Arm Identification
di: Balagopalan, Kapilan, et al.
Pubblicazione: (2024)
di: Balagopalan, Kapilan, et al.
Pubblicazione: (2024)
Optimal Multi-Objective Best Arm Identification with Fixed Confidence
di: Chen, Zhirui, et al.
Pubblicazione: (2025)
di: Chen, Zhirui, et al.
Pubblicazione: (2025)
Optimal Best-Arm Identification under Fixed Confidence with Multiple Optima
di: Truong, Lan V.
Pubblicazione: (2025)
di: Truong, Lan V.
Pubblicazione: (2025)
Bayesian Learning in Episodic Zero-Sum Games
di: Yueh, Chang-Wei, et al.
Pubblicazione: (2026)
di: Yueh, Chang-Wei, et al.
Pubblicazione: (2026)
Learning with a Budget: Identifying the Best Arm with Resource Constraints
di: Li, Zitian, et al.
Pubblicazione: (2026)
di: Li, Zitian, et al.
Pubblicazione: (2026)
Efficient Online Learning with Offline Datasets for Infinite Horizon MDPs: A Bayesian Approach
di: Tang, Dengwang, et al.
Pubblicazione: (2023)
di: Tang, Dengwang, et al.
Pubblicazione: (2023)
Best Arm Identification with Resource Constraints
di: Li, Zitian, et al.
Pubblicazione: (2024)
di: Li, Zitian, et al.
Pubblicazione: (2024)
Cost Aware Best Arm Identification
di: Kanarios, Kellen, et al.
Pubblicazione: (2024)
di: Kanarios, Kellen, et al.
Pubblicazione: (2024)
Variance-Optimal Arm Selection: Misallocation Minimization and Best Arm Identification
di: Khurshid, Sabrina, et al.
Pubblicazione: (2025)
di: Khurshid, Sabrina, et al.
Pubblicazione: (2025)
Optimal Multi-Fidelity Best-Arm Identification
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
Balancing Performance and Costs in Best Arm Identification
di: Harding, Michael O., et al.
Pubblicazione: (2025)
di: Harding, Michael O., et al.
Pubblicazione: (2025)
Best Arm Identification for Stochastic Rising Bandits
di: Mussi, Marco, et al.
Pubblicazione: (2023)
di: Mussi, Marco, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Posterior Sampling-based Online Learning for Episodic POMDPs
di: Tang, Dengwang, et al.
Pubblicazione: (2023) -
UCB Exploration for Fixed-Budget Bayesian Best Arm Identification
di: Zhu, Rong J. B., et al.
Pubblicazione: (2024) -
An Algorithm for Fixed Budget Best Arm Identification with Combinatorial Exploration
di: Parupudi, Siddhartha, et al.
Pubblicazione: (2025) -
Fixed-Budget Constrained Best Arm Identification in Grouped Bandits
di: Mukherjee, Raunak, et al.
Pubblicazione: (2026) -
Risk-Averse Best Arm Set Identification with Fixed Budget and Fixed Confidence
di: Nonaga, Shunta, et al.
Pubblicazione: (2025)