An Adaptive Approach for Infinitely Many-armed Bandits under Generalized Rotting Constraints
Fuente:
arXiv
Salvato in:
| Autori principali: | Kim, Jung-hun, Vojnovic, Milan, Yun, Se-Young |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Oracle-Efficient Combinatorial Semi-Bandits
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
Adversarial Bandits against Arbitrary Strategies
di: Kim, Jung-hun, et al.
Pubblicazione: (2022)
di: Kim, Jung-hun, et al.
Pubblicazione: (2022)
Learning to Schedule in Parallel-Server Queues with Stochastic Bilinear Rewards
di: Kim, Jung-hun, et al.
Pubblicazione: (2021)
di: Kim, Jung-hun, et al.
Pubblicazione: (2021)
What is the Alignment Objective of GRPO?
di: Vojnovic, Milan, et al.
Pubblicazione: (2025)
di: Vojnovic, Milan, et al.
Pubblicazione: (2025)
Tracking Most Significant Shifts in Infinite-Armed Bandits
di: Suk, Joe, et al.
Pubblicazione: (2025)
di: Suk, Joe, et al.
Pubblicazione: (2025)
Contextual Linear Bandits under Noisy Features: Towards Bayesian Oracles
di: Kim, Jung-hun, et al.
Pubblicazione: (2017)
di: Kim, Jung-hun, et al.
Pubblicazione: (2017)
Queueing Matching Bandits with Preference Feedback
di: Kim, Jung-hun, et al.
Pubblicazione: (2024)
di: Kim, Jung-hun, et al.
Pubblicazione: (2024)
GL-LowPopArt: A Nearly Instance-Wise Minimax-Optimal Estimator for Generalized Low-Rank Trace Regression
di: Lee, Junghyun, et al.
Pubblicazione: (2025)
di: Lee, Junghyun, et al.
Pubblicazione: (2025)
Stochastic Matching Bandits with Rare Optimization Updates
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
A Jointly Efficient and Optimal Algorithm for Heteroskedastic Generalized Linear Bandits with Adversarial Corruptions
di: Kim, Sanghwa, et al.
Pubblicazione: (2026)
di: Kim, Sanghwa, et al.
Pubblicazione: (2026)
A Unified Confidence Sequence for Generalized Linear Models, with Applications to Bandits
di: Lee, Junghyun, et al.
Pubblicazione: (2024)
di: Lee, Junghyun, et al.
Pubblicazione: (2024)
Learning in Prophet Inequalities with Noisy Observations
di: Kim, Jung-hun, et al.
Pubblicazione: (2026)
di: Kim, Jung-hun, et al.
Pubblicazione: (2026)
Dynamic Assortment Selection and Pricing with Censored Preference Feedback
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
Probability-Flow ODE in Infinite-Dimensional Function Spaces
di: Na, Kunwoo, et al.
Pubblicazione: (2025)
di: Na, Kunwoo, et al.
Pubblicazione: (2025)
Improved Regret Bounds of (Multinomial) Logistic Bandits via Regret-to-Confidence-Set Conversion
di: Lee, Junghyun, et al.
Pubblicazione: (2023)
di: Lee, Junghyun, et al.
Pubblicazione: (2023)
Optimal Control of Fluid Restless Multi-armed Bandits: A Machine Learning Approach
di: Bertsimas, Dimitris, et al.
Pubblicazione: (2025)
di: Bertsimas, Dimitris, et al.
Pubblicazione: (2025)
Adaptive Endpointing with Deep Contextual Multi-armed Bandits
di: Min, Do June, et al.
Pubblicazione: (2023)
di: Min, Do June, et al.
Pubblicazione: (2023)
Bridging Rested and Restless Bandits with Graph-Triggering: Rising and Rotting
di: Genalti, Gianmarco, et al.
Pubblicazione: (2024)
di: Genalti, Gianmarco, et al.
Pubblicazione: (2024)
Flooding with Absorption: An Efficient Protocol for Heterogeneous Bandits over Complex Networks
di: Lee, Junghyun, et al.
Pubblicazione: (2023)
di: Lee, Junghyun, et al.
Pubblicazione: (2023)
Multi-armed Bandits with Missing Outcome
di: Mahrooghi, Ilia, et al.
Pubblicazione: (2024)
di: Mahrooghi, Ilia, et al.
Pubblicazione: (2024)
On the Convergence of Multicalibration Gradient Boosting
di: Haimovich, Daniel, et al.
Pubblicazione: (2026)
di: Haimovich, Daniel, et al.
Pubblicazione: (2026)
No-Regret is not enough! Bandits with General Constraints through Adaptive Regret Minimization
di: Bernasconi, Martino, et al.
Pubblicazione: (2024)
di: Bernasconi, Martino, et al.
Pubblicazione: (2024)
Replicability is Asymptotically Free in Multi-armed Bandits
di: Komiyama, Junpei, et al.
Pubblicazione: (2024)
di: Komiyama, Junpei, et al.
Pubblicazione: (2024)
Maximal Objectives in the Multi-armed Bandit with Applications
di: Ozbay, Eren, et al.
Pubblicazione: (2020)
di: Ozbay, Eren, et al.
Pubblicazione: (2020)
Offline Learning for Combinatorial Multi-armed Bandits
di: Liu, Xutong, et al.
Pubblicazione: (2025)
di: Liu, Xutong, et al.
Pubblicazione: (2025)
Distributed Linear Bandits under Communication Constraints
di: Salgia, Sudeep, et al.
Pubblicazione: (2022)
di: Salgia, Sudeep, et al.
Pubblicazione: (2022)
Causally Abstracted Multi-armed Bandits
di: Zennaro, Fabio Massimo, et al.
Pubblicazione: (2024)
di: Zennaro, Fabio Massimo, et al.
Pubblicazione: (2024)
Deceptive Exploration in Multi-armed Bandits
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025)
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025)
KLASS: KL-Guided Fast Inference in Masked Diffusion Models
di: Kim, Seo Hyun, et al.
Pubblicazione: (2025)
di: Kim, Seo Hyun, et al.
Pubblicazione: (2025)
On the Convergence of Loss and Uncertainty-based Active Learning Algorithms
di: Haimovich, Daniel, et al.
Pubblicazione: (2023)
di: Haimovich, Daniel, et al.
Pubblicazione: (2023)
Fairness of Exposure in Online Restless Multi-armed Bandits
di: Sood, Archit, et al.
Pubblicazione: (2024)
di: Sood, Archit, et al.
Pubblicazione: (2024)
Federated $\mathcal{X}$-armed Bandit with Flexible Personalisation
di: Arabzadeh, Ali, et al.
Pubblicazione: (2024)
di: Arabzadeh, Ali, et al.
Pubblicazione: (2024)
Revisiting Early-Learning Regularization When Federated Learning Meets Noisy Labels
di: Kim, Taehyeon, et al.
Pubblicazione: (2024)
di: Kim, Taehyeon, et al.
Pubblicazione: (2024)
Transfer Learning for Contextual Multi-armed Bandits
di: Cai, Changxiao, et al.
Pubblicazione: (2022)
di: Cai, Changxiao, et al.
Pubblicazione: (2022)
Hypernetwork-Driven Model Fusion for Federated Domain Generalization
di: Bartholet, Marc, et al.
Pubblicazione: (2024)
di: Bartholet, Marc, et al.
Pubblicazione: (2024)
Temporal Alignment Guidance: On-Manifold Sampling in Diffusion Models
di: Park, Youngrok, et al.
Pubblicazione: (2025)
di: Park, Youngrok, et al.
Pubblicazione: (2025)
Locally Private Nonparametric Contextual Multi-armed Bandits
di: Ma, Yuheng, et al.
Pubblicazione: (2025)
di: Ma, Yuheng, et al.
Pubblicazione: (2025)
Transfer in Sequential Multi-armed Bandits via Reward Samples
di: R, Rahul N, et al.
Pubblicazione: (2024)
di: R, Rahul N, et al.
Pubblicazione: (2024)
Falcon: Fair Active Learning using Multi-armed Bandits
di: Tae, Ki Hyun, et al.
Pubblicazione: (2024)
di: Tae, Ki Hyun, et al.
Pubblicazione: (2024)
Continuum-armed Bandit Optimization with Batch Pairwise Comparison Oracles
di: Chang, Xiangyu, et al.
Pubblicazione: (2025)
di: Chang, Xiangyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Oracle-Efficient Combinatorial Semi-Bandits
di: Kim, Jung-hun, et al.
Pubblicazione: (2025) -
Adversarial Bandits against Arbitrary Strategies
di: Kim, Jung-hun, et al.
Pubblicazione: (2022) -
Learning to Schedule in Parallel-Server Queues with Stochastic Bilinear Rewards
di: Kim, Jung-hun, et al.
Pubblicazione: (2021) -
What is the Alignment Objective of GRPO?
di: Vojnovic, Milan, et al.
Pubblicazione: (2025) -
Tracking Most Significant Shifts in Infinite-Armed Bandits
di: Suk, Joe, et al.
Pubblicazione: (2025)