DAL: A Practical Prior-Free Black-Box Framework for Non-Stationary Bandits
Fuente:
arXiv
Salvato in:
| Autori principali: | Gerogiannis, Argyrios, Huang, Yu-Han, Bose, Subhonmesh, Veeravalli, Venugopal V. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Is Prior-Free Black-Box Non-Stationary Reinforcement Learning Feasible?
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2024)
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2024)
Detection Augmented Bandit Procedures for Piecewise Stationary MABs: A Modular Approach
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)
DARLING: Detection Augmented Reinforcement Learning with Non-Stationary Guarantees
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2026)
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2026)
Learning Where to Look: UCB-Driven Controlled Sensing for Quickest Change Detection
di: Huang, Yu-Han, et al.
Pubblicazione: (2026)
di: Huang, Yu-Han, et al.
Pubblicazione: (2026)
Track-MDP: Reinforcement Learning for Target Tracking with Controlled Sensing
di: Subramaniam, Adarsh M., et al.
Pubblicazione: (2024)
di: Subramaniam, Adarsh M., et al.
Pubblicazione: (2024)
Heterogeneous Multi-Player Multi-Armed Bandits Robust To Adversarial Attacks
di: Magesh, Akshayaa, et al.
Pubblicazione: (2025)
di: Magesh, Akshayaa, et al.
Pubblicazione: (2025)
Sequential Change Detection for Learning in Piecewise Stationary Bandit Environments
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)
Tangential Randomization in Linear Bandits (TRAiL): Guaranteed Inference and Regret Bounds
di: Güçlü, Arda, et al.
Pubblicazione: (2024)
di: Güçlü, Arda, et al.
Pubblicazione: (2024)
Finite-Horizon Quickest Change Detection Balancing Latency with False Alarm Probability
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)
Accelerating Divisible Load Processing Through Machine Learning: A Practical Framework for Large-Scale Workloads
di: Veeravalli, Bharadwaj
Pubblicazione: (2026)
di: Veeravalli, Bharadwaj
Pubblicazione: (2026)
A Practical Algorithm for Feature-Rich, Non-Stationary Bandit Problems
di: Loh, Wei Min, et al.
Pubblicazione: (2026)
di: Loh, Wei Min, et al.
Pubblicazione: (2026)
Non-Stationary Lipschitz Bandits
di: Nguyen, Nicolas, et al.
Pubblicazione: (2025)
di: Nguyen, Nicolas, et al.
Pubblicazione: (2025)
Principled Detection of Hallucinations in Large Language Models via Multiple Testing
di: Li, Jiawei, et al.
Pubblicazione: (2025)
di: Li, Jiawei, et al.
Pubblicazione: (2025)
Distributed and Rate-Adaptive Feature Compression
di: Deshmukh, Aditya, et al.
Pubblicazione: (2024)
di: Deshmukh, Aditya, et al.
Pubblicazione: (2024)
A Modularized Framework for Piecewise-Stationary Restless Bandits
di: Li, Kuan-Ta, et al.
Pubblicazione: (2026)
di: Li, Kuan-Ta, et al.
Pubblicazione: (2026)
Non-Stationary Restless Multi-Armed Bandits with Provable Guarantee
di: Hung, Yu-Heng, et al.
Pubblicazione: (2025)
di: Hung, Yu-Heng, et al.
Pubblicazione: (2025)
Adaptive Smooth Non-Stationary Bandits
di: Suk, Joe
Pubblicazione: (2024)
di: Suk, Joe
Pubblicazione: (2024)
Non-Stationary Bandit Learning via Predictive Sampling
di: Liu, Yueyang, et al.
Pubblicazione: (2022)
di: Liu, Yueyang, et al.
Pubblicazione: (2022)
Near-Optimal Algorithm for Non-Stationary Kernelized Bandits
di: Iwazaki, Shogo, et al.
Pubblicazione: (2024)
di: Iwazaki, Shogo, et al.
Pubblicazione: (2024)
Smooth Non-Stationary Bandits
di: Jia, Su, et al.
Pubblicazione: (2023)
di: Jia, Su, et al.
Pubblicazione: (2023)
Incentivized Exploration of Non-Stationary Stochastic Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2024)
di: Chakraborty, Sourav, et al.
Pubblicazione: (2024)
Non-Stationary Latent Auto-Regressive Bandits
di: Trella, Anna L., et al.
Pubblicazione: (2024)
di: Trella, Anna L., et al.
Pubblicazione: (2024)
Constrained Feedback Learning for Non-Stationary Multi-Armed Bandits
di: Li, Shaoang, et al.
Pubblicazione: (2025)
di: Li, Shaoang, et al.
Pubblicazione: (2025)
On The Complexity of Best-Arm Identification in Non-Stationary Linear Bandits
di: Maynard-Zhang, Leo, et al.
Pubblicazione: (2026)
di: Maynard-Zhang, Leo, et al.
Pubblicazione: (2026)
Partition Tree Weighting for Non-Stationary Stochastic Bandits
di: Veness, Joel, et al.
Pubblicazione: (2025)
di: Veness, Joel, et al.
Pubblicazione: (2025)
Contextual Bandits with Non-Stationary Correlated Rewards for User Association in MmWave Vehicular Networks
di: He, Xiaoyang, et al.
Pubblicazione: (2024)
di: He, Xiaoyang, et al.
Pubblicazione: (2024)
Fooling Algorithms in Non-Stationary Bandits using Belief Inertia
di: Mendelson, Gal, et al.
Pubblicazione: (2025)
di: Mendelson, Gal, et al.
Pubblicazione: (2025)
Weighted Sequential Bayesian Inference for Non-Stationary Linear Contextual Bandits
di: Werge, Nicklas, et al.
Pubblicazione: (2023)
di: Werge, Nicklas, et al.
Pubblicazione: (2023)
Non-Stationary Dueling Bandits Under a Weighted Borda Criterion
di: Suk, Joe, et al.
Pubblicazione: (2024)
di: Suk, Joe, et al.
Pubblicazione: (2024)
A Black-Box Debiasing Framework for Conditional Sampling
di: Cui, Han, et al.
Pubblicazione: (2025)
di: Cui, Han, et al.
Pubblicazione: (2025)
Nonparametric Sparse Online Learning of the Koopman Operator
di: Hou, Boya, et al.
Pubblicazione: (2025)
di: Hou, Boya, et al.
Pubblicazione: (2025)
Quickest Change Detection with Confusing Change
di: Chen, Yu-Zhen Janice, et al.
Pubblicazione: (2024)
di: Chen, Yu-Zhen Janice, et al.
Pubblicazione: (2024)
Near-Optimal Regret for Distributed Adversarial Bandits: A Black-Box Approach
di: Qiu, Hao, et al.
Pubblicazione: (2026)
di: Qiu, Hao, et al.
Pubblicazione: (2026)
Online Learning of Whittle Indices for Restless Bandits with Non-Stationary Transition Kernels
di: Shisher, Md Kamran Chowdhury, et al.
Pubblicazione: (2025)
di: Shisher, Md Kamran Chowdhury, et al.
Pubblicazione: (2025)
Diminishing Exploration: A Minimalist Approach to Piecewise Stationary Multi-Armed Bandits
di: Li, Kuan-Ta, et al.
Pubblicazione: (2024)
di: Li, Kuan-Ta, et al.
Pubblicazione: (2024)
High Probability Latency Sequential Change Detection over an Unknown Finite Horizon
di: Huang, Yu-Han, et al.
Pubblicazione: (2024)
di: Huang, Yu-Han, et al.
Pubblicazione: (2024)
Sampling as Bandits: Evaluation-Efficient Design for Black-Box Densities
di: Matsubara, Takuo, et al.
Pubblicazione: (2025)
di: Matsubara, Takuo, et al.
Pubblicazione: (2025)
Adaptive Requesting in Decentralized Edge Networks via Non-Stationary Bandits
di: Zhuang, Yi, et al.
Pubblicazione: (2026)
di: Zhuang, Yi, et al.
Pubblicazione: (2026)
Catoni-Style Change Point Detection for Regret Minimization in Non-Stationary Heavy-Tailed Bandits
di: Genalti, Gianmarco, et al.
Pubblicazione: (2025)
di: Genalti, Gianmarco, et al.
Pubblicazione: (2025)
Practical Black Box Hamiltonian Learning
di: Gu, Andi, et al.
Pubblicazione: (2022)
di: Gu, Andi, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Is Prior-Free Black-Box Non-Stationary Reinforcement Learning Feasible?
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2024) -
Detection Augmented Bandit Procedures for Piecewise Stationary MABs: A Modular Approach
di: Huang, Yu-Han, et al.
Pubblicazione: (2025) -
DARLING: Detection Augmented Reinforcement Learning with Non-Stationary Guarantees
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2026) -
Learning Where to Look: UCB-Driven Controlled Sensing for Quickest Change Detection
di: Huang, Yu-Han, et al.
Pubblicazione: (2026) -
Track-MDP: Reinforcement Learning for Target Tracking with Controlled Sensing
di: Subramaniam, Adarsh M., et al.
Pubblicazione: (2024)