Detection Augmented Bandit Procedures for Piecewise Stationary MABs: A Modular Approach
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Yu-Han, Gerogiannis, Argyrios, Bose, Subhonmesh, Veeravalli, Venugopal V. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DAL: A Practical Prior-Free Black-Box Framework for Non-Stationary Bandits
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2025)
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2025)
Learning Where to Look: UCB-Driven Controlled Sensing for Quickest Change Detection
di: Huang, Yu-Han, et al.
Pubblicazione: (2026)
di: Huang, Yu-Han, et al.
Pubblicazione: (2026)
Is Prior-Free Black-Box Non-Stationary Reinforcement Learning Feasible?
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2024)
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2024)
DARLING: Detection Augmented Reinforcement Learning with Non-Stationary Guarantees
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2026)
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2026)
Sequential Change Detection for Learning in Piecewise Stationary Bandit Environments
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)
Tangential Randomization in Linear Bandits (TRAiL): Guaranteed Inference and Regret Bounds
di: Güçlü, Arda, et al.
Pubblicazione: (2024)
di: Güçlü, Arda, et al.
Pubblicazione: (2024)
Convolutional Neural Networks for Accurate Measurement of Train Speed
di: Tian, Haitao, et al.
Pubblicazione: (2025)
di: Tian, Haitao, et al.
Pubblicazione: (2025)
Newton's Lantern: A Reinforcement Learning Framework for Finetuning AC Power Flow Warm Start Models
di: Bose, Shourya, et al.
Pubblicazione: (2026)
di: Bose, Shourya, et al.
Pubblicazione: (2026)
WARP: A Benchmark for Primal-Dual Warm-Starting of Interior-Point Solvers
di: Suri, Dhruv, et al.
Pubblicazione: (2026)
di: Suri, Dhruv, et al.
Pubblicazione: (2026)
Nonparametric Sparse Online Learning of the Koopman Operator
di: Hou, Boya, et al.
Pubblicazione: (2025)
di: Hou, Boya, et al.
Pubblicazione: (2025)
High Probability Latency Sequential Change Detection over an Unknown Finite Horizon
di: Huang, Yu-Han, et al.
Pubblicazione: (2024)
di: Huang, Yu-Han, et al.
Pubblicazione: (2024)
Principled Detection of Hallucinations in Large Language Models via Multiple Testing
di: Li, Jiawei, et al.
Pubblicazione: (2025)
di: Li, Jiawei, et al.
Pubblicazione: (2025)
Track-MDP: Reinforcement Learning for Target Tracking with Controlled Sensing
di: Subramaniam, Adarsh M., et al.
Pubblicazione: (2024)
di: Subramaniam, Adarsh M., et al.
Pubblicazione: (2024)
Smooth Non-Stationary Bandits
di: Jia, Su, et al.
Pubblicazione: (2023)
di: Jia, Su, et al.
Pubblicazione: (2023)
ADLight: A Universal Approach of Traffic Signal Control with Augmented Data Using Reinforcement Learning
di: Wang, Maonan, et al.
Pubblicazione: (2022)
di: Wang, Maonan, et al.
Pubblicazione: (2022)
MA-VAE: Multi-head Attention-based Variational Autoencoder Approach for Anomaly Detection in Multivariate Time-series Applied to Automotive Endurance Powertrain Testing
di: Correia, Lucas, et al.
Pubblicazione: (2023)
di: Correia, Lucas, et al.
Pubblicazione: (2023)
ART for Diffusion Sampling: A Reinforcement Learning Approach to Timestep Schedule
di: Huang, Yilie, et al.
Pubblicazione: (2026)
di: Huang, Yilie, et al.
Pubblicazione: (2026)
Can We Ignore Labels In Out of Distribution Detection?
di: Yang, Hong, et al.
Pubblicazione: (2025)
di: Yang, Hong, et al.
Pubblicazione: (2025)
CycLight: learning traffic signal cooperation with a cycle-level strategy
di: Han, Gengyue, et al.
Pubblicazione: (2024)
di: Han, Gengyue, et al.
Pubblicazione: (2024)
Generative Modeling and Data Augmentation for Power System Production Simulation
di: Xu, Linna, et al.
Pubblicazione: (2024)
di: Xu, Linna, et al.
Pubblicazione: (2024)
SEAL: SEmantic-Augmented Imitation Learning via Language Model
di: Gu, Chengyang, et al.
Pubblicazione: (2024)
di: Gu, Chengyang, et al.
Pubblicazione: (2024)
Bench-MFG: A Benchmark Suite for Learning in Stationary Mean Field Games
di: Magnino, Lorenzo, et al.
Pubblicazione: (2026)
di: Magnino, Lorenzo, et al.
Pubblicazione: (2026)
Learning to Spend: Model Predictive Control for Budgeting under Non-Stationary Returns
di: Pathak, Nilavra, et al.
Pubblicazione: (2026)
di: Pathak, Nilavra, et al.
Pubblicazione: (2026)
Industrial Energy Disaggregation with Digital Twin-generated Dataset and Efficient Data Augmentation
di: Internò, Christian, et al.
Pubblicazione: (2025)
di: Internò, Christian, et al.
Pubblicazione: (2025)
Solving Continuous Mean Field Games: Deep Reinforcement Learning for Non-Stationary Dynamics
di: Magnino, Lorenzo, et al.
Pubblicazione: (2025)
di: Magnino, Lorenzo, et al.
Pubblicazione: (2025)
Data-Driven Exploration for a Class of Continuous-Time Indefinite Linear--Quadratic Reinforcement Learning Problems
di: Huang, Yilie, et al.
Pubblicazione: (2025)
di: Huang, Yilie, et al.
Pubblicazione: (2025)
Distributed and Rate-Adaptive Feature Compression
di: Deshmukh, Aditya, et al.
Pubblicazione: (2024)
di: Deshmukh, Aditya, et al.
Pubblicazione: (2024)
PACD-Net: Pseudo-Augmented Contrastive Distillation for Glycemic Control Estimation from SMBG
di: Lei, Canyu, et al.
Pubblicazione: (2026)
di: Lei, Canyu, et al.
Pubblicazione: (2026)
Feature Engineering Approach to Building Load Prediction: A Case Study for Commercial Building Chiller Plant Optimization in Tropical Weather
di: Wang, Zhan, et al.
Pubblicazione: (2025)
di: Wang, Zhan, et al.
Pubblicazione: (2025)
Online Model-based Anomaly Detection in Multivariate Time Series: Taxonomy, Survey, Research Challenges and Future Directions
di: Correia, Lucas, et al.
Pubblicazione: (2024)
di: Correia, Lucas, et al.
Pubblicazione: (2024)
Sublinear Regret for a Class of Continuous-Time Linear-Quadratic Reinforcement Learning Problems
di: Huang, Yilie, et al.
Pubblicazione: (2024)
di: Huang, Yilie, et al.
Pubblicazione: (2024)
MuaLLM: A Multimodal Large Language Model Agent for Circuit Design Assistance with Hybrid Contextual Retrieval-Augmented Generation
di: Abbineni, Pravallika, et al.
Pubblicazione: (2025)
di: Abbineni, Pravallika, et al.
Pubblicazione: (2025)
A Systems Theoretic Approach to Online Machine Learning
di: Preez, Anli du, et al.
Pubblicazione: (2024)
di: Preez, Anli du, et al.
Pubblicazione: (2024)
Novelty Detection in Reinforcement Learning with World Models
di: Zollicoffer, Geigh, et al.
Pubblicazione: (2023)
di: Zollicoffer, Geigh, et al.
Pubblicazione: (2023)
LEGOMem: Modular Procedural Memory for Multi-agent LLM Systems for Workflow Automation
di: Han, Dongge, et al.
Pubblicazione: (2025)
di: Han, Dongge, et al.
Pubblicazione: (2025)
Integrating Physics-Based and Data-Driven Approaches for Probabilistic Building Energy Modeling
di: Von Krannichfeldt, Leandro, et al.
Pubblicazione: (2025)
di: Von Krannichfeldt, Leandro, et al.
Pubblicazione: (2025)
A General Approach of Automated Environment Design for Learning the Optimal Power Flow
di: Wolgast, Thomas, et al.
Pubblicazione: (2025)
di: Wolgast, Thomas, et al.
Pubblicazione: (2025)
Spatiotemporal Observer Design for Predictive Learning of High-Dimensional Data
di: Liang, Tongyi, et al.
Pubblicazione: (2024)
di: Liang, Tongyi, et al.
Pubblicazione: (2024)
Almost Minimax Optimal Best Arm Identification in Piecewise Stationary Linear Bandits
di: Hou, Yunlong, et al.
Pubblicazione: (2024)
di: Hou, Yunlong, et al.
Pubblicazione: (2024)
A Domain-Knowledge-Aided Deep Reinforcement Learning Approach for Flight Control Design
di: Shin, Hyo-Sang, et al.
Pubblicazione: (2019)
di: Shin, Hyo-Sang, et al.
Pubblicazione: (2019)
Documenti analoghi
-
DAL: A Practical Prior-Free Black-Box Framework for Non-Stationary Bandits
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2025) -
Learning Where to Look: UCB-Driven Controlled Sensing for Quickest Change Detection
di: Huang, Yu-Han, et al.
Pubblicazione: (2026) -
Is Prior-Free Black-Box Non-Stationary Reinforcement Learning Feasible?
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2024) -
DARLING: Detection Augmented Reinforcement Learning with Non-Stationary Guarantees
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2026) -
Sequential Change Detection for Learning in Piecewise Stationary Bandit Environments
di: Huang, Yu-Han, et al.
Pubblicazione: (2025)