Constrained Feedback Learning for Non-Stationary Multi-Armed Bandits
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Shaoang, Li, Jian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Non-Stationary Restless Multi-Armed Bandits with Provable Guarantee
par: Hung, Yu-Heng, et autres
Publié: (2025)
par: Hung, Yu-Heng, et autres
Publié: (2025)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
par: Xiong, Guojun, et autres
Publié: (2024)
par: Xiong, Guojun, et autres
Publié: (2024)
POLAR: Online Learning for LoRA Adapter Caching and Routing in Edge LLM Serving
par: Li, Shaoang, et autres
Publié: (2026)
par: Li, Shaoang, et autres
Publié: (2026)
Diminishing Exploration: A Minimalist Approach to Piecewise Stationary Multi-Armed Bandits
par: Li, Kuan-Ta, et autres
Publié: (2024)
par: Li, Kuan-Ta, et autres
Publié: (2024)
Near-Optimal Online Deployment and Routing for Streaming LLMs
par: Li, Shaoang, et autres
Publié: (2025)
par: Li, Shaoang, et autres
Publié: (2025)
Quantile Multi-Armed Bandits with 1-bit Feedback
par: Lau, Ivan, et autres
Publié: (2025)
par: Lau, Ivan, et autres
Publié: (2025)
On the Regularity and Fairness of Combinatorial Multi-Armed Bandit
par: Wu, Xiaoyi, et autres
Publié: (2025)
par: Wu, Xiaoyi, et autres
Publié: (2025)
On the Low-Complexity of Fair Learning for Combinatorial Multi-Armed Bandit
par: Wu, Xiaoyi, et autres
Publié: (2025)
par: Wu, Xiaoyi, et autres
Publié: (2025)
Multi-Armed Bandits with Interference
par: Jia, Su, et autres
Publié: (2024)
par: Jia, Su, et autres
Publié: (2024)
Imprecise Multi-Armed Bandits
par: Kosoy, Vanessa
Publié: (2024)
par: Kosoy, Vanessa
Publié: (2024)
Optimism in the Face of Ambiguity Principle for Multi-Armed Bandits
par: Li, Mengmeng, et autres
Publié: (2024)
par: Li, Mengmeng, et autres
Publié: (2024)
Non-Stationary Lipschitz Bandits
par: Nguyen, Nicolas, et autres
Publié: (2025)
par: Nguyen, Nicolas, et autres
Publié: (2025)
Flickering Multi-Armed Bandits
par: Chakraborty, Sourav, et autres
Publié: (2026)
par: Chakraborty, Sourav, et autres
Publié: (2026)
Multi-Agent Combinatorial-Multi-Armed-Bandit framework for the Submodular Welfare Problem under Bandit Feedback
par: Pokhriyal, Subham, et autres
Publié: (2026)
par: Pokhriyal, Subham, et autres
Publié: (2026)
Non-Stationary Bandit Learning via Predictive Sampling
par: Liu, Yueyang, et autres
Publié: (2022)
par: Liu, Yueyang, et autres
Publié: (2022)
Multi-Armed Bandits with Network Interference
par: Agarwal, Abhineet, et autres
Publié: (2024)
par: Agarwal, Abhineet, et autres
Publié: (2024)
Adversarial Attacks on Combinatorial Multi-Armed Bandits
par: Balasubramanian, Rishab, et autres
Publié: (2023)
par: Balasubramanian, Rishab, et autres
Publié: (2023)
Unlearning Offline Stochastic Multi-Armed Bandits
par: Ye, Zichun, et autres
Publié: (2026)
par: Ye, Zichun, et autres
Publié: (2026)
Rising Multi-Armed Bandits with Known Horizons
par: Song, Seockbean, et autres
Publié: (2026)
par: Song, Seockbean, et autres
Publié: (2026)
Collaborating in Multi-Armed Bandits with Strategic Agents
par: Barnea, Idan, et autres
Publié: (2026)
par: Barnea, Idan, et autres
Publié: (2026)
Optimal Streaming Algorithms for Multi-Armed Bandits
par: Jin, Tianyuan, et autres
Publié: (2024)
par: Jin, Tianyuan, et autres
Publié: (2024)
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
par: Liu, Xutong, et autres
Publié: (2024)
par: Liu, Xutong, et autres
Publié: (2024)
Introduction to Multi-Armed Bandits
par: Slivkins, Aleksandrs
Publié: (2019)
par: Slivkins, Aleksandrs
Publié: (2019)
Autonomous Drug Design with Multi-Armed Bandits
par: Svensson, Hampus Gummesson, et autres
Publié: (2022)
par: Svensson, Hampus Gummesson, et autres
Publié: (2022)
Unified Framework of Distributional Regret in Multi-Armed Bandits and Reinforcement Learning
par: Lee, Harin, et autres
Publié: (2026)
par: Lee, Harin, et autres
Publié: (2026)
Multi-Armed Bandits With Machine Learning-Generated Surrogate Rewards
par: Ji, Wenlong, et autres
Publié: (2025)
par: Ji, Wenlong, et autres
Publié: (2025)
Distributed Algorithms for Multi-Agent Multi-Armed Bandits with Collision
par: Zhou, Daoyuan, et autres
Publié: (2025)
par: Zhou, Daoyuan, et autres
Publié: (2025)
Adaptive Smooth Non-Stationary Bandits
par: Suk, Joe
Publié: (2024)
par: Suk, Joe
Publié: (2024)
Stochastic Multi-Armed Bandits with Limited Control Variates
par: Verma, Arun, et autres
Publié: (2026)
par: Verma, Arun, et autres
Publié: (2026)
Individual Regret in Cooperative Stochastic Multi-Armed Bandits
par: Barnea, Idan, et autres
Publié: (2024)
par: Barnea, Idan, et autres
Publié: (2024)
Federated Multi-Armed Bandits Under Byzantine Attacks
par: Saday, Artun, et autres
Publié: (2022)
par: Saday, Artun, et autres
Publié: (2022)
Learning to Optimize Feedback for One Million Students: Insights from Multi-Armed and Contextual Bandits in Large-Scale Online Tutoring
par: Schmucker, Robin, et autres
Publié: (2025)
par: Schmucker, Robin, et autres
Publié: (2025)
Byzantine-Resilient Decentralized Multi-Armed Bandits
par: Zhu, Jingxuan, et autres
Publié: (2023)
par: Zhu, Jingxuan, et autres
Publié: (2023)
Multi-Armed Bandits With Best-Action Queries
par: Bacchiocchi, Francesco, et autres
Publié: (2026)
par: Bacchiocchi, Francesco, et autres
Publié: (2026)
Mobility-Aware Federated Learning: Multi-Armed Bandit Based Selection in Vehicular Network
par: Tu, Haoyu, et autres
Publié: (2024)
par: Tu, Haoyu, et autres
Publié: (2024)
Adversarial Network Optimization under Bandit Feedback: Maximizing Utility in Non-Stationary Multi-Hop Networks
par: Dai, Yan, et autres
Publié: (2024)
par: Dai, Yan, et autres
Publié: (2024)
Evolution of Information in Interactive Decision Making: A Case Study for Multi-Armed Bandits
par: Gu, Yuzhou, et autres
Publié: (2025)
par: Gu, Yuzhou, et autres
Publié: (2025)
Near-Optimal Algorithm for Non-Stationary Kernelized Bandits
par: Iwazaki, Shogo, et autres
Publié: (2024)
par: Iwazaki, Shogo, et autres
Publié: (2024)
Heterogeneous Multi-Player Multi-Armed Bandits Robust To Adversarial Attacks
par: Magesh, Akshayaa, et autres
Publié: (2025)
par: Magesh, Akshayaa, et autres
Publié: (2025)
Smooth Non-Stationary Bandits
par: Jia, Su, et autres
Publié: (2023)
par: Jia, Su, et autres
Publié: (2023)
Documents similaires
-
Non-Stationary Restless Multi-Armed Bandits with Provable Guarantee
par: Hung, Yu-Heng, et autres
Publié: (2025) -
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
par: Xiong, Guojun, et autres
Publié: (2024) -
POLAR: Online Learning for LoRA Adapter Caching and Routing in Edge LLM Serving
par: Li, Shaoang, et autres
Publié: (2026) -
Diminishing Exploration: A Minimalist Approach to Piecewise Stationary Multi-Armed Bandits
par: Li, Kuan-Ta, et autres
Publié: (2024) -
Near-Optimal Online Deployment and Routing for Streaming LLMs
par: Li, Shaoang, et autres
Publié: (2025)