Reinforcement Learning for Machine Learning Model Deployment: Evaluating Multi-Armed Bandits in ML Ops Environments
Fuente:
arXiv
Salvato in:
| Autori principali: | McClendon, S. Aaron, Venkatesh, Vishaal, Morinelli, Juan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hidden Dynamics of Massive Activations in Transformer Training
di: Gallego-Feliciano, Jorge, et al.
Pubblicazione: (2025)
di: Gallego-Feliciano, Jorge, et al.
Pubblicazione: (2025)
Unified Framework of Distributional Regret in Multi-Armed Bandits and Reinforcement Learning
di: Lee, Harin, et al.
Pubblicazione: (2026)
di: Lee, Harin, et al.
Pubblicazione: (2026)
Multi-Armed Bandits With Machine Learning-Generated Surrogate Rewards
di: Ji, Wenlong, et al.
Pubblicazione: (2025)
di: Ji, Wenlong, et al.
Pubblicazione: (2025)
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
di: Liu, Xutong, et al.
Pubblicazione: (2024)
di: Liu, Xutong, et al.
Pubblicazione: (2024)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
MARBLE: Multi-Armed Restless Bandits in Latent Markovian Environment
di: Amiri, Mohsen, et al.
Pubblicazione: (2025)
di: Amiri, Mohsen, et al.
Pubblicazione: (2025)
On the Low-Complexity of Fair Learning for Combinatorial Multi-Armed Bandit
di: Wu, Xiaoyi, et al.
Pubblicazione: (2025)
di: Wu, Xiaoyi, et al.
Pubblicazione: (2025)
Constrained Feedback Learning for Non-Stationary Multi-Armed Bandits
di: Li, Shaoang, et al.
Pubblicazione: (2025)
di: Li, Shaoang, et al.
Pubblicazione: (2025)
Multi-Armed Bandits with Interference
di: Jia, Su, et al.
Pubblicazione: (2024)
di: Jia, Su, et al.
Pubblicazione: (2024)
Imprecise Multi-Armed Bandits
di: Kosoy, Vanessa
Pubblicazione: (2024)
di: Kosoy, Vanessa
Pubblicazione: (2024)
A Multi-Armed Bandit Approach to Online Selection and Evaluation of Generative Models
di: Hu, Xiaoyan, et al.
Pubblicazione: (2024)
di: Hu, Xiaoyan, et al.
Pubblicazione: (2024)
Flickering Multi-Armed Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
LASeR: Learning to Adaptively Select Reward Models with Multi-Armed Bandits
di: Nguyen, Duy, et al.
Pubblicazione: (2024)
di: Nguyen, Duy, et al.
Pubblicazione: (2024)
Multi-Armed Bandits with Network Interference
di: Agarwal, Abhineet, et al.
Pubblicazione: (2024)
di: Agarwal, Abhineet, et al.
Pubblicazione: (2024)
On the Regularity and Fairness of Combinatorial Multi-Armed Bandit
di: Wu, Xiaoyi, et al.
Pubblicazione: (2025)
di: Wu, Xiaoyi, et al.
Pubblicazione: (2025)
Rising Multi-Armed Bandits with Known Horizons
di: Song, Seockbean, et al.
Pubblicazione: (2026)
di: Song, Seockbean, et al.
Pubblicazione: (2026)
Collaborating in Multi-Armed Bandits with Strategic Agents
di: Barnea, Idan, et al.
Pubblicazione: (2026)
di: Barnea, Idan, et al.
Pubblicazione: (2026)
Optimal Streaming Algorithms for Multi-Armed Bandits
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
Large Language Model-Enhanced Multi-Armed Bandits
di: Sun, Jiahang, et al.
Pubblicazione: (2025)
di: Sun, Jiahang, et al.
Pubblicazione: (2025)
Introduction to Multi-Armed Bandits
di: Slivkins, Aleksandrs
Pubblicazione: (2019)
di: Slivkins, Aleksandrs
Pubblicazione: (2019)
Put CASH on Bandits: A Max K-Armed Problem for Automated Machine Learning
di: Balef, Amir Rezaei, et al.
Pubblicazione: (2025)
di: Balef, Amir Rezaei, et al.
Pubblicazione: (2025)
Autonomous Drug Design with Multi-Armed Bandits
di: Svensson, Hampus Gummesson, et al.
Pubblicazione: (2022)
di: Svensson, Hampus Gummesson, et al.
Pubblicazione: (2022)
VR as Library Technology: Early Faculty and Student Feedback on Educational Use of Immersive Technology
di: McClendon, V. J., et al.
Pubblicazione: (2019)
di: McClendon, V. J., et al.
Pubblicazione: (2019)
Integrating Multi-Armed Bandit, Active Learning, and Distributed Computing for Scalable Optimization
di: Hui-Mean, Foo, et al.
Pubblicazione: (2026)
di: Hui-Mean, Foo, et al.
Pubblicazione: (2026)
Distributed Algorithms for Multi-Agent Multi-Armed Bandits with Collision
di: Zhou, Daoyuan, et al.
Pubblicazione: (2025)
di: Zhou, Daoyuan, et al.
Pubblicazione: (2025)
Stochastic Multi-Armed Bandits with Limited Control Variates
di: Verma, Arun, et al.
Pubblicazione: (2026)
di: Verma, Arun, et al.
Pubblicazione: (2026)
Optimism in the Face of Ambiguity Principle for Multi-Armed Bandits
di: Li, Mengmeng, et al.
Pubblicazione: (2024)
di: Li, Mengmeng, et al.
Pubblicazione: (2024)
Individual Regret in Cooperative Stochastic Multi-Armed Bandits
di: Barnea, Idan, et al.
Pubblicazione: (2024)
di: Barnea, Idan, et al.
Pubblicazione: (2024)
Federated Multi-Armed Bandits Under Byzantine Attacks
di: Saday, Artun, et al.
Pubblicazione: (2022)
di: Saday, Artun, et al.
Pubblicazione: (2022)
Byzantine-Resilient Decentralized Multi-Armed Bandits
di: Zhu, Jingxuan, et al.
Pubblicazione: (2023)
di: Zhu, Jingxuan, et al.
Pubblicazione: (2023)
Multi-Armed Bandits With Best-Action Queries
di: Bacchiocchi, Francesco, et al.
Pubblicazione: (2026)
di: Bacchiocchi, Francesco, et al.
Pubblicazione: (2026)
ML2SC: Deploying Machine Learning Models as Smart Contracts on the Blockchain
di: Li, Zhikai, et al.
Pubblicazione: (2024)
di: Li, Zhikai, et al.
Pubblicazione: (2024)
FedMABA: Towards Fair Federated Learning through Multi-Armed Bandits Allocation
di: Wang, Zhichao, et al.
Pubblicazione: (2024)
di: Wang, Zhichao, et al.
Pubblicazione: (2024)
Mobility-Aware Federated Learning: Multi-Armed Bandit Based Selection in Vehicular Network
di: Tu, Haoyu, et al.
Pubblicazione: (2024)
di: Tu, Haoyu, et al.
Pubblicazione: (2024)
A Hybrid Meta-Learning and Multi-Armed Bandit Approach for Context-Specific Multi-Objective Recommendation Optimization
di: Cunha, Tiago, et al.
Pubblicazione: (2024)
di: Cunha, Tiago, et al.
Pubblicazione: (2024)
Adversarial Attacks on Combinatorial Multi-Armed Bandits
di: Balasubramanian, Rishab, et al.
Pubblicazione: (2023)
di: Balasubramanian, Rishab, et al.
Pubblicazione: (2023)
Unlearning Offline Stochastic Multi-Armed Bandits
di: Ye, Zichun, et al.
Pubblicazione: (2026)
di: Ye, Zichun, et al.
Pubblicazione: (2026)
Heterogeneous Multi-Player Multi-Armed Bandits Robust To Adversarial Attacks
di: Magesh, Akshayaa, et al.
Pubblicazione: (2025)
di: Magesh, Akshayaa, et al.
Pubblicazione: (2025)
Graph-Dependent Regret Bounds in Multi-Armed Bandits with Interference
di: Jamshidi, Fateme, et al.
Pubblicazione: (2025)
di: Jamshidi, Fateme, et al.
Pubblicazione: (2025)
Collaborative Min-Max Regret in Grouped Multi-Armed Bandits
di: Blanchard, Moïse, et al.
Pubblicazione: (2025)
di: Blanchard, Moïse, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Hidden Dynamics of Massive Activations in Transformer Training
di: Gallego-Feliciano, Jorge, et al.
Pubblicazione: (2025) -
Unified Framework of Distributional Regret in Multi-Armed Bandits and Reinforcement Learning
di: Lee, Harin, et al.
Pubblicazione: (2026) -
Multi-Armed Bandits With Machine Learning-Generated Surrogate Rewards
di: Ji, Wenlong, et al.
Pubblicazione: (2025) -
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
di: Liu, Xutong, et al.
Pubblicazione: (2024) -
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
di: Xiong, Guojun, et al.
Pubblicazione: (2024)