Lee, H., & Oh, M. (2026). Unified Framework of Distributional Regret in Multi-Armed Bandits and Reinforcement Learning.
Chicago-Zitierstil (17. Ausg.)Lee, Harin, und Min-hwan Oh. Unified Framework of Distributional Regret in Multi-Armed Bandits and Reinforcement Learning. 2026.
MLA-Zitierstil (9. Ausg.)Lee, Harin, und Min-hwan Oh. Unified Framework of Distributional Regret in Multi-Armed Bandits and Reinforcement Learning. 2026.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.