Jia, Z., & Lan, G. (2026). Value Mirror Descent for Reinforcement Learning.
Chicago-Zitierstil (17. Ausg.)Jia, Zhichao, und Guanghui Lan. Value Mirror Descent for Reinforcement Learning. 2026.
MLA-Zitierstil (9. Ausg.)Jia, Zhichao, und Guanghui Lan. Value Mirror Descent for Reinforcement Learning. 2026.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.