APA-Zitierstil (7. Ausg.)

Jia, Z., & Lan, G. (2026). Value Mirror Descent for Reinforcement Learning.

Chicago-Zitierstil (17. Ausg.)

Jia, Zhichao, und Guanghui Lan. Value Mirror Descent for Reinforcement Learning. 2026.

MLA-Zitierstil (9. Ausg.)

Jia, Zhichao, und Guanghui Lan. Value Mirror Descent for Reinforcement Learning. 2026.

Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.