Jia, Z., & Lan, G. (2026). Value Mirror Descent for Reinforcement Learning.
Style de citation Chicago (17e éd.)Jia, Zhichao, et Guanghui Lan. Value Mirror Descent for Reinforcement Learning. 2026.
Style de citation MLA (9e éd.)Jia, Zhichao, et Guanghui Lan. Value Mirror Descent for Reinforcement Learning. 2026.
Attention : ces citations peuvent ne pas être correctes à 100%.