Zheng, Y. (2026). RL2ML: Finite-Rollout Surrogate Objectives from Reinforcement Learning to Maximum Likelihood.
Cita Chicago Style (17a ed.)Zheng, Yifu. RL2ML: Finite-Rollout Surrogate Objectives from Reinforcement Learning to Maximum Likelihood. 2026.
Cita MLA (9a ed.)Zheng, Yifu. RL2ML: Finite-Rollout Surrogate Objectives from Reinforcement Learning to Maximum Likelihood. 2026.
Precaución: Estas citas no son 100% exactas.