Lee, D. N., & Kosorok, M. R. (2024). Off-Policy Reinforcement Learning with High Dimensional Reward.
Cita Chicago Style (17a ed.)Lee, Dong Neuck, y Michael R. Kosorok. Off-Policy Reinforcement Learning with High Dimensional Reward. 2024.
Cita MLA (9a ed.)Lee, Dong Neuck, y Michael R. Kosorok. Off-Policy Reinforcement Learning with High Dimensional Reward. 2024.
Precaución: Estas citas no son 100% exactas.