Kar, A., & Singh, R. (2024). Policy Zooming: Adaptive Discretization-based Infinite-Horizon Average-Reward Reinforcement Learning.
Cita Chicago Style (17a ed.)Kar, Avik, y Rahul Singh. Policy Zooming: Adaptive Discretization-based Infinite-Horizon Average-Reward Reinforcement Learning. 2024.
Cita MLA (9a ed.)Kar, Avik, y Rahul Singh. Policy Zooming: Adaptive Discretization-based Infinite-Horizon Average-Reward Reinforcement Learning. 2024.
Precaución: Estas citas no son 100% exactas.