Felizardo, L. K., Fadda, E., Brandimarte, P., Del-Moral-Hernandez, E., & Nascimento, M. C. V. (2025). A Reinforcement Learning Method for Environments with Stochastic Variables: Post-Decision Proximal Policy Optimization with Dual Critic Networks.
Cita Chicago Style (17a ed.)Felizardo, Leonardo Kanashiro, Edoardo Fadda, Paolo Brandimarte, Emilio Del-Moral-Hernandez, y Mariá Cristina Vasconcelos Nascimento. A Reinforcement Learning Method for Environments with Stochastic Variables: Post-Decision Proximal Policy Optimization with Dual Critic Networks. 2025.
Cita MLA (9a ed.)Felizardo, Leonardo Kanashiro, et al. A Reinforcement Learning Method for Environments with Stochastic Variables: Post-Decision Proximal Policy Optimization with Dual Critic Networks. 2025.