Cita APA (7a ed.)

Felizardo, L. K., Fadda, E., Brandimarte, P., Del-Moral-Hernandez, E., & Nascimento, M. C. V. (2025). A Reinforcement Learning Method for Environments with Stochastic Variables: Post-Decision Proximal Policy Optimization with Dual Critic Networks.

Cita Chicago Style (17a ed.)

Felizardo, Leonardo Kanashiro, Edoardo Fadda, Paolo Brandimarte, Emilio Del-Moral-Hernandez, y Mariá Cristina Vasconcelos Nascimento. A Reinforcement Learning Method for Environments with Stochastic Variables: Post-Decision Proximal Policy Optimization with Dual Critic Networks. 2025.

Cita MLA (9a ed.)

Felizardo, Leonardo Kanashiro, et al. A Reinforcement Learning Method for Environments with Stochastic Variables: Post-Decision Proximal Policy Optimization with Dual Critic Networks. 2025.

Precaución: Estas citas no son 100% exactas.