Salaje, A., Chevet, T., & Langlois, N. (2025). Convergent NMPC-based Reinforcement Learning Using Deep Expected Sarsa and Nonlinear Temporal Difference Learning.
Cita Chicago Style (17a ed.)Salaje, Amine, Thomas Chevet, y Nicolas Langlois. Convergent NMPC-based Reinforcement Learning Using Deep Expected Sarsa and Nonlinear Temporal Difference Learning. 2025.
Cita MLA (9a ed.)Salaje, Amine, et al. Convergent NMPC-based Reinforcement Learning Using Deep Expected Sarsa and Nonlinear Temporal Difference Learning. 2025.
Precaución: Estas citas no son 100% exactas.