Ishida, S., & Henriques, J. F. (2024). SOAP-RL: Sequential Option Advantage Propagation for Reinforcement Learning in POMDP Environments.
Cita Chicago Style (17a ed.)Ishida, Shu, y João F. Henriques. SOAP-RL: Sequential Option Advantage Propagation for Reinforcement Learning in POMDP Environments. 2024.
Cita MLA (9a ed.)Ishida, Shu, y João F. Henriques. SOAP-RL: Sequential Option Advantage Propagation for Reinforcement Learning in POMDP Environments. 2024.
Precaución: Estas citas no son 100% exactas.