Zhao, Y., Escamill, J. E. A., Lu, W., & Wang, H. (2024). RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning.
Cita Chicago Style (17a ed.)Zhao, Yujie, Jose Efraim Aguilar Escamill, Weyl Lu, y Huazheng Wang. RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning. 2024.
Cita MLA (9a ed.)Zhao, Yujie, et al. RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning. 2024.
Precaución: Estas citas no son 100% exactas.