Zhao, Y., Escamill, J. E. A., Lu, W., & Wang, H. (2024). RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning.
Style de citation Chicago (17e éd.)Zhao, Yujie, Jose Efraim Aguilar Escamill, Weyl Lu, et Huazheng Wang. RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning. 2024.
Style de citation MLA (9e éd.)Zhao, Yujie, et al. RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning. 2024.
Attention : ces citations peuvent ne pas être correctes à 100%.