Zhao, Y., Escamill, J. E. A., Lu, W., & Wang, H. (2024). RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning.
Chicago-Zitierstil (17. Ausg.)Zhao, Yujie, Jose Efraim Aguilar Escamill, Weyl Lu, und Huazheng Wang. RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning. 2024.
MLA-Zitierstil (9. Ausg.)Zhao, Yujie, et al. RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning. 2024.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.