Zhou, Z., Peng, A., Li, Q., Levine, S., & Kumar, A. (2024). Efficient Online Reinforcement Learning Fine-Tuning Need Not Retain Offline Data.
Chicago-Zitierstil (17. Ausg.)Zhou, Zhiyuan, Andy Peng, Qiyang Li, Sergey Levine, und Aviral Kumar. Efficient Online Reinforcement Learning Fine-Tuning Need Not Retain Offline Data. 2024.
MLA-Zitierstil (9. Ausg.)Zhou, Zhiyuan, et al. Efficient Online Reinforcement Learning Fine-Tuning Need Not Retain Offline Data. 2024.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.