Kaufmann, T., Weng, P., Bengs, V., & Hüllermeier, E. (2023). A Survey of Reinforcement Learning from Human Feedback.
Chicago-Zitierstil (17. Ausg.)Kaufmann, Timo, Paul Weng, Viktor Bengs, und Eyke Hüllermeier. A Survey of Reinforcement Learning from Human Feedback. 2023.
MLA-Zitierstil (9. Ausg.)Kaufmann, Timo, et al. A Survey of Reinforcement Learning from Human Feedback. 2023.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.