APA-Zitierstil (7. Ausg.)

Chan, A. J., Sun, H., Holt, S., & van der Schaar, M. (2024). Dense Reward for Free in Reinforcement Learning from Human Feedback.

Chicago-Zitierstil (17. Ausg.)

Chan, Alex J., Hao Sun, Samuel Holt, und Mihaela van der Schaar. Dense Reward for Free in Reinforcement Learning from Human Feedback. 2024.

MLA-Zitierstil (9. Ausg.)

Chan, Alex J., et al. Dense Reward for Free in Reinforcement Learning from Human Feedback. 2024.

Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.