Yang, W., Liu, W., Xie, R., Guo, Y., Wu, L., Yang, S., & Lin, Y. (2025). LaSeR: Reinforcement Learning with Last-Token Self-Rewarding.
Chicago-Zitierstil (17. Ausg.)Yang, Wenkai, Weijie Liu, Ruobing Xie, Yiju Guo, Lulu Wu, Saiyong Yang, und Yankai Lin. LaSeR: Reinforcement Learning with Last-Token Self-Rewarding. 2025.
MLA-Zitierstil (9. Ausg.)Yang, Wenkai, et al. LaSeR: Reinforcement Learning with Last-Token Self-Rewarding. 2025.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.