Liu, M., Diao, S., Lu, X., Hu, J., Dong, X., Choi, Y., . . . Dong, Y. (2025). ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models.
Chicago-Zitierstil (17. Ausg.)Liu, Mingjie, Shizhe Diao, Ximing Lu, Jian Hu, Xin Dong, Yejin Choi, Jan Kautz, und Yi Dong. ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models. 2025.
MLA-Zitierstil (9. Ausg.)Liu, Mingjie, et al. ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models. 2025.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.