Zeng, T., Zhang, S., Wu, S., Classen, C., Chae, D., Ewer, E., . . . Lee, K. (2025). VersaPRM: Multi-Domain Process Reward Model via Synthetic Reasoning Data.
Chicago-Zitierstil (17. Ausg.)Zeng, Thomas, et al. VersaPRM: Multi-Domain Process Reward Model via Synthetic Reasoning Data. 2025.
MLA-Zitierstil (9. Ausg.)Zeng, Thomas, et al. VersaPRM: Multi-Domain Process Reward Model via Synthetic Reasoning Data. 2025.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.