Zheng, C., Zhu, J., Lin, J., Dai, X., Liu, W., Li, H., . . . Yang, M. (2025). CoLD: Counterfactually-Guided Length Debiasing for Process Reward Models in Mathematical Reasoning.
Chicago-Zitierstil (17. Ausg.)Zheng, Congmin, Jiachen Zhu, Jianghao Lin, Xinyi Dai, Weiwen Liu, Haoxuan Li, Yong Yu, Weinan Zhang, und Mengyue Yang. CoLD: Counterfactually-Guided Length Debiasing for Process Reward Models in Mathematical Reasoning. 2025.
MLA-Zitierstil (9. Ausg.)Zheng, Congmin, et al. CoLD: Counterfactually-Guided Length Debiasing for Process Reward Models in Mathematical Reasoning. 2025.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.