Liu, Q., Xu, H., Chen, X., Chen, W., Teh, Y. W., & Miao, N. (2025). Enhancing Large Language Model Reasoning with Reward Models: An Analytical Survey.
Cita Chicago Style (17a ed.)Liu, Qiyuan, Hao Xu, Xuhong Chen, Wei Chen, Yee Whye Teh, y Ning Miao. Enhancing Large Language Model Reasoning with Reward Models: An Analytical Survey. 2025.
Cita MLA (9a ed.)Liu, Qiyuan, et al. Enhancing Large Language Model Reasoning with Reward Models: An Analytical Survey. 2025.
Precaución: Estas citas no son 100% exactas.