Yao, J., Cheng, R., Wu, X., Wu, J., & Tan, K. C. (2025). Diversity-Aware Policy Optimization for Large Language Model Reasoning.
Cita Chicago Style (17a ed.)Yao, Jian, Ran Cheng, Xingyu Wu, Jibin Wu, y Kay Chen Tan. Diversity-Aware Policy Optimization for Large Language Model Reasoning. 2025.
Cita MLA (9a ed.)Yao, Jian, et al. Diversity-Aware Policy Optimization for Large Language Model Reasoning. 2025.
Precaución: Estas citas no son 100% exactas.