Wang, C., Mu, Y., Zhou, H., Huo, Y., Zhu, Z., Zeng, J., . . . Xiao, T. (2025). GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning.
Cita Chicago Style (17a ed.)Wang, Chenglong, et al. GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning. 2025.
Cita MLA (9a ed.)Wang, Chenglong, et al. GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning. 2025.
Precaución: Estas citas no son 100% exactas.