Cita APA (7a ed.)

zhang, R., li, z., Huang, J., Zhang, R., Xu, X., zhe, s., . . . Wang, C. (2026). From Correctness to Preference: A Framework for Personalized Agentic Reinforcement Learning.

Cita Chicago Style (17a ed.)

zhang, Ranxu, zeyang li, Jiacheng Huang, Rui Zhang, Xiaozhou Xu, sun zhe, Yanyong Zhang, y Chao Wang. From Correctness to Preference: A Framework for Personalized Agentic Reinforcement Learning. 2026.

Cita MLA (9a ed.)

zhang, Ranxu, et al. From Correctness to Preference: A Framework for Personalized Agentic Reinforcement Learning. 2026.

Precaución: Estas citas no son 100% exactas.