zhang, R., li, z., Huang, J., Zhang, R., Xu, X., zhe, s., . . . Wang, C. (2026). From Correctness to Preference: A Framework for Personalized Agentic Reinforcement Learning.
Cita Chicago Style (17a ed.)zhang, Ranxu, zeyang li, Jiacheng Huang, Rui Zhang, Xiaozhou Xu, sun zhe, Yanyong Zhang, y Chao Wang. From Correctness to Preference: A Framework for Personalized Agentic Reinforcement Learning. 2026.
Cita MLA (9a ed.)zhang, Ranxu, et al. From Correctness to Preference: A Framework for Personalized Agentic Reinforcement Learning. 2026.
Precaución: Estas citas no son 100% exactas.