Wu, H., Wang, C., Zhao, W., & He, J. (2025). Mirage or Method? How Model-Task Alignment Induces Divergent RL Conclusions.
Cita Chicago Style (17a ed.)Wu, Haoze, Cheng Wang, Wenshuo Zhao, y Junxian He. Mirage or Method? How Model-Task Alignment Induces Divergent RL Conclusions. 2025.
Cita MLA (9a ed.)Wu, Haoze, et al. Mirage or Method? How Model-Task Alignment Induces Divergent RL Conclusions. 2025.
Precaución: Estas citas no son 100% exactas.