Wen, J., Zhong, R., Khan, A., Perez, E., Steinhardt, J., Huang, M., . . . Feng, S. (2024). Language Models Learn to Mislead Humans via RLHF.
Cita Chicago Style (17a ed.)Wen, Jiaxin, Ruiqi Zhong, Akbir Khan, Ethan Perez, Jacob Steinhardt, Minlie Huang, Samuel R. Bowman, He He, y Shi Feng. Language Models Learn to Mislead Humans via RLHF. 2024.
Cita MLA (9a ed.)Wen, Jiaxin, et al. Language Models Learn to Mislead Humans via RLHF. 2024.
Precaución: Estas citas no son 100% exactas.