Wong, M. F., & Tan, C. W. (2025). Aligning Crowd-sourced Human Feedback for Reinforcement Learning on Code Generation by Large Language Models.
Cita Chicago Style (17a ed.)Wong, Man Fai, y Chee Wei Tan. Aligning Crowd-sourced Human Feedback for Reinforcement Learning on Code Generation by Large Language Models. 2025.
Cita MLA (9a ed.)Wong, Man Fai, y Chee Wei Tan. Aligning Crowd-sourced Human Feedback for Reinforcement Learning on Code Generation by Large Language Models. 2025.
Precaución: Estas citas no son 100% exactas.