Tuan, Y., & Wang, W. Y. (2024). A Gradient Analysis Framework for Rewarding Good and Penalizing Bad Examples in Language Models.
Cita Chicago Style (17a ed.)Tuan, Yi-Lin, y William Yang Wang. A Gradient Analysis Framework for Rewarding Good and Penalizing Bad Examples in Language Models. 2024.
Cita MLA (9a ed.)Tuan, Yi-Lin, y William Yang Wang. A Gradient Analysis Framework for Rewarding Good and Penalizing Bad Examples in Language Models. 2024.
Precaución: Estas citas no son 100% exactas.