Tuan, Y., & Wang, W. Y. (2024). A Gradient Analysis Framework for Rewarding Good and Penalizing Bad Examples in Language Models.
Chicago Style (17th ed.) CitationTuan, Yi-Lin, and William Yang Wang. A Gradient Analysis Framework for Rewarding Good and Penalizing Bad Examples in Language Models. 2024.
MLA (9th ed.) CitationTuan, Yi-Lin, and William Yang Wang. A Gradient Analysis Framework for Rewarding Good and Penalizing Bad Examples in Language Models. 2024.
Warning: These citations may not always be 100% accurate.