Jiang, H., Zhang, W., Yao, J., Cai, H., Wang, S., & Song, R. (2026). Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models.
Chicago Style (17th ed.) CitationJiang, Haitao, Wenbo Zhang, Jiarui Yao, Hengrui Cai, Sheng Wang, and Rui Song. Supervised Fine-Tuning Versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models. 2026.
MLA (9th ed.) CitationJiang, Haitao, et al. Supervised Fine-Tuning Versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models. 2026.
Warning: These citations may not always be 100% accurate.