Fan, J., Li, Y., Qi, Z., Zhang, D., Brantley, K., Kakade, S. M., & Zhang, H. (2026). Scaling Reward Modeling without Human Supervision.
Chicago Style (17th ed.) CitationFan, Jingxuan, Yueying Li, Zhenting Qi, Dinghuai Zhang, Kianté Brantley, Sham M. Kakade, and Hanlin Zhang. Scaling Reward Modeling Without Human Supervision. 2026.
MLA (9th ed.) CitationFan, Jingxuan, et al. Scaling Reward Modeling Without Human Supervision. 2026.
Warning: These citations may not always be 100% accurate.