Hu, J., Zhang, Y., Han, Q., Jiang, D., Zhang, X., & Shum, H. (2025). Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model.
Chicago Style (17th ed.) CitationHu, Jingcheng, Yinmin Zhang, Qi Han, Daxin Jiang, Xiangyu Zhang, and Heung-Yeung Shum. Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model. 2025.
MLA (9th ed.) CitationHu, Jingcheng, et al. Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model. 2025.
Warning: These citations may not always be 100% accurate.