Scaling Up RL: Unlocking Diverse Reasoning in LLMs via Prolonged Training

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Liu, Mingjie, Diao, Shizhe, Hu, Jian, Lu, Ximing, Dong, Xin, Zhang, Hao, Bukharin, Alexander, Zhang, Shaokun, Zeng, Jiaqi, Sreedhar, Makesh Narsimhan, Shen, Gerald, Mosallanezhad, David, Zhang, Di, Yang, Jonas, Yang, June, Kuchaiev, Oleksii, Liu, Guilin, Yu, Zhiding, Molchanov, Pavlo, Choi, Yejin, Kautz, Jan, Dong, Yi
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!