Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Surana, Rohan, Mundada, Gagan, Jiang, Xunyi, Wang, Chuhan, Tang, Zhenwei, Jiao, Difan, Huang, Zihan, Xiong, Yuxin, Wu, Junda, Yu, Sheldon, Li, Xintong, Jain, Raghav, Kuang, Nikki, Zhou, Sizhe, Jin, Bowen, Chu, Zhendong, Yu, Tong, Rossi, Ryan, Huang, Kuan-Hao, Shang, Jingbo, Han, Jiawei, McAuley, Julian
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!