Train at Moving Edge: Online-Verified Prompt Selection for Efficient RL Training of Large Reasoning Model

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Wu, Jiahao, Lu, Ning, Liu, Shengcai, Wang, Kun, Yang, Yanting, Qing, Li, Tang, Ke
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!