GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Lv, Minxuan, Mei, Tiehua, Du, Tanlong, Chen, Junmin, Su, Zhenpeng, Chen, Ziyang, Wang, Ziqi, Wu, Zhennan, Pan, Ruotong, Liang, jian, Tang, Ruiming, Li, Han
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!