GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Lv, Minxuan, Mei, Tiehua, Du, Tanlong, Chen, Junmin, Su, Zhenpeng, Chen, Ziyang, Wang, Ziqi, Wu, Zhennan, Pan, Ruotong, Liang, jian, Tang, Ruiming, Li, Han
Format: Preprint
Published: 2026
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!