The Synergy Dilemma of Long-CoT SFT and RL: Investigating Post-Training Techniques for Reasoning VLMs

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Chen, Jierun, Yu, Tiezheng, Bai, Haoli, Yao, Lewei, Wu, Jiannan, Li, Kaican, Mi, Fei, Tao, Chaofan, Zhu, Lei, Zhang, Manyi, Li, Xiaohui, Hou, Lu, Shang, Lifeng, Liu, Qun
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!