R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Yao, Huanjin, Yin, Qixiang, Zhang, Jingyi, Yang, Min, Wang, Yibo, Wu, Wenhao, Su, Fei, Shen, Li, Qiu, Minghui, Tao, Dacheng, Huang, Jiaxing
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!