Why Reinforcement Fine-Tuning Enables MLLMs Preserve Prior Knowledge Better: A Data Perspective

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Zhang, Zhihao, Dong, Qiaole, Zhang, Qi, Zhao, Jun, Zhou, Enyu, Xi, Zhiheng, Jin, Senjie, Fan, Xiaoran, Zhou, Yuhao, Wu, Mingqi, Fu, Yanwei, Ji, Tao, Gui, Tao, Huang, Xuanjing, Chen, Kai
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!