UniVLR: Unifying Text and Vision in Visual Latent Reasoning for Multimodal LLMs

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Jiang, Houcheng, Fu, Jiajun, Fang, Junfeng, Gao, Chen, Wang, Xiang, He, Xiangnan, Li, Yong
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!