VLM-3R: Vision-Language Models Augmented with Instruction-Aligned 3D Reconstruction

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Fan, Zhiwen, Zhang, Jian, Li, Renjie, Zhang, Junge, Chen, Runjin, Hu, Hezhen, Wang, Kevin, Qu, Huaizhi, Zhou, Shijie, Wang, Dilin, Yan, Zhicheng, Xu, Hongyu, Theiss, Justin, Chen, Tianlong, Li, Jiachen, Tu, Zhengzhong, Wang, Zhangyang, Ranjan, Rakesh
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares