VoxRep: Enhancing 3D Spatial Understanding in 2D Vision-Language Models via Voxel Representation

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Dao, Alan, Buppodom, Norapat
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!