From Thousands to Billions: 3D Visual Language Grounding via Render-Supervised Distillation from 2D VLMs

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Cao, Ang, Arnaud, Sergio, Maksymets, Oleksandr, Yang, Jianing, Jain, Ayush, Yenamandra, Sriram, Martin, Ada, Berges, Vincent-Pierre, McVay, Paul, Partsey, Ruslan, Rajeswaran, Aravind, Meier, Franziska, Johnson, Justin, Park, Jeong Joon, Sax, Alexander
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!