SG-VLA: Learning Spatially-Grounded Vision-Language-Action Models for Mobile Manipulation

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Tu, Ruisen, Shukla, Arth, Yoo, Sohyun, Li, Xuanlin, Li, Junxi, Xie, Jianwen, Su, Hao, Tu, Zhuowen
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!