RetoVLA: Reusing Register Tokens for Spatial Reasoning in Vision-Language-Action Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Koo, Jiyeon, Cho, Taewan, Kang, Hyunjoon, Pyo, Eunseom, Oh, Tae Gyun, Kim, Taeryang, Choi, Andrew Jaeyong
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares