Chain-of-Modality: Learning Manipulation Programs from Multimodal Human Videos with Vision-Language-Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Wang, Chen, Xia, Fei, Yu, Wenhao, Zhang, Tingnan, Zhang, Ruohan, Liu, C. Karen, Fei-Fei, Li, Tan, Jie, Liang, Jacky
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!