STORM: Internalized Modeling for Spatial-Temporal Reasoning in Video-Language Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Liang, Yiming, Chen, Yixiao, Zhou, Yiyang, Wang, Yixuan, Yu, Shoubin, Deng, Andong, Liu, Fuxiao, Zhang, Qin, Chen, Chen, Bansal, Mohit, Yao, Huaxiu
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!