Can Multimodal LLMs do Visual Temporal Understanding and Reasoning? The answer is No!

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Imam, Mohamed Fazli, Lyu, Chenyang, Aji, Alham Fikri
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!