Look Every Frame All at Once: Video-Ma$^2$mba for Efficient Long-form Video Understanding with Multi-Axis Gradient Checkpointing

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Lee, Hosu, Kim, Junho, Kim, Hyunjun, Ro, Yong Man
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!