Shaking Up VLMs: Comparing Transformers and Structured State Space Models for Vision & Language Modeling

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Pantazopoulos, Georgios, Nikandrou, Malvina, Suglia, Alessandro, Lemon, Oliver, Eshghi, Arash
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!