Saltar al contenido
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Entrar
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Búsqueda avanzada
  • xGen-MM (BLIP-3): A Family of Open Large Multimodal Models
Imagen de Portada

xGen-MM (BLIP-3): A Family of Open Large Multimodal Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Xue, Le, Shu, Manli, Awadalla, Anas, Wang, Jun, Yan, An, Purushwalkam, Senthil, Zhou, Honglu, Prabhu, Viraj, Dai, Yutong, Ryoo, Michael S, Kendre, Shrikant, Zhang, Jieyu, Tseng, Shaoyen, Lujan-Moreno, Gustavo A, Olson, Matthew L, Hinck, Musashi, Cobbley, David, Lal, Vasudev, Qin, Can, Zhang, Shu, Chen, Chia-Chih, Yu, Ning, Tan, Juntao, Awalgaonkar, Tulika Manoj, Heinecke, Shelby, Wang, Huan, Choi, Yejin, Schmidt, Ludwig, Chen, Zeyuan, Savarese, Silvio, Niebles, Juan Carlos, Xiong, Caiming, Xu, Ran
Formato: Preprint
Publicado: 2024
Materias:
Computer Vision and Pattern Recognition
Artificial Intelligence
Computation and Language
Acceso en línea:
Acceder al recurso
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
  • Citar
  • Describir
  • Enviar este por Correo electrónico
  • Imprimir
  • Exportar Registro
    • Exportar a RefWorks
    • Exportar a EndNoteWeb
    • Exportar a EndNote
  • Agregar a favoritos
  • Enlace Permanente
  • Existencias
  • Descripción
  • Comentarios
  • Ejemplares similares
  • Vista Equipo

Internet

https://arxiv.org/abs/2408.08872

Ejemplares similares

  • xGen-MM-Vid (BLIP-3-Video): You Only Need 32 Tokens to Represent a Video Even in VLMs
    por: Ryoo, Michael S., et al.
    Publicado: (2024)
  • xGen-VideoSyn-1: High-fidelity Text-to-Video Synthesis with Compressed Representations
    por: Qin, Can, et al.
    Publicado: (2024)
  • Strefer: Empowering Video LLMs with Space-Time Referring and Reasoning via Synthetic Instruction Data
    por: Zhou, Honglu, et al.
    Publicado: (2025)
  • BLIP3-KALE: Knowledge Augmented Large-Scale Dense Captions
    por: Awadalla, Anas, et al.
    Publicado: (2024)
  • SMILE: A Composite Lexical-Semantic Metric for Question-Answering Evaluation
    por: Kendre, Shrikant, et al.
    Publicado: (2025)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 33,245© 2026 Universidad del Mar