Saltar al contenido
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Entrar
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Búsqueda avanzada
  • Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models
Imagen de Portada

Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Deitke, Matt, Clark, Christopher, Lee, Sangho, Tripathi, Rohun, Yang, Yue, Park, Jae Sung, Salehi, Mohammadreza, Muennighoff, Niklas, Lo, Kyle, Soldaini, Luca, Lu, Jiasen, Anderson, Taira, Bransom, Erin, Ehsani, Kiana, Ngo, Huong, Chen, YenSung, Patel, Ajay, Yatskar, Mark, Callison-Burch, Chris, Head, Andrew, Hendrix, Rose, Bastani, Favyen, VanderBilt, Eli, Lambert, Nathan, Chou, Yvonne, Chheda, Arnavi, Sparks, Jenna, Skjonsberg, Sam, Schmitz, Michael, Sarnat, Aaron, Bischoff, Byron, Walsh, Pete, Newell, Chris, Wolters, Piper, Gupta, Tanmay, Zeng, Kuo-Hao, Borchardt, Jon, Groeneveld, Dirk, Nam, Crystal, Lebrecht, Sophie, Wittlif, Caitlin, Schoenick, Carissa, Michel, Oscar, Krishna, Ranjay, Weihs, Luca, Smith, Noah A., Hajishirzi, Hannaneh, Girshick, Ross, Farhadi, Ali, Kembhavi, Aniruddha
Formato: Preprint
Publicado: 2024
Materias:
Computer Vision and Pattern Recognition
Computation and Language
Machine Learning
Acceso en línea:
Acceder al recurso
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
  • Citar
  • Describir
  • Enviar este por Correo electrónico
  • Imprimir
  • Exportar Registro
    • Exportar a RefWorks
    • Exportar a EndNoteWeb
    • Exportar a EndNote
  • Agregar a favoritos
  • Enlace Permanente
  • Existencias
  • Descripción
  • Comentarios
  • Ejemplares similares
  • Vista Equipo
Descripción
Descripción no disponible.

Ejemplares similares

  • Molmo2: Open Weights and Data for Vision-Language Models with Video Understanding and Grounding
    por: Clark, Christopher, et al.
    Publicado: (2026)
  • Scaling Text-Rich Image Understanding via Code-Guided Synthetic Multimodal Data Generation
    por: Yang, Yue, et al.
    Publicado: (2025)
  • MolmoSpaces: A Large-Scale Open Ecosystem for Robot Navigation and Manipulation
    por: Kim, Yejin, et al.
    Publicado: (2026)
  • MolmoPoint: Better Pointing for VLMs with Grounding Tokens
    por: Clark, Christopher, et al.
    Publicado: (2026)
  • OLMoTrace: Tracing Language Model Outputs Back to Trillions of Training Tokens
    por: Liu, Jiacheng, et al.
    Publicado: (2025)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 33,245© 2026 Universidad del Mar