Salta al contenuto
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Entra
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Avanzata
  • How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites
Copertina

How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Chen, Zhe, Wang, Weiyun, Tian, Hao, Ye, Shenglong, Gao, Zhangwei, Cui, Erfei, Tong, Wenwen, Hu, Kongzhi, Luo, Jiapeng, Ma, Zheng, Ma, Ji, Wang, Jiaqi, Dong, Xiaoyi, Yan, Hang, Guo, Hewei, He, Conghui, Shi, Botian, Jin, Zhenjiang, Xu, Chao, Wang, Bin, Wei, Xingjian, Li, Wei, Zhang, Wenjian, Zhang, Bo, Cai, Pinlong, Wen, Licheng, Yan, Xiangchao, Dou, Min, Lu, Lewei, Zhu, Xizhou, Lu, Tong, Lin, Dahua, Qiao, Yu, Dai, Jifeng, Wang, Wenhai
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Computer Vision and Pattern Recognition
Accesso online:
Acceder al recurso
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
  • Citazione
  • Invia SMS
  • Invia email
  • Stampa
  • Esporta il record
    • Esporta a RefWorks
    • Esporta a EndNoteWeb
    • Esporta a EndNote
  • Aggiungi alla lista
  • PLink permanente
  • Posseduto
  • Descrizione
  • Commenti
  • Documenti analoghi
  • MARC21

Accesso online

https://arxiv.org/abs/2404.16821

Documenti analoghi

  • Mini-InternVL: A Flexible-Transfer Pocket Multimodal Model with 5% Parameters and 90% Performance
    di: Gao, Zhangwei, et al.
    Pubblicazione: (2024)
  • MMInstruct: A High-Quality Multi-Modal Instruction Tuning Dataset with Extensive Diversity
    di: Liu, Yangzhou, et al.
    Pubblicazione: (2024)
  • Docopilot: Improving Multimodal Models for Document-Level Understanding
    di: Duan, Yuchen, et al.
    Pubblicazione: (2025)
  • Vision-RWKV: Efficient and Scalable Visual Perception with RWKV-Like Architectures
    di: Duan, Yuchen, et al.
    Pubblicazione: (2024)
  • OmniCorpus: A Unified Multimodal Corpus of 10 Billion-Level Images Interleaved with Text
    di: Li, Qingyun, et al.
    Pubblicazione: (2024)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 33,245© 2026 Universidad del Mar