Weiter zum Inhalt
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Login
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Erweitert
  • How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites
Buchumschlag

How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Chen, Zhe, Wang, Weiyun, Tian, Hao, Ye, Shenglong, Gao, Zhangwei, Cui, Erfei, Tong, Wenwen, Hu, Kongzhi, Luo, Jiapeng, Ma, Zheng, Ma, Ji, Wang, Jiaqi, Dong, Xiaoyi, Yan, Hang, Guo, Hewei, He, Conghui, Shi, Botian, Jin, Zhenjiang, Xu, Chao, Wang, Bin, Wei, Xingjian, Li, Wei, Zhang, Wenjian, Zhang, Bo, Cai, Pinlong, Wen, Licheng, Yan, Xiangchao, Dou, Min, Lu, Lewei, Zhu, Xizhou, Lu, Tong, Lin, Dahua, Qiao, Yu, Dai, Jifeng, Wang, Wenhai
Format: Preprint
Veröffentlicht: 2024
Schlagworte:
Computer Vision and Pattern Recognition
Online-Zugang:
Acceder al recurso
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
  • Zitieren
  • SMS versenden
  • Als E-Mail versenden
  • Drucken
  • Datensatz exportieren
    • Exportieren nach RefWorks
    • Exportieren nach EndNoteWeb
    • Exportieren nach EndNote
  • Zu den Favoriten
  • Persistenter Link
  • Exemplare
  • Beschreibung
  • Kommentare
  • Ähnliche Einträge
  • Internformat

Online

https://arxiv.org/abs/2404.16821

Ähnliche Einträge

  • Mini-InternVL: A Flexible-Transfer Pocket Multimodal Model with 5% Parameters and 90% Performance
    von: Gao, Zhangwei, et al.
    Veröffentlicht: (2024)
  • MMInstruct: A High-Quality Multi-Modal Instruction Tuning Dataset with Extensive Diversity
    von: Liu, Yangzhou, et al.
    Veröffentlicht: (2024)
  • Docopilot: Improving Multimodal Models for Document-Level Understanding
    von: Duan, Yuchen, et al.
    Veröffentlicht: (2025)
  • Vision-RWKV: Efficient and Scalable Visual Perception with RWKV-Like Architectures
    von: Duan, Yuchen, et al.
    Veröffentlicht: (2024)
  • OmniCorpus: A Unified Multimodal Corpus of 10 Billion-Level Images Interleaved with Text
    von: Li, Qingyun, et al.
    Veröffentlicht: (2024)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 33,245© 2026 Universidad del Mar