Weiter zum Inhalt
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Login
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Erweitert
  • VLMEvalKit: An Open-Source Toolkit for Evaluating Large Multi-Modality Models
Buchumschlag

VLMEvalKit: An Open-Source Toolkit for Evaluating Large Multi-Modality Models

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Duan, Haodong, Fang, Xinyu, Yang, Junming, Zhao, Xiangyu, Qiao, Yuxuan, Li, Mo, Agarwal, Amit, Chen, Zhe, Chen, Lin, Liu, Yuan, Ma, Yubo, Sun, Hailong, Zhang, Yifan, Lu, Shiyin, Wong, Tack Hwa, Wang, Weiyun, Zhou, Peiheng, Li, Xiaozhe, Fu, Chaoyou, Cui, Junbo, Chen, Jixuan, Song, Enxin, Mao, Song, Ding, Shengyuan, Liang, Tianhao, Zhang, Zicheng, Dong, Xiaoyi, Zang, Yuhang, Zhang, Pan, Wang, Jiaqi, Lin, Dahua, Chen, Kai
Format: Preprint
Veröffentlicht: 2024
Schlagworte:
Computer Vision and Pattern Recognition
Online-Zugang:
Acceder al recurso
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
  • Zitieren
  • SMS versenden
  • Als E-Mail versenden
  • Drucken
  • Datensatz exportieren
    • Exportieren nach RefWorks
    • Exportieren nach EndNoteWeb
    • Exportieren nach EndNote
  • Zu den Favoriten
  • Persistenter Link
  • Exemplare
  • Beschreibung
  • Kommentare
  • Ähnliche Einträge
  • Internformat
Beschreibung
Keine Beschreibung verfügbar.

Ähnliche Einträge

  • OPT-BENCH: Evaluating LLM Agent on Large-Scale Search Spaces Optimization Problems
    von: Li, Xiaozhe, et al.
    Veröffentlicht: (2025)
  • OPT-BENCH: Evaluating the Iterative Self-Optimization of LLM Agents in Large-Scale Search Spaces
    von: Li, Xiaozhe, et al.
    Veröffentlicht: (2026)
  • UniDial-EvalKit: A Unified Toolkit for Evaluating Multi-Faceted Conversational Abilities
    von: Jia, Qi, et al.
    Veröffentlicht: (2026)
  • Prism: A Framework for Decoupling and Assessing the Capabilities of VLMs
    von: Qiao, Yuxuan, et al.
    Veröffentlicht: (2024)
  • Ada-LEval: Evaluating long-context LLMs with length-adaptable benchmarks
    von: Wang, Chonghua, et al.
    Veröffentlicht: (2024)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 33,245© 2026 Universidad del Mar