GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Pengcheng, Ye, Jin, Wang, Guoan, Li, Yanjun, Deng, Zhongying, Li, Wei, Li, Tianbin, Duan, Haodong, Huang, Ziyan, Su, Yanzhou, Wang, Benyou, Zhang, Shaoting, Fu, Bin, Cai, Jianfei, Zhuang, Bohan, Seibel, Eric J, He, Junjun, Qiao, Yu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GMAI-VL & GMAI-VL-5.5M: A Large Vision-Language Model and A Comprehensive Multimodal Dataset Towards General Medical AI
di: Li, Tianbin, et al.
Pubblicazione: (2024)
di: Li, Tianbin, et al.
Pubblicazione: (2024)
GMAI-VL-R1: Harnessing Reinforcement Learning for Multimodal Medical Reasoning
di: Su, Yanzhou, et al.
Pubblicazione: (2025)
di: Su, Yanzhou, et al.
Pubblicazione: (2025)
SAM-Med3D-MoE: Towards a Non-Forgetting Segment Anything Model via Mixture of Experts for 3D Medical Image Segmentation
di: Wang, Guoan, et al.
Pubblicazione: (2024)
di: Wang, Guoan, et al.
Pubblicazione: (2024)
SAM-Med3D: Towards General-purpose Segmentation Models for Volumetric Medical Images
di: Wang, Haoyu, et al.
Pubblicazione: (2023)
di: Wang, Haoyu, et al.
Pubblicazione: (2023)
A-Eval: A Benchmark for Cross-Dataset Evaluation of Abdominal Multi-Organ Segmentation
di: Huang, Ziyan, et al.
Pubblicazione: (2023)
di: Huang, Ziyan, et al.
Pubblicazione: (2023)
Interactive Medical Image Segmentation: A Benchmark Dataset and Baseline
di: Cheng, Junlong, et al.
Pubblicazione: (2024)
di: Cheng, Junlong, et al.
Pubblicazione: (2024)
SegBook: A Simple Baseline and Cookbook for Volumetric Medical Image Segmentation
di: Ye, Jin, et al.
Pubblicazione: (2024)
di: Ye, Jin, et al.
Pubblicazione: (2024)
OmniMedVQA: A New Large-Scale Comprehensive Evaluation Benchmark for Medical LVLM
di: Hu, Yutao, et al.
Pubblicazione: (2024)
di: Hu, Yutao, et al.
Pubblicazione: (2024)
MMBench-Video: A Long-Form Multi-Shot Benchmark for Holistic Video Understanding
di: Fang, Xinyu, et al.
Pubblicazione: (2024)
di: Fang, Xinyu, et al.
Pubblicazione: (2024)
SlideChat: A Large Vision-Language Assistant for Whole-Slide Pathology Image Understanding
di: Chen, Ying, et al.
Pubblicazione: (2024)
di: Chen, Ying, et al.
Pubblicazione: (2024)
MMRareBench: A Rare-Disease Multimodal and Multi-Image Medical Benchmark
di: Ning, Junzhi, et al.
Pubblicazione: (2026)
di: Ning, Junzhi, et al.
Pubblicazione: (2026)
MMBench: Is Your Multi-modal Model an All-around Player?
di: Liu, Yuan, et al.
Pubblicazione: (2023)
di: Liu, Yuan, et al.
Pubblicazione: (2023)
A Fine-tuning Dataset and Benchmark for Large Language Models for Protein Understanding
di: Shen, Yiqing, et al.
Pubblicazione: (2024)
di: Shen, Yiqing, et al.
Pubblicazione: (2024)
AdaptMMBench: Benchmarking Adaptive Multimodal Reasoning for Mode Selection and Reasoning Process
di: Zhang, Xintong, et al.
Pubblicazione: (2026)
di: Zhang, Xintong, et al.
Pubblicazione: (2026)
FewMMBench: A Benchmark for Multimodal Few-Shot Learning
di: Dogan, Mustafa, et al.
Pubblicazione: (2026)
di: Dogan, Mustafa, et al.
Pubblicazione: (2026)
AstroMMBench: A Benchmark for Evaluating Multimodal Large Language Models Capabilities in Astronomy
di: Shi, Jinghang, et al.
Pubblicazione: (2025)
di: Shi, Jinghang, et al.
Pubblicazione: (2025)
CMB: A Comprehensive Medical Benchmark in Chinese
di: Wang, Xidong, et al.
Pubblicazione: (2023)
di: Wang, Xidong, et al.
Pubblicazione: (2023)
INS-MMBench: A Comprehensive Benchmark for Evaluating LVLMs' Performance in Insurance
di: Lin, Chenwei, et al.
Pubblicazione: (2024)
di: Lin, Chenwei, et al.
Pubblicazione: (2024)
MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents
di: Wang, Xuehui, et al.
Pubblicazione: (2025)
di: Wang, Xuehui, et al.
Pubblicazione: (2025)
Creation-MMBench: Assessing Context-Aware Creative Intelligence in MLLM
di: Fang, Xinyu, et al.
Pubblicazione: (2025)
di: Fang, Xinyu, et al.
Pubblicazione: (2025)
MedBench: A Comprehensive, Standardized, and Reliable Benchmarking System for Evaluating Chinese Medical Large Language Models
di: Liu, Mianxin, et al.
Pubblicazione: (2024)
di: Liu, Mianxin, et al.
Pubblicazione: (2024)
TourSynbio: A Multi-Modal Large Model and Agent Framework to Bridge Text and Protein Sequences for Protein Engineering
di: Shen, Yiqing, et al.
Pubblicazione: (2024)
di: Shen, Yiqing, et al.
Pubblicazione: (2024)
MedCAL-Bench: A Comprehensive Benchmark on Cold-Start Active Learning with Foundation Models for Medical Image Analysis
di: Zhu, Ning, et al.
Pubblicazione: (2025)
di: Zhu, Ning, et al.
Pubblicazione: (2025)
TCM-5CEval: Extended Deep Evaluation Benchmark for LLM's Comprehensive Clinical Research Competence in Traditional Chinese Medicine
di: Huang, Tianai, et al.
Pubblicazione: (2025)
di: Huang, Tianai, et al.
Pubblicazione: (2025)
ViLLA-MMBench: A Unified Benchmark Suite for LLM-Augmented Multimodal Movie Recommendation
di: Nazary, Fatemeh, et al.
Pubblicazione: (2025)
di: Nazary, Fatemeh, et al.
Pubblicazione: (2025)
F^2TTA: Free-Form Test-Time Adaptation on Cross-Domain Medical Image Classification via Image-Level Disentangled Prompt Tuning
di: Li, Wei, et al.
Pubblicazione: (2025)
di: Li, Wei, et al.
Pubblicazione: (2025)
FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion
di: Chen, Zhuokun, et al.
Pubblicazione: (2026)
di: Chen, Zhuokun, et al.
Pubblicazione: (2026)
AlignMMBench: Evaluating Chinese Multimodal Alignment in Large Vision-Language Models
di: Wu, Yuhang, et al.
Pubblicazione: (2024)
di: Wu, Yuhang, et al.
Pubblicazione: (2024)
MM-OpenFGL: A Comprehensive Benchmark for Multimodal Federated Graph Learning
di: Li, Xunkai, et al.
Pubblicazione: (2026)
di: Li, Xunkai, et al.
Pubblicazione: (2026)
InterLV-Search: Benchmarking Interleaved Multimodal Agentic Search
di: Hou, Bohan, et al.
Pubblicazione: (2026)
di: Hou, Bohan, et al.
Pubblicazione: (2026)
MieDB-100k: A Comprehensive Dataset for Medical Image Editing
di: Lai, Yongfan, et al.
Pubblicazione: (2026)
di: Lai, Yongfan, et al.
Pubblicazione: (2026)
Towards Interpretable Counterfactual Generation via Multimodal Autoregression
di: Ma, Chenglong, et al.
Pubblicazione: (2025)
di: Ma, Chenglong, et al.
Pubblicazione: (2025)
Unified Medical Image Tokenizer for Autoregressive Synthesis and Understanding
di: Ma, Chenglong, et al.
Pubblicazione: (2025)
di: Ma, Chenglong, et al.
Pubblicazione: (2025)
MultiMedEdit: A Scenario-Aware Benchmark for Evaluating Knowledge Editing in Medical VQA
di: Wen, Shengtao, et al.
Pubblicazione: (2025)
di: Wen, Shengtao, et al.
Pubblicazione: (2025)
Where and What Matters: Sensitivity-Aware Task Vectors for Many-Shot Multimodal In-Context Learning
di: Ma, Ziyu, et al.
Pubblicazione: (2025)
di: Ma, Ziyu, et al.
Pubblicazione: (2025)
Quantifying Self-diagnostic Atomic Knowledge in Chinese Medical Foundation Model: A Computational Analysis
di: Fan, Yaxin, et al.
Pubblicazione: (2023)
di: Fan, Yaxin, et al.
Pubblicazione: (2023)
Advancing Grounded Multimodal Named Entity Recognition via LLM-Based Reformulation and Box-Based Segmentation
di: Li, Jinyuan, et al.
Pubblicazione: (2024)
di: Li, Jinyuan, et al.
Pubblicazione: (2024)
MedProbeBench: Systematic Benchmarking at Deep Evidence Integration for Expert-level Medical Guideline
di: Liu, Jiyao, et al.
Pubblicazione: (2026)
di: Liu, Jiyao, et al.
Pubblicazione: (2026)
Assessing and optimizing the relationship between nutritional quality and environmental impacts of household food consumption: evidence from the longitudinal data in urban China
di: Shaoting Li, et al.
Pubblicazione: (2025)
di: Shaoting Li, et al.
Pubblicazione: (2025)
Beyond Forgetting in Continual Medical Image Segmentation: A Comprehensive Benchmark Study
di: Wang, Bomin, et al.
Pubblicazione: (2026)
di: Wang, Bomin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
GMAI-VL & GMAI-VL-5.5M: A Large Vision-Language Model and A Comprehensive Multimodal Dataset Towards General Medical AI
di: Li, Tianbin, et al.
Pubblicazione: (2024) -
GMAI-VL-R1: Harnessing Reinforcement Learning for Multimodal Medical Reasoning
di: Su, Yanzhou, et al.
Pubblicazione: (2025) -
SAM-Med3D-MoE: Towards a Non-Forgetting Segment Anything Model via Mixture of Experts for 3D Medical Image Segmentation
di: Wang, Guoan, et al.
Pubblicazione: (2024) -
SAM-Med3D: Towards General-purpose Segmentation Models for Volumetric Medical Images
di: Wang, Haoyu, et al.
Pubblicazione: (2023) -
A-Eval: A Benchmark for Cross-Dataset Evaluation of Abdominal Multi-Organ Segmentation
di: Huang, Ziyan, et al.
Pubblicazione: (2023)