Evaluating General Purpose Vision Foundation Models for Medical Image Analysis: An Experimental Study of DINOv2 on Radiology Benchmarks
Fuente:
arXiv
Saved in:
| Main Authors: | Baharoon, Mohammed, Qureshi, Waseem, Ouyang, Jiahong, Xu, Yanwu, Aljouie, Abdulrhman, Peng, Wei |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
General Purpose Image Encoder DINOv2 for Medical Image Registration
by: Song, Xinrui, et al.
Published: (2024)
by: Song, Xinrui, et al.
Published: (2024)
HyMNet: a Multimodal Deep Learning System for Hypertension Classification using Fundus Photographs and Cardiometabolic Risk Factors
by: Baharoon, Mohammed, et al.
Published: (2023)
by: Baharoon, Mohammed, et al.
Published: (2023)
Harmony: A Joint Self-Supervised and Weakly-Supervised Framework for Learning General Purpose Visual Representations
by: Baharoon, Mohammed, et al.
Published: (2024)
by: Baharoon, Mohammed, et al.
Published: (2024)
Segment Anything in Medical Images and Videos: Benchmark and Deployment
by: Ma, Jun, et al.
Published: (2024)
by: Ma, Jun, et al.
Published: (2024)
MM-DINOv2: Adapting Foundation Models for Multi-Modal Medical Image Analysis
by: Scholz, Daniel, et al.
Published: (2025)
by: Scholz, Daniel, et al.
Published: (2025)
CRIMSON: A Clinically-Grounded LLM-Based Metric for Generative Radiology Report Evaluation
by: Baharoon, Mohammed, et al.
Published: (2026)
by: Baharoon, Mohammed, et al.
Published: (2026)
DinoDental: Benchmarking DINOv3 as a Unified Vision Encoder for Dental Image Analysis
by: Tang, Kun, et al.
Published: (2026)
by: Tang, Kun, et al.
Published: (2026)
RadGame: An AI-Powered Platform for Radiology Education
by: Baharoon, Mohammed, et al.
Published: (2025)
by: Baharoon, Mohammed, et al.
Published: (2025)
DINOv3 with Test-Time Training for Medical Image Registration
by: Wang, Shansong, et al.
Published: (2025)
by: Wang, Shansong, et al.
Published: (2025)
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
by: Wu, Haoning, et al.
Published: (2023)
by: Wu, Haoning, et al.
Published: (2023)
OmniRad: A Radiological Foundation Model for Multi-Task Medical Image Analysis
by: Zedda, Luca, et al.
Published: (2026)
by: Zedda, Luca, et al.
Published: (2026)
Does DINOv3 Set a New Medical Vision Standard? Benchmarking 2D and 3D Classification, Segmentation, and Registration
by: Liu, Che, et al.
Published: (2025)
by: Liu, Che, et al.
Published: (2025)
3DReasonKnee: Advancing Grounded Reasoning in Medical Vision Language Models
by: Sambara, Sraavya, et al.
Published: (2025)
by: Sambara, Sraavya, et al.
Published: (2025)
Medical SAM Adapter: Adapting Segment Anything Model for Medical Image Segmentation
by: Wu, Junde, et al.
Published: (2023)
by: Wu, Junde, et al.
Published: (2023)
Calibrated and Robust Foundation Models for Vision-Language and Medical Image Tasks Under Distribution Shift
by: Khan, Behraj, et al.
Published: (2025)
by: Khan, Behraj, et al.
Published: (2025)
Rethinking Few-Shot Image Fusion: Granular Ball Priors Enable General-Purpose Deep Fusion
by: Deng, Minjie, et al.
Published: (2025)
by: Deng, Minjie, et al.
Published: (2025)
Comparative Analysis of ImageNet Pre-Trained Deep Learning Models and DINOv2 in Medical Imaging Classification
by: Huang, Yuning, et al.
Published: (2024)
by: Huang, Yuning, et al.
Published: (2024)
Medical Slice Transformer: Improved Diagnosis and Explainability on 3D Medical Images with DINOv2
by: Müller-Franzes, Gustav, et al.
Published: (2024)
by: Müller-Franzes, Gustav, et al.
Published: (2024)
MedSAM2: Segment Anything in 3D Medical Images and Videos
by: Ma, Jun, et al.
Published: (2025)
by: Ma, Jun, et al.
Published: (2025)
Exploring the Design Space of 3D MLLMs for CT Report Generation
by: Baharoon, Mohammed, et al.
Published: (2025)
by: Baharoon, Mohammed, et al.
Published: (2025)
Adapting Vision-Language Foundation Model for Next Generation Medical Ultrasound Image Analysis
by: Qu, Jingguo, et al.
Published: (2025)
by: Qu, Jingguo, et al.
Published: (2025)
Rethinking Cross-Generator Image Forgery Detection through DINOv3
by: Huang, Zhenglin, et al.
Published: (2025)
by: Huang, Zhenglin, et al.
Published: (2025)
Vision Foundation Models in Medical Image Analysis: Advances and Challenges
by: Liang, Pengchen, et al.
Published: (2025)
by: Liang, Pengchen, et al.
Published: (2025)
Design and Evaluation of a Culturally Adapted Multimodal Virtual Agent for PTSD Screening
by: Ozel, Cengiz, et al.
Published: (2026)
by: Ozel, Cengiz, et al.
Published: (2026)
EchoApex: A General-Purpose Vision Foundation Model for Echocardiography
by: Amadou, Abdoul Aziz, et al.
Published: (2024)
by: Amadou, Abdoul Aziz, et al.
Published: (2024)
Exploiting DINOv3-Based Self-Supervised Features for Robust Few-Shot Medical Image Segmentation
by: Xu, Guoping, et al.
Published: (2026)
by: Xu, Guoping, et al.
Published: (2026)
Analysis of Blood Report Images Using General Purpose Vision-Language Models
by: Bakhsheshi, Nadia, et al.
Published: (2025)
by: Bakhsheshi, Nadia, et al.
Published: (2025)
Chemical Composition, Antioxidants and Phenolic Contents of Aloe vera: Using as a Medicinal Purpose against Various Diseases
by: Waseem, Khalid
Published: (2020)
by: Waseem, Khalid
Published: (2020)
Summarizing Radiology Reports Findings into Impressions
by: de Padua, Raul Salles, et al.
Published: (2024)
by: de Padua, Raul Salles, et al.
Published: (2024)
A Survey on Large Language Models from General Purpose to Medical Applications: Datasets, Methodologies, and Evaluations
by: Wang, Jinqiang, et al.
Published: (2024)
by: Wang, Jinqiang, et al.
Published: (2024)
MedVision: Dataset and Benchmark for Quantitative Medical Image Analysis
by: Yao, Yongcheng, et al.
Published: (2025)
by: Yao, Yongcheng, et al.
Published: (2025)
DINOv2 based Self Supervised Learning For Few Shot Medical Image Segmentation
by: Ayzenberg, Lev, et al.
Published: (2024)
by: Ayzenberg, Lev, et al.
Published: (2024)
Benchmarking DINOv3 for Multi-Task Stroke Analysis on Non-Contrast CT
by: Zhang, Donghao, et al.
Published: (2025)
by: Zhang, Donghao, et al.
Published: (2025)
Visual Alignment of Medical Vision-Language Models for Grounded Radiology Report Generation
by: Bose, Sarosij, et al.
Published: (2025)
by: Bose, Sarosij, et al.
Published: (2025)
Are General-Purpose Vision Models All We Need for 2D Medical Image Segmentation? A Cross-Dataset Empirical Study
by: Borst, Vanessa, et al.
Published: (2026)
by: Borst, Vanessa, et al.
Published: (2026)
Zero-shot Domain Generalization of Foundational Models for 3D Medical Image Segmentation: An Experimental Study
by: Chattopadhyay, Soumitri, et al.
Published: (2025)
by: Chattopadhyay, Soumitri, et al.
Published: (2025)
Explanations of Classifiers Enhance Medical Image Segmentation via End-to-end Pre-training
by: Chen, Jiamin, et al.
Published: (2024)
by: Chen, Jiamin, et al.
Published: (2024)
DINOv3 Beats Specialized Detectors: A Simple Foundation Model Baseline for Image Forensics
by: Yu, Jieming, et al.
Published: (2026)
by: Yu, Jieming, et al.
Published: (2026)
Can General-Purpose Omnimodels Compete with Specialists? A Case Study in Medical Image Segmentation
by: Zhang, Yizhe, et al.
Published: (2025)
by: Zhang, Yizhe, et al.
Published: (2025)
The Future is Now: Evaluating the Best AI Medical Imaging Software for Radiology in 2025
by: www.rasitdinc.com
Published: (2025)
by: www.rasitdinc.com
Published: (2025)
Similar Items
-
General Purpose Image Encoder DINOv2 for Medical Image Registration
by: Song, Xinrui, et al.
Published: (2024) -
HyMNet: a Multimodal Deep Learning System for Hypertension Classification using Fundus Photographs and Cardiometabolic Risk Factors
by: Baharoon, Mohammed, et al.
Published: (2023) -
Harmony: A Joint Self-Supervised and Weakly-Supervised Framework for Learning General Purpose Visual Representations
by: Baharoon, Mohammed, et al.
Published: (2024) -
Segment Anything in Medical Images and Videos: Benchmark and Deployment
by: Ma, Jun, et al.
Published: (2024) -
MM-DINOv2: Adapting Foundation Models for Multi-Modal Medical Image Analysis
by: Scholz, Daniel, et al.
Published: (2025)