VisionUnite: A Vision-Language Foundation Model for Ophthalmology Enhanced with Clinical Knowledge
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Zihan, Song, Diping, Yang, Zefeng, Wang, Deming, Li, Fei, Zhang, Xiulan, Kinahan, Paul E., Qiao, Yu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Constructing Ophthalmic MLLM for Positioning-diagnosis Collaboration Through Clinical Cognitive Chain Reasoning
di: Liu, Xinyao, et al.
Pubblicazione: (2025)
di: Liu, Xinyao, et al.
Pubblicazione: (2025)
Scale-aware Adaptive Supervised Network with Limited Medical Annotations
di: Li, Zihan, et al.
Pubblicazione: (2026)
di: Li, Zihan, et al.
Pubblicazione: (2026)
Beyond Textual Knowledge-Leveraging Multimodal Knowledge Bases for Enhancing Vision-and-Language Navigation
di: Yang, Dongsheng, et al.
Pubblicazione: (2026)
di: Yang, Dongsheng, et al.
Pubblicazione: (2026)
Mammo-CLIP: A Vision Language Foundation Model to Enhance Data Efficiency and Robustness in Mammography
di: Ghosh, Shantanu, et al.
Pubblicazione: (2024)
di: Ghosh, Shantanu, et al.
Pubblicazione: (2024)
Knowledge-enhanced Pretraining for Vision-language Pathology Foundation Model on Cancer Diagnosis
di: Zhou, Xiao, et al.
Pubblicazione: (2024)
di: Zhou, Xiao, et al.
Pubblicazione: (2024)
Enhancing Diagnostic Accuracy in Rare and Common Fundus Diseases with a Knowledge-Rich Vision-Language Model
di: Wang, Meng, et al.
Pubblicazione: (2024)
di: Wang, Meng, et al.
Pubblicazione: (2024)
E3D-GPT: Enhanced 3D Visual Foundation for Medical Vision-Language Model
di: Lai, Haoran, et al.
Pubblicazione: (2024)
di: Lai, Haoran, et al.
Pubblicazione: (2024)
Cardiac-CLIP: A Vision-Language Foundation Model for 3D Cardiac CT Images
di: Hu, Yutao, et al.
Pubblicazione: (2025)
di: Hu, Yutao, et al.
Pubblicazione: (2025)
Vision Foundation Models for Computed Tomography
di: Pai, Suraj, et al.
Pubblicazione: (2025)
di: Pai, Suraj, et al.
Pubblicazione: (2025)
Vision Foundation Models in Medical Image Analysis: Advances and Challenges
di: Liang, Pengchen, et al.
Pubblicazione: (2025)
di: Liang, Pengchen, et al.
Pubblicazione: (2025)
VisionFM: a Multi-Modal Multi-Task Vision Foundation Model for Generalist Ophthalmic Artificial Intelligence
di: Qiu, Jianing, et al.
Pubblicazione: (2023)
di: Qiu, Jianing, et al.
Pubblicazione: (2023)
Vision-Language Synthetic Data Enhances Echocardiography Downstream Tasks
di: Ashrafian, Pooria, et al.
Pubblicazione: (2024)
di: Ashrafian, Pooria, et al.
Pubblicazione: (2024)
Hibou: A Family of Foundational Vision Transformers for Pathology
di: Nechaev, Dmitry, et al.
Pubblicazione: (2024)
di: Nechaev, Dmitry, et al.
Pubblicazione: (2024)
Benchmarking Ophthalmology Foundation Models for Clinically Significant Age Macular Degeneration Detection
di: Cohen, Benjamin A., et al.
Pubblicazione: (2025)
di: Cohen, Benjamin A., et al.
Pubblicazione: (2025)
Prostate-Specific Foundation Models for Enhanced Detection of Clinically Significant Cancer
di: Lee, Jeong Hoon, et al.
Pubblicazione: (2025)
di: Lee, Jeong Hoon, et al.
Pubblicazione: (2025)
Downstream Analysis of Foundational Medical Vision Models for Disease Progression
di: Demir, Basar, et al.
Pubblicazione: (2025)
di: Demir, Basar, et al.
Pubblicazione: (2025)
Curriculum Fine-tuning of Vision Foundation Model for Medical Image Classification Under Label Noise
di: Yu, Yeonguk, et al.
Pubblicazione: (2024)
di: Yu, Yeonguk, et al.
Pubblicazione: (2024)
Unleashing Vision Foundation Models for Coronary Artery Segmentation: Parallel ViT-CNN Encoding and Variational Fusion
di: Dong, Caixia, et al.
Pubblicazione: (2025)
di: Dong, Caixia, et al.
Pubblicazione: (2025)
Deep Learning for Ophthalmology: The State-of-the-Art and Future Trends
di: Nguyen, Duy M. H., et al.
Pubblicazione: (2025)
di: Nguyen, Duy M. H., et al.
Pubblicazione: (2025)
Dimensional Coactivation for Representational Consistency in Frozen Vision Foundation Models
di: Saddik, Izaldein Al-Zyoud Abdulmotaleb El
Pubblicazione: (2026)
di: Saddik, Izaldein Al-Zyoud Abdulmotaleb El
Pubblicazione: (2026)
A Disease-Centric Vision-Language Foundation Model for Precision Oncology in Kidney Cancer
di: Tao, Yuhui, et al.
Pubblicazione: (2025)
di: Tao, Yuhui, et al.
Pubblicazione: (2025)
DiagR1: A Vision-Language Model Trained via Reinforcement Learning for Digestive Pathology Diagnosis
di: Ouyang, Minxi, et al.
Pubblicazione: (2025)
di: Ouyang, Minxi, et al.
Pubblicazione: (2025)
QMamba: On First Exploration of Vision Mamba for Image Quality Assessment
di: Guan, Fengbin, et al.
Pubblicazione: (2024)
di: Guan, Fengbin, et al.
Pubblicazione: (2024)
VLSM-Ensemble: Ensembling CLIP-based Vision-Language Models for Enhanced Medical Image Segmentation
di: Dietlmeier, Julia, et al.
Pubblicazione: (2025)
di: Dietlmeier, Julia, et al.
Pubblicazione: (2025)
Pixel Perfect MegaMed: A Megapixel-Scale Vision-Language Foundation Model for Generating High Resolution Medical Images
di: TehraniNasab, Zahra, et al.
Pubblicazione: (2025)
di: TehraniNasab, Zahra, et al.
Pubblicazione: (2025)
Enhancing Diameter Measurement Accuracy in Machine Vision Applications
di: Poyraz, Ahmet Gokhan, et al.
Pubblicazione: (2025)
di: Poyraz, Ahmet Gokhan, et al.
Pubblicazione: (2025)
Regist3R: Incremental Registration with Stereo Foundation Model
di: Liu, Sidun, et al.
Pubblicazione: (2025)
di: Liu, Sidun, et al.
Pubblicazione: (2025)
Vision-Language Model Based Multi-Expert Fusion for CT Image Classification
di: Bai, Jianfa, et al.
Pubblicazione: (2026)
di: Bai, Jianfa, et al.
Pubblicazione: (2026)
Exploring Autoregressive Vision Foundation Models for Image Compression
di: Phung, Huu-Tai, et al.
Pubblicazione: (2025)
di: Phung, Huu-Tai, et al.
Pubblicazione: (2025)
Are Vision Foundation Models Ready for Out-of-the-Box Medical Image Registration?
di: Gu, Hanxue, et al.
Pubblicazione: (2025)
di: Gu, Hanxue, et al.
Pubblicazione: (2025)
PromptHSI: Universal Hyperspectral Image Restoration with Vision-Language Modulated Frequency Adaptation
di: Lee, Chia-Ming, et al.
Pubblicazione: (2024)
di: Lee, Chia-Ming, et al.
Pubblicazione: (2024)
Large-Scale Label Quality Assessment for Medical Segmentation via a Vision-Language Judge and Synthetic Data
di: Chen, Yixiong, et al.
Pubblicazione: (2026)
di: Chen, Yixiong, et al.
Pubblicazione: (2026)
Off-the-shelf Vision Models Benefit Image Manipulation Localization
di: Zhang, Zhengxuan, et al.
Pubblicazione: (2026)
di: Zhang, Zhengxuan, et al.
Pubblicazione: (2026)
Med3DVLM: An Efficient Vision-Language Model for 3D Medical Image Analysis
di: Xin, Yu, et al.
Pubblicazione: (2025)
di: Xin, Yu, et al.
Pubblicazione: (2025)
MGCR-Net:Multimodal Graph-Conditioned Vision-Language Reconstruction Network for Remote Sensing Change Detection
di: Wang, Chengming, et al.
Pubblicazione: (2025)
di: Wang, Chengming, et al.
Pubblicazione: (2025)
Cross-Organ and Cross-Scanner Adenocarcinoma Segmentation using Rein to Fine-tune Vision Foundation Models
di: Cai, Pengzhou, et al.
Pubblicazione: (2024)
di: Cai, Pengzhou, et al.
Pubblicazione: (2024)
A New Era in Computational Pathology: A Survey on Foundation and Vision-Language Models
di: Chanda, Dibaloke, et al.
Pubblicazione: (2024)
di: Chanda, Dibaloke, et al.
Pubblicazione: (2024)
VM-UNet: Vision Mamba UNet for Medical Image Segmentation
di: Ruan, Jiacheng, et al.
Pubblicazione: (2024)
di: Ruan, Jiacheng, et al.
Pubblicazione: (2024)
MedVisionLlama: Leveraging Pre-Trained Large Language Model Layers to Enhance Medical Image Segmentation
di: Kumar, Gurucharan Marthi Krishna, et al.
Pubblicazione: (2024)
di: Kumar, Gurucharan Marthi Krishna, et al.
Pubblicazione: (2024)
Context-Aware Vision Language Foundation Models for Ocular Disease Screening in Retinal Images
di: Berger, Lucie, et al.
Pubblicazione: (2025)
di: Berger, Lucie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Constructing Ophthalmic MLLM for Positioning-diagnosis Collaboration Through Clinical Cognitive Chain Reasoning
di: Liu, Xinyao, et al.
Pubblicazione: (2025) -
Scale-aware Adaptive Supervised Network with Limited Medical Annotations
di: Li, Zihan, et al.
Pubblicazione: (2026) -
Beyond Textual Knowledge-Leveraging Multimodal Knowledge Bases for Enhancing Vision-and-Language Navigation
di: Yang, Dongsheng, et al.
Pubblicazione: (2026) -
Mammo-CLIP: A Vision Language Foundation Model to Enhance Data Efficiency and Robustness in Mammography
di: Ghosh, Shantanu, et al.
Pubblicazione: (2024) -
Knowledge-enhanced Pretraining for Vision-language Pathology Foundation Model on Cancer Diagnosis
di: Zhou, Xiao, et al.
Pubblicazione: (2024)