Expert-level vision-language foundation model for real-world radiology and comprehensive evaluation
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Xiaohong, Yang, Guoxing, Luo, Yulin, Mao, Jiaji, Zhang, Xiang, Gao, Ming, Zhang, Shanghang, Shen, Jun, Wang, Guangyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Thinker: A vision-language foundation model for embodied intelligence
di: Pan, Baiyu, et al.
Pubblicazione: (2026)
di: Pan, Baiyu, et al.
Pubblicazione: (2026)
ClinicalGPT-R1: Pushing reasoning capability of generalist disease diagnosis with large language model
di: Lan, Wuyang, et al.
Pubblicazione: (2025)
di: Lan, Wuyang, et al.
Pubblicazione: (2025)
Towards a clinically accessible radiology foundation model: open-access and lightweight, with automated evaluation
di: Chaves, Juan Manuel Zambrano, et al.
Pubblicazione: (2024)
di: Chaves, Juan Manuel Zambrano, et al.
Pubblicazione: (2024)
GreenRFM: Toward a resource-efficient radiology foundation model
di: Li, Yingtai, et al.
Pubblicazione: (2026)
di: Li, Yingtai, et al.
Pubblicazione: (2026)
Editorial for “A Glycine‐Targeted In Vivo Magnetic Resonance Spectroscopy for Quantifying Glycine in Glioma”
di: Jiaji Mao, et al.
Pubblicazione: (2025)
di: Jiaji Mao, et al.
Pubblicazione: (2025)
Towards a vision foundation model for comprehensive assessment of Cardiac MRI
di: Jacob, Athira J, et al.
Pubblicazione: (2024)
di: Jacob, Athira J, et al.
Pubblicazione: (2024)
Generalizing vision-language models to novel domains: A comprehensive survey
di: Li, Xinyao, et al.
Pubblicazione: (2025)
di: Li, Xinyao, et al.
Pubblicazione: (2025)
A foundation model of vision, audition, and language for in-silico neuroscience
di: d'Ascoli, Stéphane, et al.
Pubblicazione: (2026)
di: d'Ascoli, Stéphane, et al.
Pubblicazione: (2026)
More performant and scalable: Rethinking contrastive vision-language pre-training of radiology in the LLM era
di: Li, Yingtai, et al.
Pubblicazione: (2025)
di: Li, Yingtai, et al.
Pubblicazione: (2025)
ProTDyn: a foundation Protein language model for Thermodynamics and Dynamics generation
di: Liu, Yikai, et al.
Pubblicazione: (2025)
di: Liu, Yikai, et al.
Pubblicazione: (2025)
Zero‐shot animal behaviour classification with vision‐language foundation models
di: Gaspard Dussert, et al.
Pubblicazione: (2025)
di: Gaspard Dussert, et al.
Pubblicazione: (2025)
The current status of large language models in summarizing radiology report impressions
di: Hu, Danqing, et al.
Pubblicazione: (2024)
di: Hu, Danqing, et al.
Pubblicazione: (2024)
An integrated language-vision foundation model for conversational diagnostics and triaging in primary eye care
di: Da Soh, Zhi, et al.
Pubblicazione: (2025)
di: Da Soh, Zhi, et al.
Pubblicazione: (2025)
Artificial intelligence and surgical radiology – how it is shaping real‐world management
di: Victor Chai, et al.
Pubblicazione: (2024)
di: Victor Chai, et al.
Pubblicazione: (2024)
A systematic evaluation of vision-language models for observational astronomical reasoning tasks
di: Ren, Wenke, et al.
Pubblicazione: (2026)
di: Ren, Wenke, et al.
Pubblicazione: (2026)
Enhancing the vision-language foundation model with key semantic knowledge-emphasized report refinement
di: Huang, Weijian, et al.
Pubblicazione: (2024)
di: Huang, Weijian, et al.
Pubblicazione: (2024)
MoVL:Exploring Fusion Strategies for the Domain-Adaptive Application of Pretrained Models in Medical Imaging Tasks
di: Tian, Haijiang, et al.
Pubblicazione: (2024)
di: Tian, Haijiang, et al.
Pubblicazione: (2024)
WM-MoE: Weather-aware Multi-scale Mixture-of-Experts for Blind Adverse Weather Removal
di: Luo, Yulin, et al.
Pubblicazione: (2023)
di: Luo, Yulin, et al.
Pubblicazione: (2023)
PathBench: A comprehensive comparison benchmark for pathology foundation models towards precision oncology
di: Ma, Jiabo, et al.
Pubblicazione: (2025)
di: Ma, Jiabo, et al.
Pubblicazione: (2025)
Openfly: A comprehensive platform for aerial vision-language navigation
di: Gao, Yunpeng, et al.
Pubblicazione: (2025)
di: Gao, Yunpeng, et al.
Pubblicazione: (2025)
Zero-shot segmentation of skin tumors in whole-slide images with vision-language foundation models
di: Moreno, Santiago, et al.
Pubblicazione: (2025)
di: Moreno, Santiago, et al.
Pubblicazione: (2025)
Generative vector search to improve pathology foundation models across multimodal vision-language tasks
di: Ekvall, Markus, et al.
Pubblicazione: (2025)
di: Ekvall, Markus, et al.
Pubblicazione: (2025)
A vision–language foundation model for Alzheimer's disease diagnosis using MRI and clinical data
di: Ping‐Ju Lin, et al.
Pubblicazione: (2025)
di: Ping‐Ju Lin, et al.
Pubblicazione: (2025)
Open foundation models for Azerbaijani language
di: Isbarov, Jafar, et al.
Pubblicazione: (2024)
di: Isbarov, Jafar, et al.
Pubblicazione: (2024)
A comprehensive atlas of pediatric immune checkpoint inhibitors‐related adverse events: From real‐world pharmacovigilance data to mechanistic insights
di: Anqi Lin, et al.
Pubblicazione: (2025)
di: Anqi Lin, et al.
Pubblicazione: (2025)
EAA: Automating materials characterization with vision language model agents
di: Du, Ming, et al.
Pubblicazione: (2026)
di: Du, Ming, et al.
Pubblicazione: (2026)
scMIR: A vision–language foundation model for single-cell light microscopy image representation
di: Shang, Yifan
Pubblicazione: (2026)
di: Shang, Yifan
Pubblicazione: (2026)
I-MedSAM: Implicit Medical Image Segmentation with Segment Anything
di: Wei, Xiaobao, et al.
Pubblicazione: (2023)
di: Wei, Xiaobao, et al.
Pubblicazione: (2023)
LLM as Dataset Analyst: Subpopulation Structure Discovery with Large Language Model
di: Luo, Yulin, et al.
Pubblicazione: (2024)
di: Luo, Yulin, et al.
Pubblicazione: (2024)
The language of time: a language model perspective on time-series foundation models
di: Xie, Yi, et al.
Pubblicazione: (2025)
di: Xie, Yi, et al.
Pubblicazione: (2025)
A comprehensive evaluation of large language models in mining gene relations and pathway knowledge
di: Muhammad Azam, et al.
Pubblicazione: (2024)
di: Muhammad Azam, et al.
Pubblicazione: (2024)
Decomposing the Neurons: Activation Sparsity via Mixture of Experts for Continual Test Time Adaptation
di: Zhang, Rongyu, et al.
Pubblicazione: (2024)
di: Zhang, Rongyu, et al.
Pubblicazione: (2024)
Insights into a radiology-specialised multimodal large language model with sparse autoencoders
di: Bouzid, Kenza, et al.
Pubblicazione: (2025)
di: Bouzid, Kenza, et al.
Pubblicazione: (2025)
RadEval: A framework for radiology text evaluation
di: Xu, Justin, et al.
Pubblicazione: (2025)
di: Xu, Justin, et al.
Pubblicazione: (2025)
Development of an effectiveness evaluation model of the security management function of radiological facilities
di: A.R Lima
Pubblicazione: (2022)
di: A.R Lima
Pubblicazione: (2022)
MMG-Vid: Maximizing Marginal Gains at Segment-level and Token-level for Efficient Video LLMs
di: Ma, Junpeng, et al.
Pubblicazione: (2025)
di: Ma, Junpeng, et al.
Pubblicazione: (2025)
Real‐world evidence for comprehensive evaluation of guselkumab in the treatment of psoriasis
di: Diamant Thaçi
Pubblicazione: (2025)
di: Diamant Thaçi
Pubblicazione: (2025)
A Time Series is Worth Five Experts: Heterogeneous Mixture of Experts for Traffic Flow Prediction
di: Wang, Guangyu, et al.
Pubblicazione: (2024)
di: Wang, Guangyu, et al.
Pubblicazione: (2024)
MoASE++: Mixture of Activation Sparsity Experts with Domain-Adaptive On-policy Distillation for Continual Test Time Adaptation
di: Zhang, Ronyu, et al.
Pubblicazione: (2026)
di: Zhang, Ronyu, et al.
Pubblicazione: (2026)
YOLOv10 with Kolmogorov-Arnold networks and vision-language foundation models for interpretable object detection and trustworthy multimodal AI in computer vision perception
di: Impraimakis, Marios, et al.
Pubblicazione: (2026)
di: Impraimakis, Marios, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Thinker: A vision-language foundation model for embodied intelligence
di: Pan, Baiyu, et al.
Pubblicazione: (2026) -
ClinicalGPT-R1: Pushing reasoning capability of generalist disease diagnosis with large language model
di: Lan, Wuyang, et al.
Pubblicazione: (2025) -
Towards a clinically accessible radiology foundation model: open-access and lightweight, with automated evaluation
di: Chaves, Juan Manuel Zambrano, et al.
Pubblicazione: (2024) -
GreenRFM: Toward a resource-efficient radiology foundation model
di: Li, Yingtai, et al.
Pubblicazione: (2026) -
Editorial for “A Glycine‐Targeted In Vivo Magnetic Resonance Spectroscopy for Quantifying Glycine in Glioma”
di: Jiaji Mao, et al.
Pubblicazione: (2025)