Anatomical Structure-Guided Medical Vision-Language Pre-training
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Qingqiu, Yan, Xiaohan, Xu, Jilan, Yuan, Runtian, Zhang, Yuejie, Feng, Rui, Shen, Quanli, Zhang, Xiaobo, Wang, Shujun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AOR: Anatomical Ontology-Guided Reasoning for Medical Large Multimodal Model in Chest X-Ray Interpretation
di: Li, Qingqiu, et al.
Pubblicazione: (2025)
di: Li, Qingqiu, et al.
Pubblicazione: (2025)
Vision-Language Model Based Multi-Expert Fusion for CT Image Classification
di: Bai, Jianfa, et al.
Pubblicazione: (2026)
di: Bai, Jianfa, et al.
Pubblicazione: (2026)
Clinical Priors Guided Lung Disease Detection in 3D CT Scans
di: Lu, Kejin, et al.
Pubblicazione: (2026)
di: Lu, Kejin, et al.
Pubblicazione: (2026)
Text-Promptable Propagation for Referring Medical Image Sequence Segmentation
di: Yuan, Runtian, et al.
Pubblicazione: (2025)
di: Yuan, Runtian, et al.
Pubblicazione: (2025)
Advancing Lung Disease Diagnosis in 3D CT Scans
di: Li, Qingqiu, et al.
Pubblicazione: (2025)
di: Li, Qingqiu, et al.
Pubblicazione: (2025)
Domain Adaptation Using Pseudo Labels for COVID-19 Detection
di: Yuan, Runtian, et al.
Pubblicazione: (2024)
di: Yuan, Runtian, et al.
Pubblicazione: (2024)
Advancing COVID-19 Detection in 3D CT Scans
di: Li, Qingqiu, et al.
Pubblicazione: (2024)
di: Li, Qingqiu, et al.
Pubblicazione: (2024)
Multi-Source COVID-19 Detection via Variance Risk Extrapolation
di: Yuan, Runtian, et al.
Pubblicazione: (2025)
di: Yuan, Runtian, et al.
Pubblicazione: (2025)
An Empirical Analysis of Uncertainty in Large Language Model Evaluations
di: Xie, Qiujie, et al.
Pubblicazione: (2025)
di: Xie, Qiujie, et al.
Pubblicazione: (2025)
NITP: Next Implicit Token Prediction for LLM Pre-training
di: Zhang, Xiangdong, et al.
Pubblicazione: (2026)
di: Zhang, Xiangdong, et al.
Pubblicazione: (2026)
VLP: A Survey on Vision-Language Pre-training
di: Chen, Feilong, et al.
Pubblicazione: (2022)
di: Chen, Feilong, et al.
Pubblicazione: (2022)
FineMedLM-o1: Enhancing Medical Knowledge Reasoning Ability of LLM from Supervised Fine-Tuning to Test-Time Training
di: Yu, Hongzhou, et al.
Pubblicazione: (2025)
di: Yu, Hongzhou, et al.
Pubblicazione: (2025)
Pseudo-Prompt Generating in Pre-trained Vision-Language Models for Multi-Label Medical Image Classification
di: Ye, Yaoqin, et al.
Pubblicazione: (2024)
di: Ye, Yaoqin, et al.
Pubblicazione: (2024)
CT2C-QA: Multimodal Question Answering over Chinese Text, Table and Chart
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
Distributionally Robust Alignment for Medical Federated Vision-Language Pre-training Under Data Heterogeneity
di: Shuai, Zitao, et al.
Pubblicazione: (2024)
di: Shuai, Zitao, et al.
Pubblicazione: (2024)
TiMix: Text-aware Image Mixing for Effective Vision-Language Pre-training
di: Jiang, Chaoya, et al.
Pubblicazione: (2023)
di: Jiang, Chaoya, et al.
Pubblicazione: (2023)
Pre-trained Language Models and Few-shot Learning for Medical Entity Extraction
di: Wang, Xiaokai, et al.
Pubblicazione: (2025)
di: Wang, Xiaokai, et al.
Pubblicazione: (2025)
GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
EgoExo-Gen: Ego-centric Video Prediction by Watching Exo-centric Videos
di: Xu, Jilan, et al.
Pubblicazione: (2025)
di: Xu, Jilan, et al.
Pubblicazione: (2025)
Uni-Mlip: Unified Self-supervision for Medical Vision Language Pre-training
di: Bawazir, Ameera, et al.
Pubblicazione: (2024)
di: Bawazir, Ameera, et al.
Pubblicazione: (2024)
Masked Structural Growth for 2x Faster Language Model Pre-training
di: Yao, Yiqun, et al.
Pubblicazione: (2023)
di: Yao, Yiqun, et al.
Pubblicazione: (2023)
Medical Vision-Language Pre-Training for Brain Abnormalities
di: Monajatipoor, Masoud, et al.
Pubblicazione: (2024)
di: Monajatipoor, Masoud, et al.
Pubblicazione: (2024)
Superpixel Semantics Representation and Pre-training for Vision-Language Task
di: Zhang, Siyu, et al.
Pubblicazione: (2023)
di: Zhang, Siyu, et al.
Pubblicazione: (2023)
Fine-tuning Pre-trained Language Models for Few-shot Intent Detection: Supervised Pre-training and Isotropization
di: Zhang, Haode, et al.
Pubblicazione: (2022)
di: Zhang, Haode, et al.
Pubblicazione: (2022)
COSMOS: Cross-Modality Self-Distillation for Vision Language Pre-training
di: Kim, Sanghwan, et al.
Pubblicazione: (2024)
di: Kim, Sanghwan, et al.
Pubblicazione: (2024)
TRELM: Towards Robust and Efficient Pre-training for Knowledge-Enhanced Language Models
di: Yan, Junbing, et al.
Pubblicazione: (2024)
di: Yan, Junbing, et al.
Pubblicazione: (2024)
EVE: Efficient Vision-Language Pre-training with Masked Prediction and Modality-Aware MoE
di: Chen, Junyi, et al.
Pubblicazione: (2023)
di: Chen, Junyi, et al.
Pubblicazione: (2023)
Memory Grafting: Scaling Language Model Pre-training via Offline Conditional Memory
di: Cheng, Runxi, et al.
Pubblicazione: (2026)
di: Cheng, Runxi, et al.
Pubblicazione: (2026)
Pre-trained Vision-Language Models Learn Discoverable Visual Concepts
di: Zang, Yuan, et al.
Pubblicazione: (2024)
di: Zang, Yuan, et al.
Pubblicazione: (2024)
Inside the Black Box: Detecting Data Leakage in Pre-trained Language Encoders
di: Xin, Yuan, et al.
Pubblicazione: (2024)
di: Xin, Yuan, et al.
Pubblicazione: (2024)
KoCo: Conditioning Language Model Pre-training on Knowledge Coordinates
di: Li, Yudong, et al.
Pubblicazione: (2026)
di: Li, Yudong, et al.
Pubblicazione: (2026)
Efficient Continual Pre-training by Mitigating the Stability Gap
di: Guo, Yiduo, et al.
Pubblicazione: (2024)
di: Guo, Yiduo, et al.
Pubblicazione: (2024)
Dual Semantic-Aware Network for Noise Suppressed Ultrasound Video Segmentation
di: Zhou, Ling, et al.
Pubblicazione: (2025)
di: Zhou, Ling, et al.
Pubblicazione: (2025)
MedFLIP: Medical Vision-and-Language Self-supervised Fast Pre-Training with Masked Autoencoder
di: Li, Lei, et al.
Pubblicazione: (2024)
di: Li, Lei, et al.
Pubblicazione: (2024)
Chinese Sequence Labeling with Semi-Supervised Boundary-Aware Language Model Pre-training
di: Zhang, Longhui, et al.
Pubblicazione: (2024)
di: Zhang, Longhui, et al.
Pubblicazione: (2024)
DEPT: Decoupled Embeddings for Pre-training Language Models
di: Iacob, Alex, et al.
Pubblicazione: (2024)
di: Iacob, Alex, et al.
Pubblicazione: (2024)
QoSBERT: An Uncertainty-Aware Approach based on Pre-trained Language Models for Service Quality Prediction
di: Wang, Ziliang, et al.
Pubblicazione: (2025)
di: Wang, Ziliang, et al.
Pubblicazione: (2025)
Med-MoE: Mixture of Domain-Specific Experts for Lightweight Medical Vision-Language Models
di: Jiang, Songtao, et al.
Pubblicazione: (2024)
di: Jiang, Songtao, et al.
Pubblicazione: (2024)
MEDVOC: Vocabulary Adaptation for Fine-tuning Pre-trained Language Models on Medical Text Summarization
di: Balde, Gunjan, et al.
Pubblicazione: (2024)
di: Balde, Gunjan, et al.
Pubblicazione: (2024)
Leveraging Vision-Language Pre-training for Human Activity Recognition in Still Images
di: Mahanta, Cristina, et al.
Pubblicazione: (2025)
di: Mahanta, Cristina, et al.
Pubblicazione: (2025)
Documenti analoghi
-
AOR: Anatomical Ontology-Guided Reasoning for Medical Large Multimodal Model in Chest X-Ray Interpretation
di: Li, Qingqiu, et al.
Pubblicazione: (2025) -
Vision-Language Model Based Multi-Expert Fusion for CT Image Classification
di: Bai, Jianfa, et al.
Pubblicazione: (2026) -
Clinical Priors Guided Lung Disease Detection in 3D CT Scans
di: Lu, Kejin, et al.
Pubblicazione: (2026) -
Text-Promptable Propagation for Referring Medical Image Sequence Segmentation
di: Yuan, Runtian, et al.
Pubblicazione: (2025) -
Advancing Lung Disease Diagnosis in 3D CT Scans
di: Li, Qingqiu, et al.
Pubblicazione: (2025)