IMITATE: Clinical Prior Guided Hierarchical Vision-Language Pre-training
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Che, Cheng, Sibo, Shi, Miaojing, Shah, Anand, Bai, Wenjia, Arcucci, Rossella |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
G2D: From Global to Dense Radiography Representation Learning via Vision-Language Pre-training
di: Liu, Che, et al.
Pubblicazione: (2023)
di: Liu, Che, et al.
Pubblicazione: (2023)
Utilizing Synthetic Data for Medical Vision-Language Pre-training: Bypassing the Need for Real Images
di: Liu, Che, et al.
Pubblicazione: (2023)
di: Liu, Che, et al.
Pubblicazione: (2023)
Freeze the backbones: A Parameter-Efficient Contrastive Approach to Robust Medical Vision-Language Pre-training
di: Qin, Jiuming, et al.
Pubblicazione: (2024)
di: Qin, Jiuming, et al.
Pubblicazione: (2024)
How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study
di: Liu, Che, et al.
Pubblicazione: (2025)
di: Liu, Che, et al.
Pubblicazione: (2025)
T3D: Advancing 3D Medical Vision-Language Pre-training by Learning Multi-View Visual Consistency
di: Liu, Che, et al.
Pubblicazione: (2023)
di: Liu, Che, et al.
Pubblicazione: (2023)
Enhancing Abnormality Grounding for Vision Language Models with Knowledge Descriptions
di: Li, Jun, et al.
Pubblicazione: (2025)
di: Li, Jun, et al.
Pubblicazione: (2025)
Can Medical Vision-Language Pre-training Succeed with Purely Synthetic Data?
di: Liu, Che, et al.
Pubblicazione: (2024)
di: Liu, Che, et al.
Pubblicazione: (2024)
How Does Diverse Interpretability of Textual Prompts Impact Medical Vision-Language Zero-Shot Tasks?
di: Wang, Sicheng, et al.
Pubblicazione: (2024)
di: Wang, Sicheng, et al.
Pubblicazione: (2024)
Med-UniC: Unifying Cross-Lingual Medical Vision-Language Pre-Training by Diminishing Bias
di: Wan, Zhongwei, et al.
Pubblicazione: (2023)
di: Wan, Zhongwei, et al.
Pubblicazione: (2023)
Knowledge to Sight: Reasoning over Visual Attributes via Knowledge Decomposition for Abnormality Grounding
di: Li, Jun, et al.
Pubblicazione: (2025)
di: Li, Jun, et al.
Pubblicazione: (2025)
FMBench: Benchmarking Fairness in Multimodal Large Language Models on Medical Tasks
di: Wu, Peiran, et al.
Pubblicazione: (2024)
di: Wu, Peiran, et al.
Pubblicazione: (2024)
VLPrompt: Vision-Language Prompting for Panoptic Scene Graph Generation
di: Zhou, Zijian, et al.
Pubblicazione: (2023)
di: Zhou, Zijian, et al.
Pubblicazione: (2023)
BIMCV-R: A Landmark Dataset for 3D CT Text-Image Retrieval
di: Chen, Yinda, et al.
Pubblicazione: (2024)
di: Chen, Yinda, et al.
Pubblicazione: (2024)
Argus: Benchmarking and Enhancing Vision-Language Models for 3D Radiology Report Generation
di: Liu, Che, et al.
Pubblicazione: (2024)
di: Liu, Che, et al.
Pubblicazione: (2024)
3D Scene Graph Guided Vision-Language Pre-training
di: Liu, Hao, et al.
Pubblicazione: (2024)
di: Liu, Hao, et al.
Pubblicazione: (2024)
Pre-trained Model Guided Fine-Tuning for Zero-Shot Adversarial Robustness
di: Wang, Sibo, et al.
Pubblicazione: (2024)
di: Wang, Sibo, et al.
Pubblicazione: (2024)
BOTM: Echocardiography Segmentation via Bi-directional Optimal Token Matching
di: Liu, Zhihua, et al.
Pubblicazione: (2025)
di: Liu, Zhihua, et al.
Pubblicazione: (2025)
Multitask Learning in Minimally Invasive Surgical Vision: A Review
di: Alabi, Oluwatosin, et al.
Pubblicazione: (2024)
di: Alabi, Oluwatosin, et al.
Pubblicazione: (2024)
Text Promptable Surgical Instrument Segmentation with Vision-Language Models
di: Zhou, Zijian, et al.
Pubblicazione: (2023)
di: Zhou, Zijian, et al.
Pubblicazione: (2023)
Noise2Noise Denoising of CRISM Hyperspectral Data
di: Platt, Robert, et al.
Pubblicazione: (2024)
di: Platt, Robert, et al.
Pubblicazione: (2024)
Can LLM-Generated Text Empower Surgical Vision-Language Pre-training?
di: Che, Chengan, et al.
Pubblicazione: (2026)
di: Che, Chengan, et al.
Pubblicazione: (2026)
MAA: Meticulous Adversarial Attack against Vision-Language Pre-trained Models
di: Zhang, Peng-Fei, et al.
Pubblicazione: (2025)
di: Zhang, Peng-Fei, et al.
Pubblicazione: (2025)
Zero-Shot ECG Classification with Multimodal Learning and Test-time Clinical Knowledge Enhancement
di: Liu, Che, et al.
Pubblicazione: (2024)
di: Liu, Che, et al.
Pubblicazione: (2024)
Enhancing Vision-Language Pre-training with Rich Supervisions
di: Gao, Yuan, et al.
Pubblicazione: (2024)
di: Gao, Yuan, et al.
Pubblicazione: (2024)
Anatomical Structure-Guided Medical Vision-Language Pre-training
di: Li, Qingqiu, et al.
Pubblicazione: (2024)
di: Li, Qingqiu, et al.
Pubblicazione: (2024)
Enhancing Space-time Video Super-resolution via Spatial-temporal Feature Interaction
di: Yue, Zijie, et al.
Pubblicazione: (2022)
di: Yue, Zijie, et al.
Pubblicazione: (2022)
IMITATE: Image Registration with Context for unknown time frame recovery
di: Kheil, Ziad, et al.
Pubblicazione: (2025)
di: Kheil, Ziad, et al.
Pubblicazione: (2025)
TIP: Tabular-Image Pre-training for Multimodal Classification with Incomplete Data
di: Du, Siyi, et al.
Pubblicazione: (2024)
di: Du, Siyi, et al.
Pubblicazione: (2024)
Unsupervised Pre-training with Language-Vision Prompts for Low-Data Instance Segmentation
di: Zhang, Dingwen, et al.
Pubblicazione: (2024)
di: Zhang, Dingwen, et al.
Pubblicazione: (2024)
Efficient and Effective Universal Adversarial Attack against Vision-Language Pre-training Models
di: Yang, Fan, et al.
Pubblicazione: (2024)
di: Yang, Fan, et al.
Pubblicazione: (2024)
VLP: A Survey on Vision-Language Pre-training
di: Chen, Feilong, et al.
Pubblicazione: (2022)
di: Chen, Feilong, et al.
Pubblicazione: (2022)
Does DINOv3 Set a New Medical Vision Standard? Benchmarking 2D and 3D Classification, Segmentation, and Registration
di: Liu, Che, et al.
Pubblicazione: (2025)
di: Liu, Che, et al.
Pubblicazione: (2025)
Efficient Vision-Language Pre-training by Cluster Masking
di: Wei, Zihao, et al.
Pubblicazione: (2024)
di: Wei, Zihao, et al.
Pubblicazione: (2024)
Semantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-training
di: Liu, Haowei, et al.
Pubblicazione: (2024)
di: Liu, Haowei, et al.
Pubblicazione: (2024)
PriorCLIP: Visual Prior Guided Vision-Language Model for Remote Sensing Image-Text Retrieval
di: Pan, Jiancheng, et al.
Pubblicazione: (2024)
di: Pan, Jiancheng, et al.
Pubblicazione: (2024)
Memory-guided Network with Uncertainty-based Feature Augmentation for Few-shot Semantic Segmentation
di: Chen, Xinyue, et al.
Pubblicazione: (2024)
di: Chen, Xinyue, et al.
Pubblicazione: (2024)
Revisiting Multimodal Positional Encoding in Vision-Language Models
di: Huang, Jie, et al.
Pubblicazione: (2025)
di: Huang, Jie, et al.
Pubblicazione: (2025)
PriorRG: Prior-Guided Contrastive Pre-training and Coarse-to-Fine Decoding for Chest X-ray Report Generation
di: Liu, Kang, et al.
Pubblicazione: (2025)
di: Liu, Kang, et al.
Pubblicazione: (2025)
When Multi-Task Learning Meets Partial Supervision: A Computer Vision Review
di: Fontana, Maxime, et al.
Pubblicazione: (2023)
di: Fontana, Maxime, et al.
Pubblicazione: (2023)
Multilingual Vision-Language Pre-training for the Remote Sensing Domain
di: Silva, João Daniel, et al.
Pubblicazione: (2024)
di: Silva, João Daniel, et al.
Pubblicazione: (2024)
Documenti analoghi
-
G2D: From Global to Dense Radiography Representation Learning via Vision-Language Pre-training
di: Liu, Che, et al.
Pubblicazione: (2023) -
Utilizing Synthetic Data for Medical Vision-Language Pre-training: Bypassing the Need for Real Images
di: Liu, Che, et al.
Pubblicazione: (2023) -
Freeze the backbones: A Parameter-Efficient Contrastive Approach to Robust Medical Vision-Language Pre-training
di: Qin, Jiuming, et al.
Pubblicazione: (2024) -
How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study
di: Liu, Che, et al.
Pubblicazione: (2025) -
T3D: Advancing 3D Medical Vision-Language Pre-training by Learning Multi-View Visual Consistency
di: Liu, Che, et al.
Pubblicazione: (2023)