How Does Diverse Interpretability of Textual Prompts Impact Medical Vision-Language Zero-Shot Tasks?
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Sicheng, Liu, Che, Arcucci, Rossella |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
T3D: Advancing 3D Medical Vision-Language Pre-training by Learning Multi-View Visual Consistency
por: Liu, Che, et al.
Publicado: (2023)
por: Liu, Che, et al.
Publicado: (2023)
Diagnostic Accuracy of Open-Source Vision-Language Models on Diverse Medical Imaging Tasks
por: Müller-Franzes, Gustav, et al.
Publicado: (2025)
por: Müller-Franzes, Gustav, et al.
Publicado: (2025)
Few Shot Class Incremental Learning using Vision-Language models
por: Kumar, Anurag, et al.
Publicado: (2024)
por: Kumar, Anurag, et al.
Publicado: (2024)
CPLIP: Zero-Shot Learning for Histopathology with Comprehensive Vision-Language Alignment
por: Javed, Sajid, et al.
Publicado: (2024)
por: Javed, Sajid, et al.
Publicado: (2024)
E3D-GPT: Enhanced 3D Visual Foundation for Medical Vision-Language Model
por: Lai, Haoran, et al.
Publicado: (2024)
por: Lai, Haoran, et al.
Publicado: (2024)
Read Like a Radiologist: Efficient Vision-Language Model for 3D Medical Imaging Interpretation
por: Lee, Changsun, et al.
Publicado: (2024)
por: Lee, Changsun, et al.
Publicado: (2024)
MedVisionLlama: Leveraging Pre-Trained Large Language Model Layers to Enhance Medical Image Segmentation
por: Kumar, Gurucharan Marthi Krishna, et al.
Publicado: (2024)
por: Kumar, Gurucharan Marthi Krishna, et al.
Publicado: (2024)
Interpretable Few-Shot Retinal Disease Diagnosis with Concept-Guided Prompting of Vision-Language Models
por: Mehta, Deval, et al.
Publicado: (2025)
por: Mehta, Deval, et al.
Publicado: (2025)
Benchmarking GPT-5 for Zero-Shot Multimodal Medical Reasoning in Radiology and Radiation Oncology
por: Hu, Mingzhe, et al.
Publicado: (2025)
por: Hu, Mingzhe, et al.
Publicado: (2025)
Comparing SAM 2 and SAM 3 for Zero-Shot Segmentation of 3D Medical Data
por: Chakrabarty, Satrajit, et al.
Publicado: (2025)
por: Chakrabarty, Satrajit, et al.
Publicado: (2025)
Medical diffusion on a budget: Textual Inversion for medical image generation
por: de Wilde, Bram, et al.
Publicado: (2023)
por: de Wilde, Bram, et al.
Publicado: (2023)
The Importance of Facial Features in Vision-based Sign Language Recognition: Eyes, Mouth or Full Face?
por: Pham, Dinh Nam, et al.
Publicado: (2025)
por: Pham, Dinh Nam, et al.
Publicado: (2025)
BUFFER-X: Towards Zero-Shot Point Cloud Registration in Diverse Scenes
por: Seo, Minkyun, et al.
Publicado: (2025)
por: Seo, Minkyun, et al.
Publicado: (2025)
SAM3D: Zero-Shot Semi-Automatic Segmentation in 3D Medical Images with the Segment Anything Model
por: Chan, Trevor J., et al.
Publicado: (2024)
por: Chan, Trevor J., et al.
Publicado: (2024)
How Well Do Supervised 3D Models Transfer to Medical Imaging Tasks?
por: Li, Wenxuan, et al.
Publicado: (2025)
por: Li, Wenxuan, et al.
Publicado: (2025)
MedFLIP: Medical Vision-and-Language Self-supervised Fast Pre-Training with Masked Autoencoder
por: Li, Lei, et al.
Publicado: (2024)
por: Li, Lei, et al.
Publicado: (2024)
Rethinking Few-Shot Medical Image Segmentation by SAM2: A Training-Free Framework with Augmentative Prompting and Dynamic Matching
por: Zu, Haiyue, et al.
Publicado: (2025)
por: Zu, Haiyue, et al.
Publicado: (2025)
CuNeRF: Cube-Based Neural Radiance Field for Zero-Shot Medical Image Arbitrary-Scale Super Resolution
por: Chen, Zixuan, et al.
Publicado: (2023)
por: Chen, Zixuan, et al.
Publicado: (2023)
Vision-Language Synthetic Data Enhances Echocardiography Downstream Tasks
por: Ashrafian, Pooria, et al.
Publicado: (2024)
por: Ashrafian, Pooria, et al.
Publicado: (2024)
EPSegFZ: Efficient Point Cloud Semantic Segmentation for Few- and Zero-Shot Scenarios with Language Guidance
por: Wang, Jiahui, et al.
Publicado: (2025)
por: Wang, Jiahui, et al.
Publicado: (2025)
Structured Prompting and Multi-Agent Knowledge Distillation for Traffic Video Interpretation and Risk Inference
por: Yang, Yunxiang, et al.
Publicado: (2025)
por: Yang, Yunxiang, et al.
Publicado: (2025)
Zero-Shot Distracted Driver Detection via Vision Language Models with Double Decoupling
por: Miyata, Takamichi, et al.
Publicado: (2026)
por: Miyata, Takamichi, et al.
Publicado: (2026)
One-Prompt to Segment All Medical Images
por: Wu, Junde, et al.
Publicado: (2023)
por: Wu, Junde, et al.
Publicado: (2023)
Zero-Shot Image Denoising for High-Resolution Electron Microscopy
por: Tian, Xuanyu, et al.
Publicado: (2024)
por: Tian, Xuanyu, et al.
Publicado: (2024)
Cross-conditioned Diffusion Model for Medical Image to Image Translation
por: Xing, Zhaohu, et al.
Publicado: (2024)
por: Xing, Zhaohu, et al.
Publicado: (2024)
Vision-Language Controlled Deep Unfolding for Joint Medical Image Restoration and Segmentation
por: Chen, Ping, et al.
Publicado: (2026)
por: Chen, Ping, et al.
Publicado: (2026)
Taming Vision-Language Models for Medical Image Analysis: A Comprehensive Review
por: Lin, Haoneng, et al.
Publicado: (2025)
por: Lin, Haoneng, et al.
Publicado: (2025)
PromptHSI: Universal Hyperspectral Image Restoration with Vision-Language Modulated Frequency Adaptation
por: Lee, Chia-Ming, et al.
Publicado: (2024)
por: Lee, Chia-Ming, et al.
Publicado: (2024)
Zero-Shot Low-dose CT Denoising via Sinogram Flicking
por: Shi, Yongyi, et al.
Publicado: (2025)
por: Shi, Yongyi, et al.
Publicado: (2025)
Toward Zero-Shot Learning for Visual Dehazing of Urological Surgical Robots
por: Wu, Renkai, et al.
Publicado: (2024)
por: Wu, Renkai, et al.
Publicado: (2024)
Lightweight Physics-Aware Zero-Shot Ultrasound Plane-Wave Denoising
por: Asgariandehkordi, Hojat, et al.
Publicado: (2025)
por: Asgariandehkordi, Hojat, et al.
Publicado: (2025)
Large-Vocabulary Segmentation for Medical Images with Text Prompts
por: Zhao, Ziheng, et al.
Publicado: (2023)
por: Zhao, Ziheng, et al.
Publicado: (2023)
Segmentation of Knee Bones for Osteoarthritis Assessment: A Comparative Analysis of Supervised, Few-Shot, and Zero-Shot Learning Approaches
por: Teoh, Yun Xin, et al.
Publicado: (2024)
por: Teoh, Yun Xin, et al.
Publicado: (2024)
Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute
por: Kim, Daneul, et al.
Publicado: (2025)
por: Kim, Daneul, et al.
Publicado: (2025)
Med3DVLM: An Efficient Vision-Language Model for 3D Medical Image Analysis
por: Xin, Yu, et al.
Publicado: (2025)
por: Xin, Yu, et al.
Publicado: (2025)
VLSM-Ensemble: Ensembling CLIP-based Vision-Language Models for Enhanced Medical Image Segmentation
por: Dietlmeier, Julia, et al.
Publicado: (2025)
por: Dietlmeier, Julia, et al.
Publicado: (2025)
Prompt-driven Latent Domain Generalization for Medical Image Classification
por: Yan, Siyuan, et al.
Publicado: (2024)
por: Yan, Siyuan, et al.
Publicado: (2024)
Task-Guided Prompting for Unified Remote Sensing Image Restoration
por: Huang, Wenli, et al.
Publicado: (2026)
por: Huang, Wenli, et al.
Publicado: (2026)
Zero-Shot Hyperspectral Pansharpening Using Hysteresis-Based Tuning for Spectral Quality Control
por: Guarino, Giuseppe, et al.
Publicado: (2025)
por: Guarino, Giuseppe, et al.
Publicado: (2025)
IGDNet: Zero-Shot Robust Underexposed Image Enhancement via Illumination-Guided and Denoising
por: Yan, Hailong, et al.
Publicado: (2025)
por: Yan, Hailong, et al.
Publicado: (2025)
Ejemplares similares
-
T3D: Advancing 3D Medical Vision-Language Pre-training by Learning Multi-View Visual Consistency
por: Liu, Che, et al.
Publicado: (2023) -
Diagnostic Accuracy of Open-Source Vision-Language Models on Diverse Medical Imaging Tasks
por: Müller-Franzes, Gustav, et al.
Publicado: (2025) -
Few Shot Class Incremental Learning using Vision-Language models
por: Kumar, Anurag, et al.
Publicado: (2024) -
CPLIP: Zero-Shot Learning for Histopathology with Comprehensive Vision-Language Alignment
por: Javed, Sajid, et al.
Publicado: (2024) -
E3D-GPT: Enhanced 3D Visual Foundation for Medical Vision-Language Model
por: Lai, Haoran, et al.
Publicado: (2024)