Efficient Few-Shot Medical Image Analysis via Hierarchical Contrastive Vision-Language Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Fuller, Harrison, Garcia, Fernando Gabriela, Flores, Victor |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Enhancing Vision-Language Few-Shot Adaptation with Negative Learning
von: Zhang, Ce, et al.
Veröffentlicht: (2024)
von: Zhang, Ce, et al.
Veröffentlicht: (2024)
HSCR: Hierarchical Self-Contrastive Rewarding for Aligning Medical Vision Language Models
von: Jiang, Songtao, et al.
Veröffentlicht: (2025)
von: Jiang, Songtao, et al.
Veröffentlicht: (2025)
Mechanistic Finetuning of Vision-Language-Action Models via Few-Shot Demonstrations
von: Mitra, Chancharik, et al.
Veröffentlicht: (2025)
von: Mitra, Chancharik, et al.
Veröffentlicht: (2025)
Few-Shot Learning from Gigapixel Images via Hierarchical Vision-Language Alignment and Modeling
von: Wong, Bryan, et al.
Veröffentlicht: (2025)
von: Wong, Bryan, et al.
Veröffentlicht: (2025)
Few Shot Class Incremental Learning using Vision-Language models
von: Kumar, Anurag, et al.
Veröffentlicht: (2024)
von: Kumar, Anurag, et al.
Veröffentlicht: (2024)
Few-Shot Adversarial Prompt Learning on Vision-Language Models
von: Zhou, Yiwei, et al.
Veröffentlicht: (2024)
von: Zhou, Yiwei, et al.
Veröffentlicht: (2024)
MedCLIPSeg: Probabilistic Vision-Language Adaptation for Data-Efficient and Generalizable Medical Image Segmentation
von: Koleilat, Taha, et al.
Veröffentlicht: (2026)
von: Koleilat, Taha, et al.
Veröffentlicht: (2026)
Multi-Level Correlation Network For Few-Shot Image Classification
von: Dang, Yunkai, et al.
Veröffentlicht: (2024)
von: Dang, Yunkai, et al.
Veröffentlicht: (2024)
Enhancing Few-Shot Vision-Language Classification with Large Multimodal Model Features
von: Mitra, Chancharik, et al.
Veröffentlicht: (2024)
von: Mitra, Chancharik, et al.
Veröffentlicht: (2024)
ZALM3: Zero-Shot Enhancement of Vision-Language Alignment via In-Context Information in Multi-Turn Multimodal Medical Dialogue
von: Li, Zhangpu, et al.
Veröffentlicht: (2024)
von: Li, Zhangpu, et al.
Veröffentlicht: (2024)
Contrastive Graph Modeling for Cross-Domain Few-Shot Medical Image Segmentation
von: Bo, Yuntian, et al.
Veröffentlicht: (2025)
von: Bo, Yuntian, et al.
Veröffentlicht: (2025)
Dynamic Embedding of Hierarchical Visual Features for Efficient Vision-Language Fine-Tuning
von: Wei, Xinyu, et al.
Veröffentlicht: (2025)
von: Wei, Xinyu, et al.
Veröffentlicht: (2025)
Evaluating Linguistic Capabilities of Multimodal LLMs in the Lens of Few-Shot Learning
von: Dogan, Mustafa, et al.
Veröffentlicht: (2024)
von: Dogan, Mustafa, et al.
Veröffentlicht: (2024)
Few-Shot Image Quality Assessment via Adaptation of Vision-Language Models
von: Li, Xudong, et al.
Veröffentlicht: (2024)
von: Li, Xudong, et al.
Veröffentlicht: (2024)
TemMed-Bench: Evaluating Temporal Medical Image Reasoning in Vision-Language Models
von: Zhang, Junyi, et al.
Veröffentlicht: (2025)
von: Zhang, Junyi, et al.
Veröffentlicht: (2025)
CLoVe: Encoding Compositional Language in Contrastive Vision-Language Models
von: Castro, Santiago, et al.
Veröffentlicht: (2024)
von: Castro, Santiago, et al.
Veröffentlicht: (2024)
Exploiting DINOv3-Based Self-Supervised Features for Robust Few-Shot Medical Image Segmentation
von: Xu, Guoping, et al.
Veröffentlicht: (2026)
von: Xu, Guoping, et al.
Veröffentlicht: (2026)
Few-Shot Relation Extraction with Hybrid Visual Evidence
von: Gong, Jiaying, et al.
Veröffentlicht: (2024)
von: Gong, Jiaying, et al.
Veröffentlicht: (2024)
Towards Zero-Shot Annotation of the Built Environment with Vision-Language Models (Vision Paper)
von: Han, Bin, et al.
Veröffentlicht: (2024)
von: Han, Bin, et al.
Veröffentlicht: (2024)
WAON: A Large-Scale Japanese Image-Text Dataset for Cultural Adaptation in Contrastive Vision-Language Models
von: Sugiura, Issa, et al.
Veröffentlicht: (2025)
von: Sugiura, Issa, et al.
Veröffentlicht: (2025)
Open-Source Image Editing Models Are Zero-Shot Vision Learners
von: Liu, Wei, et al.
Veröffentlicht: (2026)
von: Liu, Wei, et al.
Veröffentlicht: (2026)
Efficient Few-Shot Continual Learning in Vision-Language Models
von: Panos, Aristeidis, et al.
Veröffentlicht: (2025)
von: Panos, Aristeidis, et al.
Veröffentlicht: (2025)
Pseudo-Prompt Generating in Pre-trained Vision-Language Models for Multi-Label Medical Image Classification
von: Ye, Yaoqin, et al.
Veröffentlicht: (2024)
von: Ye, Yaoqin, et al.
Veröffentlicht: (2024)
Verbalized Representation Learning for Interpretable Few-Shot Generalization
von: Yang, Cheng-Fu, et al.
Veröffentlicht: (2024)
von: Yang, Cheng-Fu, et al.
Veröffentlicht: (2024)
NAVIG: Natural Language-guided Analysis with Vision Language Models for Image Geo-localization
von: Zhang, Zheyuan, et al.
Veröffentlicht: (2025)
von: Zhang, Zheyuan, et al.
Veröffentlicht: (2025)
HAWAII: Hierarchical Visual Knowledge Transfer for Efficient Vision-Language Models
von: Wang, Yimu, et al.
Veröffentlicht: (2025)
von: Wang, Yimu, et al.
Veröffentlicht: (2025)
VLCD: Vision-Language Contrastive Distillation for Accurate and Efficient Automatic Placenta Analysis
von: Mehta, Manas, et al.
Veröffentlicht: (2025)
von: Mehta, Manas, et al.
Veröffentlicht: (2025)
Few-Shot VQA with Frozen LLMs: A Tale of Two Approaches
von: Sterner, Igor, et al.
Veröffentlicht: (2024)
von: Sterner, Igor, et al.
Veröffentlicht: (2024)
Investigating Prompting Techniques for Zero- and Few-Shot Visual Question Answering
von: Awal, Rabiul, et al.
Veröffentlicht: (2023)
von: Awal, Rabiul, et al.
Veröffentlicht: (2023)
Medical Context Distorts Decisions in Clinical Vision Language Models
von: Restrepo, David, et al.
Veröffentlicht: (2026)
von: Restrepo, David, et al.
Veröffentlicht: (2026)
Anatomical Structure-Guided Medical Vision-Language Pre-training
von: Li, Qingqiu, et al.
Veröffentlicht: (2024)
von: Li, Qingqiu, et al.
Veröffentlicht: (2024)
CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values
von: Koleilat, Taha, et al.
Veröffentlicht: (2025)
von: Koleilat, Taha, et al.
Veröffentlicht: (2025)
Refining Skewed Perceptions in Vision-Language Contrastive Models through Visual Representations
von: Dai, Haocheng, et al.
Veröffentlicht: (2024)
von: Dai, Haocheng, et al.
Veröffentlicht: (2024)
Toward Robust Incomplete Multimodal Sentiment Analysis via Hierarchical Representation Learning
von: Li, Mingcheng, et al.
Veröffentlicht: (2024)
von: Li, Mingcheng, et al.
Veröffentlicht: (2024)
Enhancing Fine-Grained Image Classifications via Cascaded Vision Language Models
von: Wei, Canshi
Veröffentlicht: (2024)
von: Wei, Canshi
Veröffentlicht: (2024)
Few-Shot Segmentation with Global and Local Contrastive Learning
von: Liu, Weide, et al.
Veröffentlicht: (2021)
von: Liu, Weide, et al.
Veröffentlicht: (2021)
Benchmarking Direct Preference Optimization for Medical Large Vision-Language Models
von: Kim, Dain, et al.
Veröffentlicht: (2026)
von: Kim, Dain, et al.
Veröffentlicht: (2026)
Prompt-Induced Score Variance in Zero-Shot Binary Vision-Language Safety Classification
von: Weng, Charles, et al.
Veröffentlicht: (2026)
von: Weng, Charles, et al.
Veröffentlicht: (2026)
Mitigating Hallucinations in Large Vision-Language Models with Internal Fact-based Contrastive Decoding
von: Wang, Chao, et al.
Veröffentlicht: (2025)
von: Wang, Chao, et al.
Veröffentlicht: (2025)
SynthVLM: Towards High-Quality and Efficient Synthesis of Image-Caption Datasets for Vision-Language Models
von: Liu, Zheng, et al.
Veröffentlicht: (2024)
von: Liu, Zheng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Enhancing Vision-Language Few-Shot Adaptation with Negative Learning
von: Zhang, Ce, et al.
Veröffentlicht: (2024) -
HSCR: Hierarchical Self-Contrastive Rewarding for Aligning Medical Vision Language Models
von: Jiang, Songtao, et al.
Veröffentlicht: (2025) -
Mechanistic Finetuning of Vision-Language-Action Models via Few-Shot Demonstrations
von: Mitra, Chancharik, et al.
Veröffentlicht: (2025) -
Few-Shot Learning from Gigapixel Images via Hierarchical Vision-Language Alignment and Modeling
von: Wong, Bryan, et al.
Veröffentlicht: (2025) -
Few Shot Class Incremental Learning using Vision-Language models
von: Kumar, Anurag, et al.
Veröffentlicht: (2024)