Exploring Transfer Learning in Medical Image Segmentation using Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Poudel, Kanchan, Dhakal, Manish, Bhandari, Prasiddha, Adhikari, Rabin, Thapaliya, Safal, Khanal, Bishesh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TuneVLSeg: Prompt Tuning Benchmark for Vision-Language Segmentation Models
di: Adhikari, Rabin, et al.
Pubblicazione: (2024)
di: Adhikari, Rabin, et al.
Pubblicazione: (2024)
VLSM-Adapter: Finetuning Vision-Language Segmentation Efficiently with Lightweight Blocks
di: Dhakal, Manish, et al.
Pubblicazione: (2024)
di: Dhakal, Manish, et al.
Pubblicazione: (2024)
Automated Quality Assessment of Blind Sweep Obstetric Ultrasound for Improved Diagnosis
di: Bhandari, Prasiddha, et al.
Pubblicazione: (2026)
di: Bhandari, Prasiddha, et al.
Pubblicazione: (2026)
Adversarial Robustness Analysis of Vision-Language Models in Medical Image Segmentation
di: Budathoki, Anjila, et al.
Pubblicazione: (2025)
di: Budathoki, Anjila, et al.
Pubblicazione: (2025)
AI-Assisted Cervical Cancer Screening
di: Poudel, Kanchan, et al.
Pubblicazione: (2024)
di: Poudel, Kanchan, et al.
Pubblicazione: (2024)
Deep-learning Assisted Detection and Quantification of (oo)cysts of Giardia and Cryptosporidium on Smartphone Microscopy Images
di: Nakarmi, Suprim, et al.
Pubblicazione: (2023)
di: Nakarmi, Suprim, et al.
Pubblicazione: (2023)
NLPineers@ NLU of Devanagari Script Languages 2025: Hate Speech Detection using Ensembling of BERT-based models
di: Guragain, Anmol, et al.
Pubblicazione: (2024)
di: Guragain, Anmol, et al.
Pubblicazione: (2024)
Investigating the Robustness of Vision Transformers against Label Noise in Medical Image Classification
di: Khanal, Bidur, et al.
Pubblicazione: (2024)
di: Khanal, Bidur, et al.
Pubblicazione: (2024)
MedCLIPSeg: Probabilistic Vision-Language Adaptation for Data-Efficient and Generalizable Medical Image Segmentation
di: Koleilat, Taha, et al.
Pubblicazione: (2026)
di: Koleilat, Taha, et al.
Pubblicazione: (2026)
Efficient Few-Shot Medical Image Analysis via Hierarchical Contrastive Vision-Language Learning
di: Fuller, Harrison, et al.
Pubblicazione: (2025)
di: Fuller, Harrison, et al.
Pubblicazione: (2025)
Parameter Efficient Fine-tuning for Domain-specific Gastrointestinal Disease Recognition
di: Poudel, Sanjaya, et al.
Pubblicazione: (2026)
di: Poudel, Sanjaya, et al.
Pubblicazione: (2026)
From Development to Deployment of AI-assisted Telehealth and Screening for Vision- and Hearing-threatening diseases in resource-constrained settings: Field Observations, Challenges and Way Forward
di: Shakya, Mahesh, et al.
Pubblicazione: (2025)
di: Shakya, Mahesh, et al.
Pubblicazione: (2025)
Evaluating Reasoning Faithfulness in Medical Vision-Language Models using Multimodal Perturbations
di: Moll, Johannes, et al.
Pubblicazione: (2025)
di: Moll, Johannes, et al.
Pubblicazione: (2025)
TemMed-Bench: Evaluating Temporal Medical Image Reasoning in Vision-Language Models
di: Zhang, Junyi, et al.
Pubblicazione: (2025)
di: Zhang, Junyi, et al.
Pubblicazione: (2025)
Parameter-efficient Fine-tuning for improved Convolutional Baseline for Brain Tumor Segmentation in Sub-Saharan Africa Adult Glioma Dataset
di: Adhikari, Bijay, et al.
Pubblicazione: (2024)
di: Adhikari, Bijay, et al.
Pubblicazione: (2024)
TaxaBind: A Unified Embedding Space for Ecological Applications
di: Sastry, Srikumar, et al.
Pubblicazione: (2024)
di: Sastry, Srikumar, et al.
Pubblicazione: (2024)
How does self-supervised pretraining improve robustness against noisy labels across various medical image classification datasets?
di: Khanal, Bidur, et al.
Pubblicazione: (2024)
di: Khanal, Bidur, et al.
Pubblicazione: (2024)
MedVisionLlama: Leveraging Pre-Trained Large Language Model Layers to Enhance Medical Image Segmentation
di: Kumar, Gurucharan Marthi Krishna, et al.
Pubblicazione: (2024)
di: Kumar, Gurucharan Marthi Krishna, et al.
Pubblicazione: (2024)
Pseudo-Prompt Generating in Pre-trained Vision-Language Models for Multi-Label Medical Image Classification
di: Ye, Yaoqin, et al.
Pubblicazione: (2024)
di: Ye, Yaoqin, et al.
Pubblicazione: (2024)
Medical Context Distorts Decisions in Clinical Vision Language Models
di: Restrepo, David, et al.
Pubblicazione: (2026)
di: Restrepo, David, et al.
Pubblicazione: (2026)
Anatomical Structure-Guided Medical Vision-Language Pre-training
di: Li, Qingqiu, et al.
Pubblicazione: (2024)
di: Li, Qingqiu, et al.
Pubblicazione: (2024)
GeoSynth: Contextually-Aware High-Resolution Satellite Image Synthesis
di: Sastry, Srikumar, et al.
Pubblicazione: (2024)
di: Sastry, Srikumar, et al.
Pubblicazione: (2024)
Benchmarking Direct Preference Optimization for Medical Large Vision-Language Models
di: Kim, Dain, et al.
Pubblicazione: (2026)
di: Kim, Dain, et al.
Pubblicazione: (2026)
MedCLIP-SAMv2: Towards Universal Text-Driven Medical Image Segmentation
di: Koleilat, Taha, et al.
Pubblicazione: (2024)
di: Koleilat, Taha, et al.
Pubblicazione: (2024)
Paddy Disease Detection and Classification Using Computer Vision Techniques: A Mobile Application to Detect Paddy Disease
di: Khanal, Bimarsha, et al.
Pubblicazione: (2024)
di: Khanal, Bimarsha, et al.
Pubblicazione: (2024)
HSCR: Hierarchical Self-Contrastive Rewarding for Aligning Medical Vision Language Models
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
Fusion of Domain-Adapted Vision and Language Models for Medical Visual Question Answering
di: Ha, Cuong Nhat, et al.
Pubblicazione: (2024)
di: Ha, Cuong Nhat, et al.
Pubblicazione: (2024)
PhenoLIP: Integrating Phenotype Ontology Knowledge into Medical Vision-Language Pretraining
di: Liang, Cheng, et al.
Pubblicazione: (2026)
di: Liang, Cheng, et al.
Pubblicazione: (2026)
SimLBR: Learning to Detect Fake Images by Learning to Detect Real Images
di: Dhakal, Aayush, et al.
Pubblicazione: (2026)
di: Dhakal, Aayush, et al.
Pubblicazione: (2026)
Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models
di: Zhu, Wenhui, et al.
Pubblicazione: (2025)
di: Zhu, Wenhui, et al.
Pubblicazione: (2025)
Med-MoE: Mixture of Domain-Specific Experts for Lightweight Medical Vision-Language Models
di: Jiang, Songtao, et al.
Pubblicazione: (2024)
di: Jiang, Songtao, et al.
Pubblicazione: (2024)
CBVLM: Training-free Explainable Concept-based Large Vision Language Models for Medical Image Classification
di: Patrício, Cristiano, et al.
Pubblicazione: (2025)
di: Patrício, Cristiano, et al.
Pubblicazione: (2025)
Understanding Museum Exhibits using Vision-Language Reasoning
di: Balauca, Ada-Astrid, et al.
Pubblicazione: (2024)
di: Balauca, Ada-Astrid, et al.
Pubblicazione: (2024)
NAVIG: Natural Language-guided Analysis with Vision Language Models for Image Geo-localization
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
Unifying Vision-Language Latents for Zero-label Image Caption Enhancement
di: Byun, Sanghyun, et al.
Pubblicazione: (2025)
di: Byun, Sanghyun, et al.
Pubblicazione: (2025)
Babel-ImageNet: Massively Multilingual Evaluation of Vision-and-Language Representations
di: Geigle, Gregor, et al.
Pubblicazione: (2023)
di: Geigle, Gregor, et al.
Pubblicazione: (2023)
Enhancing Large Vision Language Models with Self-Training on Image Comprehension
di: Deng, Yihe, et al.
Pubblicazione: (2024)
di: Deng, Yihe, et al.
Pubblicazione: (2024)
Visual In-Context Learning for Large Vision-Language Models
di: Zhou, Yucheng, et al.
Pubblicazione: (2024)
di: Zhou, Yucheng, et al.
Pubblicazione: (2024)
Guiding Medical Vision-Language Models with Explicit Visual Prompts: Framework Design and Comprehensive Exploration of Prompt Variations
di: Zhu, Kangyu, et al.
Pubblicazione: (2025)
di: Zhu, Kangyu, et al.
Pubblicazione: (2025)
GaussianVision: Vision-Language Alignment from Compressed Image Representations using 2D Gaussian Splatting
di: Omri, Yasmine, et al.
Pubblicazione: (2025)
di: Omri, Yasmine, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TuneVLSeg: Prompt Tuning Benchmark for Vision-Language Segmentation Models
di: Adhikari, Rabin, et al.
Pubblicazione: (2024) -
VLSM-Adapter: Finetuning Vision-Language Segmentation Efficiently with Lightweight Blocks
di: Dhakal, Manish, et al.
Pubblicazione: (2024) -
Automated Quality Assessment of Blind Sweep Obstetric Ultrasound for Improved Diagnosis
di: Bhandari, Prasiddha, et al.
Pubblicazione: (2026) -
Adversarial Robustness Analysis of Vision-Language Models in Medical Image Segmentation
di: Budathoki, Anjila, et al.
Pubblicazione: (2025) -
AI-Assisted Cervical Cancer Screening
di: Poudel, Kanchan, et al.
Pubblicazione: (2024)