XAI-CLIP: ROI-Guided Perturbation Framework for Explainable Medical Image Segmentation in Multimodal Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Alzubaidi, Thuraya, Ammar, Sana, Alsharqi, Maryam, Rekik, Islem, Behzad, Muzammil |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scaling Down to Scale Up: Towards Operationally-Efficient and Deployable Clinical Models via Cross-Modal Low-Rank Adaptation for Medical Vision-Language Models
di: Alzubaidi, Thuraya, et al.
Pubblicazione: (2025)
di: Alzubaidi, Thuraya, et al.
Pubblicazione: (2025)
PULSE: A Unified Multi-Task Architecture for Cardiac Segmentation, Diagnosis, and Few-Shot Cross-Modality Clinical Adaptation
di: Ghouse, Hania, et al.
Pubblicazione: (2025)
di: Ghouse, Hania, et al.
Pubblicazione: (2025)
NEURAL: Attention-Guided Pruning for Unified Multimodal Resource-Constrained Clinical Evaluation
di: Joshi, Devvrat, et al.
Pubblicazione: (2025)
di: Joshi, Devvrat, et al.
Pubblicazione: (2025)
Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition
di: Behzad, Muzammil
Pubblicazione: (2025)
di: Behzad, Muzammil
Pubblicazione: (2025)
Prompt-Guided Patch UNet-VAE with Adversarial Supervision for Adrenal Gland Segmentation in Computed Tomography Medical Images
di: Ghouse, Hania, et al.
Pubblicazione: (2025)
di: Ghouse, Hania, et al.
Pubblicazione: (2025)
Unsupervised Multiview Contrastive Language-Image Joint Learning with Pseudo-Labeled Prompts Via Vision-Language Model for 3D/4D Facial Expression Recognition
di: Behzad, Muzammil
Pubblicazione: (2025)
di: Behzad, Muzammil
Pubblicazione: (2025)
Beam-Guided Knowledge Replay for Knowledge-Rich Image Captioning using Vision-Language Model
di: AlJunaid, Reem, et al.
Pubblicazione: (2025)
di: AlJunaid, Reem, et al.
Pubblicazione: (2025)
Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model
di: Dalaq, Alaa, et al.
Pubblicazione: (2025)
di: Dalaq, Alaa, et al.
Pubblicazione: (2025)
SwinTF3D: A Lightweight Multimodal Fusion Approach for Text-Guided 3D Medical Image Segmentation
di: Khan, Hasan Faraz, et al.
Pubblicazione: (2025)
di: Khan, Hasan Faraz, et al.
Pubblicazione: (2025)
UniFed: A Universal Federation of a Mixture of Highly Heterogeneous Medical Image Classification Tasks
di: Hassani, Atefe, et al.
Pubblicazione: (2024)
di: Hassani, Atefe, et al.
Pubblicazione: (2024)
Multimodal Sheaf-based Network for Glioblastoma Molecular Subtype Prediction
di: Idrissova, Shekhnaz, et al.
Pubblicazione: (2025)
di: Idrissova, Shekhnaz, et al.
Pubblicazione: (2025)
FireGNN: Neuro-Symbolic Graph Neural Networks with Trainable Fuzzy Rules for Interpretable Medical Image Classification
di: Sengupta, Prajit, et al.
Pubblicazione: (2025)
di: Sengupta, Prajit, et al.
Pubblicazione: (2025)
Self-Supervised Multi-View Representation Learning using Vision-Language Model for 3D/4D Facial Expression Recognition
di: Behzad, Muzammil
Pubblicazione: (2025)
di: Behzad, Muzammil
Pubblicazione: (2025)
Contrastive Language-Image Learning with Augmented Textual Prompts for 3D/4D FER Using Vision-Language Model
di: Behzad, Muzammil, et al.
Pubblicazione: (2025)
di: Behzad, Muzammil, et al.
Pubblicazione: (2025)
Underwater Diffusion Attention Network with Contrastive Language-Image Joint Learning for Underwater Image Enhancement
di: Shaahid, Afrah, et al.
Pubblicazione: (2025)
di: Shaahid, Afrah, et al.
Pubblicazione: (2025)
Spatio-Semantic Expert Routing Architecture with Mixture-of-Experts for Referring Image Segmentation
di: Dalaq, Alaa, et al.
Pubblicazione: (2026)
di: Dalaq, Alaa, et al.
Pubblicazione: (2026)
MOSAIC: A Multi-View 2.5D Organ Slice Selector with Cross-Attentional Reasoning for Anatomically-Aware CT Localization in Medical Organ Segmentation
di: Ghouse, Hania, et al.
Pubblicazione: (2025)
di: Ghouse, Hania, et al.
Pubblicazione: (2025)
AquaDiff: Diffusion-Based Underwater Image Enhancement for Addressing Color Distortion
di: Shaahid, Afrah, et al.
Pubblicazione: (2025)
di: Shaahid, Afrah, et al.
Pubblicazione: (2025)
Metadata-Driven Federated Learning of Connectional Brain Templates in Non-IID Multi-Domain Scenarios
di: Chen, Geng, et al.
Pubblicazione: (2024)
di: Chen, Geng, et al.
Pubblicazione: (2024)
Generative Adversarial Synthesis and Deep Feature Discrimination of Brain Tumor MRI Images
di: Ali, Md Sumon, et al.
Pubblicazione: (2025)
di: Ali, Md Sumon, et al.
Pubblicazione: (2025)
Envisioning MedCLIP: A Deep Dive into Explainability for Medical Vision-Language Models
di: Hashmi, Anees Ur Rehman, et al.
Pubblicazione: (2024)
di: Hashmi, Anees Ur Rehman, et al.
Pubblicazione: (2024)
Robust and Explainable Framework to Address Data Scarcity in Diagnostic Imaging
di: Zhao, Zehui, et al.
Pubblicazione: (2024)
di: Zhao, Zehui, et al.
Pubblicazione: (2024)
XAI-MeD: Explainable Knowledge Guided Neuro-Symbolic Framework for Domain Generalization and Rare Class Detection in Medical Imaging
di: Urooj, Midhat, et al.
Pubblicazione: (2026)
di: Urooj, Midhat, et al.
Pubblicazione: (2026)
Explainable AI (XAI) in Image Segmentation in Medicine, Industry, and Beyond: A Survey
di: Gipiškis, Rokas, et al.
Pubblicazione: (2024)
di: Gipiškis, Rokas, et al.
Pubblicazione: (2024)
VLSM-Ensemble: Ensembling CLIP-based Vision-Language Models for Enhanced Medical Image Segmentation
di: Dietlmeier, Julia, et al.
Pubblicazione: (2025)
di: Dietlmeier, Julia, et al.
Pubblicazione: (2025)
BiCLIP: Bidirectional and Consistent Language-Image Processing for Robust Medical Image Segmentation
di: Talaei, Saivan, et al.
Pubblicazione: (2026)
di: Talaei, Saivan, et al.
Pubblicazione: (2026)
Reservoir-Based Graph Convolutional Networks
di: Soussia, Mayssa, et al.
Pubblicazione: (2026)
di: Soussia, Mayssa, et al.
Pubblicazione: (2026)
MorphXAI: An Explainable Framework for Morphological Analysis of Parasites in Blood Smear Images
di: Yousaf, Aqsa, et al.
Pubblicazione: (2026)
di: Yousaf, Aqsa, et al.
Pubblicazione: (2026)
Language Guided Domain Generalized Medical Image Segmentation
di: Kunhimon, Shahina, et al.
Pubblicazione: (2024)
di: Kunhimon, Shahina, et al.
Pubblicazione: (2024)
Evaluating the Explainability of Vision Transformers in Medical Imaging
di: Barekatain, Leili, et al.
Pubblicazione: (2025)
di: Barekatain, Leili, et al.
Pubblicazione: (2025)
Evaluating Reasoning Faithfulness in Medical Vision-Language Models using Multimodal Perturbations
di: Moll, Johannes, et al.
Pubblicazione: (2025)
di: Moll, Johannes, et al.
Pubblicazione: (2025)
From Graphs to Gates: DNS-HyXNet, A Lightweight and Deployable Sequential Model for Real-Time DNS Tunnel Detection
di: Ali, Faraz, et al.
Pubblicazione: (2025)
di: Ali, Faraz, et al.
Pubblicazione: (2025)
Segmentation and Smoothing Affect Explanation Quality More Than the Choice of Perturbation-based XAI Method for Image Explanations
di: Pihlgren, Gustav Grund, et al.
Pubblicazione: (2024)
di: Pihlgren, Gustav Grund, et al.
Pubblicazione: (2024)
Effective and Robust Multimodal Medical Image Analysis
di: Dhar, Joy, et al.
Pubblicazione: (2026)
di: Dhar, Joy, et al.
Pubblicazione: (2026)
Attack-Aware Deepfake Detection under Counter-Forensic Manipulations
di: Fatima, Noor, et al.
Pubblicazione: (2025)
di: Fatima, Noor, et al.
Pubblicazione: (2025)
MaskedCLIP: Bridging the Masked and CLIP Space for Semi-Supervised Medical Vision-Language Pre-training
di: Zhu, Lei, et al.
Pubblicazione: (2025)
di: Zhu, Lei, et al.
Pubblicazione: (2025)
XAI for Point Cloud Data using Perturbations based on Meaningful Segmentation
di: Mulawade, Raju Ningappa, et al.
Pubblicazione: (2025)
di: Mulawade, Raju Ningappa, et al.
Pubblicazione: (2025)
Predicting Infant Brain Connectivity with Federated Multi-Trajectory GNNs using Scarce Data
di: Pistos, Michalis, et al.
Pubblicazione: (2024)
di: Pistos, Michalis, et al.
Pubblicazione: (2024)
Uncertainty-Aware Vision-Language Segmentation for Medical Imaging
di: Das, Aryan, et al.
Pubblicazione: (2026)
di: Das, Aryan, et al.
Pubblicazione: (2026)
MTA-CLIP: Language-Guided Semantic Segmentation with Mask-Text Alignment
di: Das, Anurag, et al.
Pubblicazione: (2024)
di: Das, Anurag, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Scaling Down to Scale Up: Towards Operationally-Efficient and Deployable Clinical Models via Cross-Modal Low-Rank Adaptation for Medical Vision-Language Models
di: Alzubaidi, Thuraya, et al.
Pubblicazione: (2025) -
PULSE: A Unified Multi-Task Architecture for Cardiac Segmentation, Diagnosis, and Few-Shot Cross-Modality Clinical Adaptation
di: Ghouse, Hania, et al.
Pubblicazione: (2025) -
NEURAL: Attention-Guided Pruning for Unified Multimodal Resource-Constrained Clinical Evaluation
di: Joshi, Devvrat, et al.
Pubblicazione: (2025) -
Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition
di: Behzad, Muzammil
Pubblicazione: (2025) -
Prompt-Guided Patch UNet-VAE with Adversarial Supervision for Adrenal Gland Segmentation in Computed Tomography Medical Images
di: Ghouse, Hania, et al.
Pubblicazione: (2025)