SwinTF3D: A Lightweight Multimodal Fusion Approach for Text-Guided 3D Medical Image Segmentation
Fuente:
arXiv
Saved in:
| Main Authors: | Khan, Hasan Faraz, Fatima, Noor, Behzad, Muzammil |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Attack-Aware Deepfake Detection under Counter-Forensic Manipulations
by: Fatima, Noor, et al.
Published: (2025)
by: Fatima, Noor, et al.
Published: (2025)
Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition
by: Behzad, Muzammil
Published: (2025)
by: Behzad, Muzammil
Published: (2025)
XAI-CLIP: ROI-Guided Perturbation Framework for Explainable Medical Image Segmentation in Multimodal Vision-Language Models
by: Alzubaidi, Thuraya, et al.
Published: (2026)
by: Alzubaidi, Thuraya, et al.
Published: (2026)
Unsupervised Multiview Contrastive Language-Image Joint Learning with Pseudo-Labeled Prompts Via Vision-Language Model for 3D/4D Facial Expression Recognition
by: Behzad, Muzammil
Published: (2025)
by: Behzad, Muzammil
Published: (2025)
Spatio-Semantic Expert Routing Architecture with Mixture-of-Experts for Referring Image Segmentation
by: Dalaq, Alaa, et al.
Published: (2026)
by: Dalaq, Alaa, et al.
Published: (2026)
Self-Supervised Multi-View Representation Learning using Vision-Language Model for 3D/4D Facial Expression Recognition
by: Behzad, Muzammil
Published: (2025)
by: Behzad, Muzammil
Published: (2025)
Contrastive Language-Image Learning with Augmented Textual Prompts for 3D/4D FER Using Vision-Language Model
by: Behzad, Muzammil, et al.
Published: (2025)
by: Behzad, Muzammil, et al.
Published: (2025)
Prompt-Guided Patch UNet-VAE with Adversarial Supervision for Adrenal Gland Segmentation in Computed Tomography Medical Images
by: Ghouse, Hania, et al.
Published: (2025)
by: Ghouse, Hania, et al.
Published: (2025)
From Graphs to Gates: DNS-HyXNet, A Lightweight and Deployable Sequential Model for Real-Time DNS Tunnel Detection
by: Ali, Faraz, et al.
Published: (2025)
by: Ali, Faraz, et al.
Published: (2025)
MOSAIC: A Multi-View 2.5D Organ Slice Selector with Cross-Attentional Reasoning for Anatomically-Aware CT Localization in Medical Organ Segmentation
by: Ghouse, Hania, et al.
Published: (2025)
by: Ghouse, Hania, et al.
Published: (2025)
Beam-Guided Knowledge Replay for Knowledge-Rich Image Captioning using Vision-Language Model
by: AlJunaid, Reem, et al.
Published: (2025)
by: AlJunaid, Reem, et al.
Published: (2025)
Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model
by: Dalaq, Alaa, et al.
Published: (2025)
by: Dalaq, Alaa, et al.
Published: (2025)
Lightweight Method for Interactive 3D Medical Image Segmentation with Multi-Round Result Fusion
by: Shen, Bingzhi, et al.
Published: (2024)
by: Shen, Bingzhi, et al.
Published: (2024)
Underwater Diffusion Attention Network with Contrastive Language-Image Joint Learning for Underwater Image Enhancement
by: Shaahid, Afrah, et al.
Published: (2025)
by: Shaahid, Afrah, et al.
Published: (2025)
PULSE: A Unified Multi-Task Architecture for Cardiac Segmentation, Diagnosis, and Few-Shot Cross-Modality Clinical Adaptation
by: Ghouse, Hania, et al.
Published: (2025)
by: Ghouse, Hania, et al.
Published: (2025)
Swin SMT: Global Sequential Modeling in 3D Medical Image Segmentation
by: Płotka, Szymon, et al.
Published: (2024)
by: Płotka, Szymon, et al.
Published: (2024)
AquaDiff: Diffusion-Based Underwater Image Enhancement for Addressing Color Distortion
by: Shaahid, Afrah, et al.
Published: (2025)
by: Shaahid, Afrah, et al.
Published: (2025)
nnY-Net: Swin-NeXt with Cross-Attention for 3D Medical Images Segmentation
by: Liu, Haixu, et al.
Published: (2025)
by: Liu, Haixu, et al.
Published: (2025)
S-LAM3D: Segmentation-Guided Monocular 3D Object Detection via Feature Space Fusion
by: Sas, Diana-Alexandra, et al.
Published: (2025)
by: Sas, Diana-Alexandra, et al.
Published: (2025)
SwinTextUNet: Integrating CLIP-Based Text Guidance into Swin Transformer U-Nets for Medical Image Segmentation
by: Yeafi, Ashfak, et al.
Published: (2026)
by: Yeafi, Ashfak, et al.
Published: (2026)
Text Embedded Swin-UMamba for DeepLesion Segmentation
by: Cheng, Ruida, et al.
Published: (2025)
by: Cheng, Ruida, et al.
Published: (2025)
ESICA: A Scalable Framework for Text-Guided 3D Medical Image Segmentation
by: Xin, Yu, et al.
Published: (2026)
by: Xin, Yu, et al.
Published: (2026)
3D Nephrographic Image Synthesis in CT Urography with the Diffusion Model and Swin Transformer
by: Yu, Hongkun, et al.
Published: (2025)
by: Yu, Hongkun, et al.
Published: (2025)
Swin-TUNA : A Novel PEFT Approach for Accurate Food Image Segmentation
by: Chen, Haotian, et al.
Published: (2025)
by: Chen, Haotian, et al.
Published: (2025)
Translation Consistent Semi-supervised Segmentation for 3D Medical Images
by: Liu, Yuyuan, et al.
Published: (2022)
by: Liu, Yuyuan, et al.
Published: (2022)
Generative Adversarial Synthesis and Deep Feature Discrimination of Brain Tumor MRI Images
by: Ali, Md Sumon, et al.
Published: (2025)
by: Ali, Md Sumon, et al.
Published: (2025)
A Text-Image Fusion Method with Data Augmentation Capabilities for Referring Medical Image Segmentation
by: Chai, Shurong, et al.
Published: (2025)
by: Chai, Shurong, et al.
Published: (2025)
Focal Modulation and Bidirectional Feature Fusion Network for Medical Image Segmentation
by: Safdar, Moin, et al.
Published: (2025)
by: Safdar, Moin, et al.
Published: (2025)
WaveFormer: A 3D Transformer with Wavelet-Driven Feature Representation for Efficient Medical Image Segmentation
by: Hasan, Md Mahfuz Al, et al.
Published: (2025)
by: Hasan, Md Mahfuz Al, et al.
Published: (2025)
UNETR++: Delving into Efficient and Accurate 3D Medical Image Segmentation
by: Shaker, Abdelrahman, et al.
Published: (2022)
by: Shaker, Abdelrahman, et al.
Published: (2022)
DescriptorMedSAM: Language-Image Fusion with Multi-Aspect Text Guidance for Medical Image Segmentation
by: Zhang, Wenjie, et al.
Published: (2025)
by: Zhang, Wenjie, et al.
Published: (2025)
Efficient KernelSHAP Explanations for Patch-based 3D Medical Image Segmentation
by: Brioso, Ricardo Coimbra, et al.
Published: (2026)
by: Brioso, Ricardo Coimbra, et al.
Published: (2026)
Introducing 3D Representation for Medical Image Volume-to-Volume Translation via Score Fusion
by: Zhu, Xiyue, et al.
Published: (2025)
by: Zhu, Xiyue, et al.
Published: (2025)
ReplaceAnything3D:Text-Guided 3D Scene Editing with Compositional Neural Radiance Fields
by: Bartrum, Edward, et al.
Published: (2024)
by: Bartrum, Edward, et al.
Published: (2024)
Refining 3D Medical Segmentation with Verbal Instruction
by: Xie, Kangxian, et al.
Published: (2026)
by: Xie, Kangxian, et al.
Published: (2026)
Residual-SwinCA-Net: A Channel-Aware Integrated Residual CNN-Swin Transformer for Malignant Lesion Segmentation in BUSI
by: Naz, Saeeda, et al.
Published: (2025)
by: Naz, Saeeda, et al.
Published: (2025)
Less is More: AMBER-AFNO -- a New Benchmark for Lightweight 3D Medical Image Segmentation
by: Dosi, Andrea, et al.
Published: (2025)
by: Dosi, Andrea, et al.
Published: (2025)
MedLiteNet: Lightweight Hybrid Medical Image Segmentation Model
by: Yu, Pengyang, et al.
Published: (2025)
by: Yu, Pengyang, et al.
Published: (2025)
Feedforward 3D Editing via Text-Steerable Image-to-3D
by: Ma, Ziqi, et al.
Published: (2025)
by: Ma, Ziqi, et al.
Published: (2025)
Text-Guided Layer Fusion Mitigates Hallucination in Multimodal LLMs
by: Lin, Chenchen, et al.
Published: (2026)
by: Lin, Chenchen, et al.
Published: (2026)
Similar Items
-
Attack-Aware Deepfake Detection under Counter-Forensic Manipulations
by: Fatima, Noor, et al.
Published: (2025) -
Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition
by: Behzad, Muzammil
Published: (2025) -
XAI-CLIP: ROI-Guided Perturbation Framework for Explainable Medical Image Segmentation in Multimodal Vision-Language Models
by: Alzubaidi, Thuraya, et al.
Published: (2026) -
Unsupervised Multiview Contrastive Language-Image Joint Learning with Pseudo-Labeled Prompts Via Vision-Language Model for 3D/4D Facial Expression Recognition
by: Behzad, Muzammil
Published: (2025) -
Spatio-Semantic Expert Routing Architecture with Mixture-of-Experts for Referring Image Segmentation
by: Dalaq, Alaa, et al.
Published: (2026)