CDPDNet: Integrating Text Guidance with Hybrid Vision Encoders for Medical Image Segmentation
Fuente:
arXiv
Saved in:
| Main Authors: | Wu, Jiong, Xing, Yang, Yu, Boxiao, Shao, Wei, Gong, Kuang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SAM2-SGP: Enhancing SAM2 for Medical Image Segmentation via Support-Set Guided Prompting
by: Xing, Yang, et al.
Published: (2025)
by: Xing, Yang, et al.
Published: (2025)
Structure-Adaptive Sparse Diffusion in Voxel Space for 3D Medical Image Enhancement
by: Jiang, Hongxu, et al.
Published: (2026)
by: Jiang, Hongxu, et al.
Published: (2026)
Adaptive Whole-Body PET Image Denoising Using 3D Diffusion Models with ControlNet
by: Yu, Boxiao, et al.
Published: (2024)
by: Yu, Boxiao, et al.
Published: (2024)
General Vision Encoder Features as Guidance in Medical Image Registration
by: Kögl, Fryderyk, et al.
Published: (2024)
by: Kögl, Fryderyk, et al.
Published: (2024)
ESICA: A Scalable Framework for Text-Guided 3D Medical Image Segmentation
by: Xin, Yu, et al.
Published: (2026)
by: Xin, Yu, et al.
Published: (2026)
LDM-Morph: Latent diffusion model guided deformable image registration
by: Wu, Jiong, et al.
Published: (2024)
by: Wu, Jiong, et al.
Published: (2024)
Med3DVLM: An Efficient Vision-Language Model for 3D Medical Image Analysis
by: Xin, Yu, et al.
Published: (2025)
by: Xin, Yu, et al.
Published: (2025)
HybridMamba: A Dual-domain Mamba for 3D Medical Image Segmentation
by: Wu, Weitong, et al.
Published: (2025)
by: Wu, Weitong, et al.
Published: (2025)
SwinTextUNet: Integrating CLIP-Based Text Guidance into Swin Transformer U-Nets for Medical Image Segmentation
by: Yeafi, Ashfak, et al.
Published: (2026)
by: Yeafi, Ashfak, et al.
Published: (2026)
HybridMIM: A Hybrid Masked Image Modeling Framework for 3D Medical Image Segmentation
by: Xing, Zhaohu, et al.
Published: (2023)
by: Xing, Zhaohu, et al.
Published: (2023)
MedVL-SAM2: A unified 3D medical vision-language model for multimodal reasoning and prompt-driven segmentation
by: Xing, Yang, et al.
Published: (2026)
by: Xing, Yang, et al.
Published: (2026)
TAMISeg: Text-Aligned Multi-scale Medical Image Segmentation with Semantic Encoder Distillation
by: Gao, Qiang, et al.
Published: (2026)
by: Gao, Qiang, et al.
Published: (2026)
TauGenNet: Plasma-Driven Tau PET Image Synthesis via Text-Guided 3D Diffusion Models
by: Gong, Yuxin, et al.
Published: (2025)
by: Gong, Yuxin, et al.
Published: (2025)
Geodesic Diffusion Models for Efficient Medical Image Enhancement
by: Zhang, Teng, et al.
Published: (2025)
by: Zhang, Teng, et al.
Published: (2025)
DCFormer: Efficient 3D Vision-Language Modeling with Decomposed Convolutions
by: Ates, Gorkem Can, et al.
Published: (2025)
by: Ates, Gorkem Can, et al.
Published: (2025)
UNIT: Unifying Image and Text Recognition in One Vision Encoder
by: Zhu, Yi, et al.
Published: (2024)
by: Zhu, Yi, et al.
Published: (2024)
Language-Image Alignment with Fixed Text Encoders
by: Yang, Jingfeng, et al.
Published: (2025)
by: Yang, Jingfeng, et al.
Published: (2025)
Segmentation-Free Guidance for Text-to-Image Diffusion Models
by: Azarian, Kambiz, et al.
Published: (2024)
by: Azarian, Kambiz, et al.
Published: (2024)
SAM2-UNet: Segment Anything 2 Makes Strong Encoder for Natural and Medical Image Segmentation
by: Xiong, Xinyu, et al.
Published: (2024)
by: Xiong, Xinyu, et al.
Published: (2024)
Vivim: a Video Vision Mamba for Medical Video Segmentation
by: Yang, Yijun, et al.
Published: (2024)
by: Yang, Yijun, et al.
Published: (2024)
Text-driven Multiplanar Visual Interaction for Semi-supervised Medical Image Segmentation
by: Huang, Kaiwen, et al.
Published: (2025)
by: Huang, Kaiwen, et al.
Published: (2025)
ODES: Domain Adaptation with Expert Guidance for Online Medical Image Segmentation
by: Islam, Md Shazid, et al.
Published: (2023)
by: Islam, Md Shazid, et al.
Published: (2023)
DescriptorMedSAM: Language-Image Fusion with Multi-Aspect Text Guidance for Medical Image Segmentation
by: Zhang, Wenjie, et al.
Published: (2025)
by: Zhang, Wenjie, et al.
Published: (2025)
RAPHAEL: Text-to-Image Generation via Large Mixture of Diffusion Paths
by: Xue, Zeyue, et al.
Published: (2023)
by: Xue, Zeyue, et al.
Published: (2023)
Spatial-aware Symmetric Alignment for Text-guided Medical Image Segmentation
by: Liao, Linglin, et al.
Published: (2025)
by: Liao, Linglin, et al.
Published: (2025)
PMT: Plain Mask Transformer for Image and Video Segmentation with Frozen Vision Encoders
by: Cavagnero, Niccolò, et al.
Published: (2026)
by: Cavagnero, Niccolò, et al.
Published: (2026)
LEAF: Latent Diffusion with Efficient Encoder Distillation for Aligned Features in Medical Image Segmentation
by: Huang, Qilin, et al.
Published: (2025)
by: Huang, Qilin, et al.
Published: (2025)
Medical SAM Adapter: Adapting Segment Anything Model for Medical Image Segmentation
by: Wu, Junde, et al.
Published: (2023)
by: Wu, Junde, et al.
Published: (2023)
Enhancing Vision-Language Model with Unmasked Token Alignment
by: Liu, Jihao, et al.
Published: (2024)
by: Liu, Jihao, et al.
Published: (2024)
GuiDINO: Rethinking Vision Foundation Model in Medical Image Segmentation
by: Liang, Zhuonan, et al.
Published: (2026)
by: Liang, Zhuonan, et al.
Published: (2026)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
by: Shao, Hao, et al.
Published: (2025)
by: Shao, Hao, et al.
Published: (2025)
Guidance Matters: Rethinking the Evaluation Pitfall for Text-to-Image Generation
by: Xie, Dian, et al.
Published: (2026)
by: Xie, Dian, et al.
Published: (2026)
Text-Guided Semantic Image Encoder
by: Thirukovalluru, Raghuveer, et al.
Published: (2025)
by: Thirukovalluru, Raghuveer, et al.
Published: (2025)
H-vmunet: High-order Vision Mamba UNet for Medical Image Segmentation
by: Wu, Renkai, et al.
Published: (2024)
by: Wu, Renkai, et al.
Published: (2024)
MSVM-UNet: Multi-Scale Vision Mamba UNet for Medical Image Segmentation
by: Chen, Chaowei, et al.
Published: (2024)
by: Chen, Chaowei, et al.
Published: (2024)
Tuning-Free Image Customization with Image and Text Guidance
by: Li, Pengzhi, et al.
Published: (2024)
by: Li, Pengzhi, et al.
Published: (2024)
VQ-Seg: Vector-Quantized Token Perturbation for Semi-Supervised Medical Image Segmentation
by: Yang, Sicheng, et al.
Published: (2026)
by: Yang, Sicheng, et al.
Published: (2026)
Covariance Descriptors Meet General Vision Encoders: Riemannian Deep Learning for Medical Image Classification
by: Mayr, Josef, et al.
Published: (2025)
by: Mayr, Josef, et al.
Published: (2025)
Conditional Text-to-Image Generation with Reference Guidance
by: Kim, Taewook, et al.
Published: (2024)
by: Kim, Taewook, et al.
Published: (2024)
Annotation-Efficient Task Guidance for Medical Segment Anything
by: Ward, Tyler, et al.
Published: (2024)
by: Ward, Tyler, et al.
Published: (2024)
Similar Items
-
SAM2-SGP: Enhancing SAM2 for Medical Image Segmentation via Support-Set Guided Prompting
by: Xing, Yang, et al.
Published: (2025) -
Structure-Adaptive Sparse Diffusion in Voxel Space for 3D Medical Image Enhancement
by: Jiang, Hongxu, et al.
Published: (2026) -
Adaptive Whole-Body PET Image Denoising Using 3D Diffusion Models with ControlNet
by: Yu, Boxiao, et al.
Published: (2024) -
General Vision Encoder Features as Guidance in Medical Image Registration
by: Kögl, Fryderyk, et al.
Published: (2024) -
ESICA: A Scalable Framework for Text-Guided 3D Medical Image Segmentation
by: Xin, Yu, et al.
Published: (2026)