Deep Generative Models Unveil Patterns in Medical Images Through Vision-Language Conditioning
Fuente:
arXiv
Saved in:
| Main Authors: | Xing, Xiaodan, Ning, Junzhi, Nan, Yang, Yang, Guang |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Anatomy-Guided Radiology Report Generation with Pathology-Aware Regional Prompts
by: Gao, Yijian, et al.
Published: (2024)
by: Gao, Yijian, et al.
Published: (2024)
Assessing the Efficacy of Invisible Watermarks in AI-Generated Medical Images
by: Xing, Xiaodan, et al.
Published: (2024)
by: Xing, Xiaodan, et al.
Published: (2024)
Unpaired Translation of Chest X-ray Images for Lung Opacity Diagnosis via Adaptive Activation Masks and Cross-Domain Alignment
by: Ning, Junzhi, et al.
Published: (2025)
by: Ning, Junzhi, et al.
Published: (2025)
MedQ-UNI: Toward Unified Medical Image Quality Assessment and Restoration via Vision-Language Modeling
by: Liu, Jiyao, et al.
Published: (2026)
by: Liu, Jiyao, et al.
Published: (2026)
Revisiting Medical Image Retrieval via Knowledge Consolidation
by: Nan, Yang, et al.
Published: (2025)
by: Nan, Yang, et al.
Published: (2025)
Beyond the Hype: A dispassionate look at vision-language models in medical scenario
by: Nan, Yang, et al.
Published: (2024)
by: Nan, Yang, et al.
Published: (2024)
Deep asymmetric mixture model for unsupervised cell segmentation
by: Nan, Yang, et al.
Published: (2024)
by: Nan, Yang, et al.
Published: (2024)
Enhancing Image Aesthetics with Dual-Conditioned Diffusion Models Guided by Multimodal Perception
by: Nan, Xinyu, et al.
Published: (2026)
by: Nan, Xinyu, et al.
Published: (2026)
Adapting Vision-Language Foundation Model for Next Generation Medical Ultrasound Image Analysis
by: Qu, Jingguo, et al.
Published: (2025)
by: Qu, Jingguo, et al.
Published: (2025)
Coupling AI and Citizen Science in Creation of Enhanced Training Dataset for Medical Image Segmentation
by: Syahmi, Amir, et al.
Published: (2024)
by: Syahmi, Amir, et al.
Published: (2024)
Cyclic Vision-Language Manipulator: Towards Reliable and Fine-Grained Image Interpretation for Automated Report Generation
by: Fang, Yingying, et al.
Published: (2024)
by: Fang, Yingying, et al.
Published: (2024)
MMRareBench: A Rare-Disease Multimodal and Multi-Image Medical Benchmark
by: Ning, Junzhi, et al.
Published: (2026)
by: Ning, Junzhi, et al.
Published: (2026)
SegMamba: Long-range Sequential Modeling Mamba For 3D Medical Image Segmentation
by: Xing, Zhaohu, et al.
Published: (2024)
by: Xing, Zhaohu, et al.
Published: (2024)
MONICA: Benchmarking on Long-tailed Medical Image Classification
by: Ju, Lie, et al.
Published: (2024)
by: Ju, Lie, et al.
Published: (2024)
Conditional Diffusion Model for Longitudinal Medical Image Generation
by: Dao, Duy-Phuong, et al.
Published: (2024)
by: Dao, Duy-Phuong, et al.
Published: (2024)
Generate to Ground: Multimodal Text Conditioning Boosts Phrase Grounding in Medical Vision-Language Models
by: Nützel, Felix, et al.
Published: (2025)
by: Nützel, Felix, et al.
Published: (2025)
CDPDNet: Integrating Text Guidance with Hybrid Vision Encoders for Medical Image Segmentation
by: Wu, Jiong, et al.
Published: (2025)
by: Wu, Jiong, et al.
Published: (2025)
Generative Drifting for Conditional Medical Image Generation
by: Li, Zirong, et al.
Published: (2026)
by: Li, Zirong, et al.
Published: (2026)
Decoding Decision Reasoning: A Counterfactual-Powered Model for Knowledge Discovery
by: Fang, Yingying, et al.
Published: (2024)
by: Fang, Yingying, et al.
Published: (2024)
MedQ-Engine: A Closed-Loop Data Engine for Evolving MLLMs in Medical Image Quality Assessment
by: Liu, Jiyao, et al.
Published: (2026)
by: Liu, Jiyao, et al.
Published: (2026)
Mirage: Unveiling Hidden Artifacts in Synthetic Images with Large Vision-Language Models
by: Sharma, Pranav, et al.
Published: (2025)
by: Sharma, Pranav, et al.
Published: (2025)
Prompting Medical Vision-Language Models to Mitigate Diagnosis Bias by Generating Realistic Dermoscopic Images
by: Munia, Nusrat, et al.
Published: (2025)
by: Munia, Nusrat, et al.
Published: (2025)
Enhancing Remote Sensing Vision-Language Models Through MLLM and LLM-Based High-Quality Image-Text Dataset Generation
by: He, Yiguo, et al.
Published: (2025)
by: He, Yiguo, et al.
Published: (2025)
Vision-Language Model Guided Image Restoration
by: Yang, Cuixin, et al.
Published: (2025)
by: Yang, Cuixin, et al.
Published: (2025)
DiffExplainer: Unveiling Black Box Models Via Counterfactual Generation
by: Fang, Yingying, et al.
Published: (2024)
by: Fang, Yingying, et al.
Published: (2024)
Preserving Cardiac Integrity: A Topology-Infused Approach to Whole Heart Segmentation
by: Zhang, Chenyu, et al.
Published: (2024)
by: Zhang, Chenyu, et al.
Published: (2024)
Medical Large Vision Language Models with Multi-Image Visual Ability
by: Yang, Xikai, et al.
Published: (2025)
by: Yang, Xikai, et al.
Published: (2025)
Fuzzy Attention-based Border Rendering Network for Lung Organ Segmentation
by: Zhang, Sheng, et al.
Published: (2024)
by: Zhang, Sheng, et al.
Published: (2024)
Self-Rewarding Large Vision-Language Models for Optimizing Prompts in Text-to-Image Generation
by: Yang, Hongji, et al.
Published: (2025)
by: Yang, Hongji, et al.
Published: (2025)
Adversarial Robustness Analysis of Vision-Language Models in Medical Image Segmentation
by: Budathoki, Anjila, et al.
Published: (2025)
by: Budathoki, Anjila, et al.
Published: (2025)
UMIT: Unifying Medical Imaging Tasks via Vision-Language Models
by: Yu, Haiyang, et al.
Published: (2025)
by: Yu, Haiyang, et al.
Published: (2025)
Unveiling Typographic Deceptions: Insights of the Typographic Vulnerability in Large Vision-Language Model
by: Cheng, Hao, et al.
Published: (2024)
by: Cheng, Hao, et al.
Published: (2024)
Better Tokens for Better 3D: Advancing Vision-Language Modeling in 3D Medical Imaging
by: Hamamci, Ibrahim Ethem, et al.
Published: (2025)
by: Hamamci, Ibrahim Ethem, et al.
Published: (2025)
RoiMAM: Region-of-Interest Medical Attention Model for Efficient Vision-Language Understanding
by: Yang, Jiayan, et al.
Published: (2026)
by: Yang, Jiayan, et al.
Published: (2026)
Covariance Descriptors Meet General Vision Encoders: Riemannian Deep Learning for Medical Image Classification
by: Mayr, Josef, et al.
Published: (2025)
by: Mayr, Josef, et al.
Published: (2025)
Detecting and Evaluating Medical Hallucinations in Large Vision Language Models
by: Chen, Jiawei, et al.
Published: (2024)
by: Chen, Jiawei, et al.
Published: (2024)
Unveiling the Tapestry of Consistency in Large Vision-Language Models
by: Zhang, Yuan, et al.
Published: (2024)
by: Zhang, Yuan, et al.
Published: (2024)
Histopathology Image Report Generation by Vision Language Model with Multimodal In-Context Learning
by: Liu, Shih-Wen, et al.
Published: (2025)
by: Liu, Shih-Wen, et al.
Published: (2025)
Vision-Language Models for Automated 3D PET/CT Report Generation
by: Jiao, Wenpei, et al.
Published: (2025)
by: Jiao, Wenpei, et al.
Published: (2025)
Language-Guided Visual Perception Disentanglement for Image Quality Assessment and Conditional Image Generation
by: Yang, Zhichao, et al.
Published: (2025)
by: Yang, Zhichao, et al.
Published: (2025)
Similar Items
-
Anatomy-Guided Radiology Report Generation with Pathology-Aware Regional Prompts
by: Gao, Yijian, et al.
Published: (2024) -
Assessing the Efficacy of Invisible Watermarks in AI-Generated Medical Images
by: Xing, Xiaodan, et al.
Published: (2024) -
Unpaired Translation of Chest X-ray Images for Lung Opacity Diagnosis via Adaptive Activation Masks and Cross-Domain Alignment
by: Ning, Junzhi, et al.
Published: (2025) -
MedQ-UNI: Toward Unified Medical Image Quality Assessment and Restoration via Vision-Language Modeling
by: Liu, Jiyao, et al.
Published: (2026) -
Revisiting Medical Image Retrieval via Knowledge Consolidation
by: Nan, Yang, et al.
Published: (2025)