Aligning Medical Images with General Knowledge from Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Fang, Xiao, Lin, Yi, Zhang, Dong, Cheng, Kwang-Ting, Chen, Hao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Boosting Convolution with Efficient MLP-Permutation for Volumetric Medical Image Segmentation
por: Lin, Yi, et al.
Publicado: (2023)
por: Lin, Yi, et al.
Publicado: (2023)
Generalized Task-Driven Medical Image Quality Enhancement with Gradient Promotion
por: Zhang, Dong, et al.
Publicado: (2025)
por: Zhang, Dong, et al.
Publicado: (2025)
Rethinking Boundary Detection in Deep Learning-Based Medical Image Segmentation
por: Lin, Yi, et al.
Publicado: (2025)
por: Lin, Yi, et al.
Publicado: (2025)
Revisiting Deep Ensemble Uncertainty for Enhanced Medical Anomaly Detection
por: Gu, Yi, et al.
Publicado: (2024)
por: Gu, Yi, et al.
Publicado: (2024)
Iterative Online Image Synthesis via Diffusion Model for Imbalanced Classification
por: Li, Shuhan, et al.
Publicado: (2024)
por: Li, Shuhan, et al.
Publicado: (2024)
Prompt-Guided Adaptive Model Transformation for Whole Slide Image Classification
por: Lin, Yi, et al.
Publicado: (2024)
por: Lin, Yi, et al.
Publicado: (2024)
BoNuS: Boundary Mining for Nuclei Segmentation with Partial Point Labels
por: Lin, Yi, et al.
Publicado: (2024)
por: Lin, Yi, et al.
Publicado: (2024)
Towards Customized Knowledge Distillation for Chip-Level Dense Image Predictions
por: Zhang, Dong, et al.
Publicado: (2024)
por: Zhang, Dong, et al.
Publicado: (2024)
Rethinking Autoencoders for Medical Anomaly Detection from A Theoretical Perspective
por: Cai, Yu, et al.
Publicado: (2024)
por: Cai, Yu, et al.
Publicado: (2024)
Labeled-to-Unlabeled Distribution Alignment for Partially-Supervised Multi-Organ Medical Image Segmentation
por: Jiang, Xixi, et al.
Publicado: (2024)
por: Jiang, Xixi, et al.
Publicado: (2024)
Pixal3D: Pixel-Aligned 3D Generation from Images
por: Li, Dong-Yang, et al.
Publicado: (2026)
por: Li, Dong-Yang, et al.
Publicado: (2026)
MicarVLMoE: A Modern Gated Cross-Aligned Vision-Language Mixture of Experts Model for Medical Image Captioning and Report Generation
por: Izhar, Amaan, et al.
Publicado: (2025)
por: Izhar, Amaan, et al.
Publicado: (2025)
MedIAnomaly: A comparative study of anomaly detection in medical images
por: Cai, Yu, et al.
Publicado: (2024)
por: Cai, Yu, et al.
Publicado: (2024)
Memory Efficient Transformer Adapter for Dense Predictions
por: Zhang, Dong, et al.
Publicado: (2025)
por: Zhang, Dong, et al.
Publicado: (2025)
A Medical Multimodal Large Language Model for Pediatric Pneumonia
por: Tian, Weiwei, et al.
Publicado: (2024)
por: Tian, Weiwei, et al.
Publicado: (2024)
A Chain-of-Thought Subspace Meta-Learning for Few-shot Image Captioning with Large Vision and Language Models
por: Huang, Hao, et al.
Publicado: (2025)
por: Huang, Hao, et al.
Publicado: (2025)
HealthGPT: A Medical Large Vision-Language Model for Unifying Comprehension and Generation via Heterogeneous Knowledge Adaptation
por: Lin, Tianwei, et al.
Publicado: (2025)
por: Lin, Tianwei, et al.
Publicado: (2025)
SynerMedGen: Synergizing Medical Multimodal Understanding with Generation via Task Alignment
por: Zhao, Weiren, et al.
Publicado: (2026)
por: Zhao, Weiren, et al.
Publicado: (2026)
Asynchronous Denoising Diffusion Models for Aligning Text-to-Image Generation
por: Hu, Zijing, et al.
Publicado: (2025)
por: Hu, Zijing, et al.
Publicado: (2025)
Learnable Prompting SAM-induced Knowledge Distillation for Semi-supervised Medical Image Segmentation
por: Huang, Kaiwen, et al.
Publicado: (2024)
por: Huang, Kaiwen, et al.
Publicado: (2024)
ThinkFake: Reasoning in Multimodal Large Language Models for AI-Generated Image Detection
por: Huang, Tai-Ming, et al.
Publicado: (2025)
por: Huang, Tai-Ming, et al.
Publicado: (2025)
TAMISeg: Text-Aligned Multi-scale Medical Image Segmentation with Semantic Encoder Distillation
por: Gao, Qiang, et al.
Publicado: (2026)
por: Gao, Qiang, et al.
Publicado: (2026)
AlignMMBench: Evaluating Chinese Multimodal Alignment in Large Vision-Language Models
por: Wu, Yuhang, et al.
Publicado: (2024)
por: Wu, Yuhang, et al.
Publicado: (2024)
Enhancing 3D Medical Image Understanding with Pretraining Aided by 2D Multimodal Large Language Models
por: Chen, Qiuhui, et al.
Publicado: (2025)
por: Chen, Qiuhui, et al.
Publicado: (2025)
An Empirical Study and Analysis of Text-to-Image Generation Using Large Language Model-Powered Textual Representation
por: Tan, Zhiyu, et al.
Publicado: (2024)
por: Tan, Zhiyu, et al.
Publicado: (2024)
Filter & Align: Leveraging Human Knowledge to Curate Image-Text Data
por: Zhang, Lei, et al.
Publicado: (2023)
por: Zhang, Lei, et al.
Publicado: (2023)
LEAF: Latent Diffusion with Efficient Encoder Distillation for Aligned Features in Medical Image Segmentation
por: Huang, Qilin, et al.
Publicado: (2025)
por: Huang, Qilin, et al.
Publicado: (2025)
Align Beyond Prompts: Evaluating World Knowledge Alignment in Text-to-Image Generation
por: Zhang, Wenchao, et al.
Publicado: (2025)
por: Zhang, Wenchao, et al.
Publicado: (2025)
Med3DInsight: Enhancing 3D Medical Image Understanding with 2D Multi-Modal Large Language Models
por: Chen, Qiuhui, et al.
Publicado: (2024)
por: Chen, Qiuhui, et al.
Publicado: (2024)
Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation
por: Wu, Xun, et al.
Publicado: (2024)
por: Wu, Xun, et al.
Publicado: (2024)
When Preference Labels Fall Short: Aligning Diffusion Models from Real Data
por: Chen, Weiyan, et al.
Publicado: (2026)
por: Chen, Weiyan, et al.
Publicado: (2026)
Token Merging via Spatiotemporal Information Mining for Surgical Video Understanding
por: Jiang, Xixi, et al.
Publicado: (2025)
por: Jiang, Xixi, et al.
Publicado: (2025)
FedIA: Federated Medical Image Segmentation with Heterogeneous Annotation Completeness
por: Xiang, Yangyang, et al.
Publicado: (2024)
por: Xiang, Yangyang, et al.
Publicado: (2024)
AlignedGen: Aligning Style Across Generated Images
por: Zhang, Jiexuan, et al.
Publicado: (2025)
por: Zhang, Jiexuan, et al.
Publicado: (2025)
Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models
por: Meng, Chutian, et al.
Publicado: (2024)
por: Meng, Chutian, et al.
Publicado: (2024)
Fair Text to Medical Image Diffusion Model with Subgroup Distribution Aligned Tuning
por: Han, Xu, et al.
Publicado: (2024)
por: Han, Xu, et al.
Publicado: (2024)
Detecting and Evaluating Medical Hallucinations in Large Vision Language Models
por: Chen, Jiawei, et al.
Publicado: (2024)
por: Chen, Jiawei, et al.
Publicado: (2024)
AlignGen: Boosting Personalized Image Generation with Cross-Modality Prior Alignment
por: Lin, Yiheng, et al.
Publicado: (2025)
por: Lin, Yiheng, et al.
Publicado: (2025)
Label-Efficient Deep Learning in Medical Image Analysis: Challenges and Future Directions
por: Jin, Cheng, et al.
Publicado: (2023)
por: Jin, Cheng, et al.
Publicado: (2023)
On Large Visual Language Models for Medical Imaging Analysis: An Empirical Study
por: Van, Minh-Hao, et al.
Publicado: (2024)
por: Van, Minh-Hao, et al.
Publicado: (2024)
Ejemplares similares
-
Boosting Convolution with Efficient MLP-Permutation for Volumetric Medical Image Segmentation
por: Lin, Yi, et al.
Publicado: (2023) -
Generalized Task-Driven Medical Image Quality Enhancement with Gradient Promotion
por: Zhang, Dong, et al.
Publicado: (2025) -
Rethinking Boundary Detection in Deep Learning-Based Medical Image Segmentation
por: Lin, Yi, et al.
Publicado: (2025) -
Revisiting Deep Ensemble Uncertainty for Enhanced Medical Anomaly Detection
por: Gu, Yi, et al.
Publicado: (2024) -
Iterative Online Image Synthesis via Diffusion Model for Imbalanced Classification
por: Li, Shuhan, et al.
Publicado: (2024)