Potential of Multimodal Large Language Models for Data Mining of Medical Images and Free-text Reports
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Yutong, Pan, Yi, Zhong, Tianyang, Dong, Peixin, Xie, Kangni, Liu, Yuxiao, Jiang, Hanqi, Liu, Zhengliang, Zhao, Shijie, Zhang, Tuo, Jiang, Xi, Shen, Dinggang, Liu, Tianming, Zhang, Xin |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
EG-SpikeFormer: Eye-Gaze Guided Transformer on Spiking Neural Networks for Medical Image Analysis
by: Pan, Yi, et al.
Published: (2024)
by: Pan, Yi, et al.
Published: (2024)
MediViSTA: Medical Video Segmentation via Temporal Fusion SAM Adaptation for Echocardiography
by: Kim, Sekeun, et al.
Published: (2023)
by: Kim, Sekeun, et al.
Published: (2023)
End-to-end Triple-domain PET Enhancement: A Hybrid Denoising-and-reconstruction Framework for Reconstructing Standard-dose PET Images from Low-dose PET Sinograms
by: Jiang, Caiwen, et al.
Published: (2024)
by: Jiang, Caiwen, et al.
Published: (2024)
A Comprehensive Review of Multimodal Large Language Models: Performance and Challenges Across Different Tasks
by: Wang, Jiaqi, et al.
Published: (2024)
by: Wang, Jiaqi, et al.
Published: (2024)
Structure Unbiased Adversarial Model for Medical Image Segmentation
by: Zhang, Tianyang, et al.
Published: (2022)
by: Zhang, Tianyang, et al.
Published: (2022)
Eye-gaze Guided Multi-modal Alignment for Medical Representation Learning
by: Ma, Chong, et al.
Published: (2024)
by: Ma, Chong, et al.
Published: (2024)
Residual Connection Networks in Medical Image Processing: Exploration of ResUnet++ Model Driven by Human Computer Interaction
by: Dai, Peixin, et al.
Published: (2024)
by: Dai, Peixin, et al.
Published: (2024)
3D MedDiffusion: A 3D Medical Latent Diffusion Model for Controllable and High-quality Medical Image Generation
by: Wang, Haoshen, et al.
Published: (2024)
by: Wang, Haoshen, et al.
Published: (2024)
Multimodal Medical Image Binding via Shared Text Embeddings
by: Liu, Yunhao, et al.
Published: (2025)
by: Liu, Yunhao, et al.
Published: (2025)
Shape-Preserving Generation of Food Images for Automatic Dietary Assessment
by: Chen, Guangzong, et al.
Published: (2024)
by: Chen, Guangzong, et al.
Published: (2024)
M$^4$oE: A Foundation Model for Medical Multimodal Image Segmentation with Mixture of Experts
by: Jiang, Yufeng, et al.
Published: (2024)
by: Jiang, Yufeng, et al.
Published: (2024)
ECHOPulse: ECG controlled echocardio-grams video generation
by: Li, Yiwei, et al.
Published: (2024)
by: Li, Yiwei, et al.
Published: (2024)
A dual-task mutual learning framework for predicting post-thrombectomy cerebral hemorrhage
by: Jiang, Caiwen, et al.
Published: (2024)
by: Jiang, Caiwen, et al.
Published: (2024)
SAR-GTR: Attributed Scattering Information Guided SAR Graph Transformer Recognition Algorithm
by: Xiong, Xuying, et al.
Published: (2025)
by: Xiong, Xuying, et al.
Published: (2025)
LDSF: Lightweight Dual-Stream Framework for SAR Target Recognition by Coupling Local Electromagnetic Scattering Features and Global Visual Features
by: Xiong, Xuying, et al.
Published: (2024)
by: Xiong, Xuying, et al.
Published: (2024)
RadIR: A Scalable Framework for Multi-Grained Medical Image Retrieval via Radiology Report Mining
by: Zhang, Tengfei, et al.
Published: (2025)
by: Zhang, Tengfei, et al.
Published: (2025)
Mechanisms of Generative Image-to-Image Translation Networks
by: Chen, Guangzong, et al.
Published: (2024)
by: Chen, Guangzong, et al.
Published: (2024)
ReXGradient-160K: A Large-Scale Publicly Available Dataset of Chest Radiographs with Free-text Reports
by: Zhang, Xiaoman, et al.
Published: (2025)
by: Zhang, Xiaoman, et al.
Published: (2025)
Control Copy-Paste: Controllable Diffusion-Based Augmentation Method for Remote Sensing Few-Shot Object Detection
by: Liu, Yanxing, et al.
Published: (2025)
by: Liu, Yanxing, et al.
Published: (2025)
Towards General Text-guided Image Synthesis for Customized Multimodal Brain MRI Generation
by: Wang, Yulin, et al.
Published: (2024)
by: Wang, Yulin, et al.
Published: (2024)
Provably Convergent Plug-and-play Proximal Block Coordinate Descent Method for Hyperspectral Anomaly Detection
by: Liu, Xiaoxia, et al.
Published: (2024)
by: Liu, Xiaoxia, et al.
Published: (2024)
RWKV-UNet: Improving UNet with Long-Range Cooperation for Effective Medical Image Segmentation
by: Jiang, Juntao, et al.
Published: (2025)
by: Jiang, Juntao, et al.
Published: (2025)
CIResDiff: A Clinically-Informed Residual Diffusion Model for Predicting Idiopathic Pulmonary Fibrosis Progression
by: Jiang, Caiwen, et al.
Published: (2024)
by: Jiang, Caiwen, et al.
Published: (2024)
Towards Collective Intelligence: Uncertainty-aware SAM Adaptation for Ambiguous Medical Image Segmentation
by: Jiang, Mingzhou, et al.
Published: (2024)
by: Jiang, Mingzhou, et al.
Published: (2024)
Human Gaze-based Dual Teacher Guidance Learning for Semi-Supervised Medical Image Segmentation
by: Ge, Rongjun, et al.
Published: (2026)
by: Ge, Rongjun, et al.
Published: (2026)
EndoGen: Conditional Autoregressive Endoscopic Video Generation
by: Liu, Xinyu, et al.
Published: (2025)
by: Liu, Xinyu, et al.
Published: (2025)
M$^3$HL: Mutual Mask Mix with High-Low Level Feature Consistency for Semi-Supervised Medical Image Segmentation
by: Liu, Yajun, et al.
Published: (2025)
by: Liu, Yajun, et al.
Published: (2025)
CI-ICM: Channel Importance-driven Learned Image Coding for Machines
by: Zhang, Yun, et al.
Published: (2026)
by: Zhang, Yun, et al.
Published: (2026)
Brain-Adapter: Enhancing Neurological Disorder Analysis with Adapter-Tuning Multimodal Large Language Models
by: Zhang, Jing, et al.
Published: (2025)
by: Zhang, Jing, et al.
Published: (2025)
Foundation Models for Low-Resource Language Education (Vision Paper)
by: Ding, Zhaojun, et al.
Published: (2024)
by: Ding, Zhaojun, et al.
Published: (2024)
Geometry-Aware Attenuation Learning for Sparse-View CBCT Reconstruction
by: Liu, Zhentao, et al.
Published: (2023)
by: Liu, Zhentao, et al.
Published: (2023)
Task-based Regularization in Penalized Least-Squares for Binary Signal Detection Tasks in Medical Image Denoising
by: Chen, Wentao, et al.
Published: (2025)
by: Chen, Wentao, et al.
Published: (2025)
Geodesic Diffusion Models for Efficient Medical Image Enhancement
by: Zhang, Teng, et al.
Published: (2025)
by: Zhang, Teng, et al.
Published: (2025)
M3CoTBench: Benchmark Chain-of-Thought of MLLMs in Medical Image Understanding
by: Jiang, Juntao, et al.
Published: (2026)
by: Jiang, Juntao, et al.
Published: (2026)
Towards Next-Generation Medical Agent: How o1 is Reshaping Decision-Making in Medical Scenarios
by: Xu, Shaochen, et al.
Published: (2024)
by: Xu, Shaochen, et al.
Published: (2024)
Skill-Evolving Grounded Reasoning for Free-Text Promptable 3D Medical Image Segmentation
by: Zhang, Tongrui, et al.
Published: (2026)
by: Zhang, Tongrui, et al.
Published: (2026)
MARformer: An Efficient Metal Artifact Reduction Transformer for Dental CBCT Images
by: Shi, Yuxuan, et al.
Published: (2023)
by: Shi, Yuxuan, et al.
Published: (2023)
Generative Flow Networks for Personalized Multimedia Systems: A Case Study on Short Video Feeds
by: Jin, Yili, et al.
Published: (2025)
by: Jin, Yili, et al.
Published: (2025)
CAMixerSR: Only Details Need More "Attention"
by: Wang, Yan, et al.
Published: (2024)
by: Wang, Yan, et al.
Published: (2024)
Enhancing Weakly Supervised 3D Medical Image Segmentation through Probabilistic-aware Learning
by: Jiang, Runmin, et al.
Published: (2024)
by: Jiang, Runmin, et al.
Published: (2024)
Similar Items
-
EG-SpikeFormer: Eye-Gaze Guided Transformer on Spiking Neural Networks for Medical Image Analysis
by: Pan, Yi, et al.
Published: (2024) -
MediViSTA: Medical Video Segmentation via Temporal Fusion SAM Adaptation for Echocardiography
by: Kim, Sekeun, et al.
Published: (2023) -
End-to-end Triple-domain PET Enhancement: A Hybrid Denoising-and-reconstruction Framework for Reconstructing Standard-dose PET Images from Low-dose PET Sinograms
by: Jiang, Caiwen, et al.
Published: (2024) -
A Comprehensive Review of Multimodal Large Language Models: Performance and Challenges Across Different Tasks
by: Wang, Jiaqi, et al.
Published: (2024) -
Structure Unbiased Adversarial Model for Medical Image Segmentation
by: Zhang, Tianyang, et al.
Published: (2022)