MG-3D: Multi-Grained Knowledge-Enhanced 3D Medical Vision-Language Pre-training
Fuente:
arXiv
Saved in:
| Main Authors: | Ni, Xuefeng, Wu, Linshan, Zhuang, Jiaxin, Wang, Qiong, Wu, Mingxiang, Vardhanabhuti, Varut, Zhang, Lihai, Gao, Hanyu, Chen, Hao |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MiM: Mask in Mask Self-Supervised Pre-Training for 3D Medical Image Analysis
by: Zhuang, Jiaxin, et al.
Published: (2024)
by: Zhuang, Jiaxin, et al.
Published: (2024)
Large-Scale 3D Medical Image Pre-training with Geometric Context Priors
by: Wu, Linshan, et al.
Published: (2024)
by: Wu, Linshan, et al.
Published: (2024)
VoCo: A Simple-yet-Effective Volume Contrastive Learning Framework for 3D Medical Image Analysis
by: Wu, Linshan, et al.
Published: (2024)
by: Wu, Linshan, et al.
Published: (2024)
FreeTumor: Advance Tumor Segmentation via Large-Scale Tumor Synthesis
by: Wu, Linshan, et al.
Published: (2024)
by: Wu, Linshan, et al.
Published: (2024)
FreeTumor: Large-Scale Generative Tumor Synthesis in Computed Tomography Images for Improving Tumor Recognition
by: Wu, Linshan, et al.
Published: (2025)
by: Wu, Linshan, et al.
Published: (2025)
Glance and Focus Reinforcement for Pan-cancer Screening
by: Wu, Linshan, et al.
Published: (2026)
by: Wu, Linshan, et al.
Published: (2026)
A Large Model for Non-invasive and Personalized Management of Breast Cancer from Multiparametric MRI
by: Luo, Luyang, et al.
Published: (2024)
by: Luo, Luyang, et al.
Published: (2024)
Free Lunch in Medical Image Foundation Model Pre-training via Randomized Synthesis and Disentanglement
by: Wei, Yuhan, et al.
Published: (2026)
by: Wei, Yuhan, et al.
Published: (2026)
T3D: Advancing 3D Medical Vision-Language Pre-training by Learning Multi-View Visual Consistency
by: Liu, Che, et al.
Published: (2023)
by: Liu, Che, et al.
Published: (2023)
UniBiomed: A Universal Foundation Model for Grounded Biomedical Image Interpretation
by: Wu, Linshan, et al.
Published: (2025)
by: Wu, Linshan, et al.
Published: (2025)
3D Scene Graph Guided Vision-Language Pre-training
by: Liu, Hao, et al.
Published: (2024)
by: Liu, Hao, et al.
Published: (2024)
Fractional Denoising for 3D Molecular Pre-training
by: Feng, Shikun, et al.
Published: (2023)
by: Feng, Shikun, et al.
Published: (2023)
Grounded Knowledge-Enhanced Medical Vision-Language Pre-training for Chest X-Ray
by: Deng, Qiao, et al.
Published: (2024)
by: Deng, Qiao, et al.
Published: (2024)
Muskie: Multi-view Masked Image Modeling for 3D Vision Pre-training
by: Li, Wenyu, et al.
Published: (2025)
by: Li, Wenyu, et al.
Published: (2025)
FILP-3D: Enhancing 3D Few-shot Class-incremental Learning with Pre-trained Vision-Language Models
by: Xu, Wan, et al.
Published: (2023)
by: Xu, Wan, et al.
Published: (2023)
Comparative Effectiveness of Psychosocial Protective Factors for Prostate Cancer Survivorship ‐ A UK Biobank Study
by: Yan Yu, et al.
Published: (2025)
by: Yan Yu, et al.
Published: (2025)
An Explainable Biomedical Foundation Model via Large-Scale Concept-Enhanced Vision-Language Pre-training
by: Nie, Yuxiang, et al.
Published: (2025)
by: Nie, Yuxiang, et al.
Published: (2025)
Towards Scalable Language-Image Pre-training for 3D Medical Imaging
by: Zhao, Chenhui, et al.
Published: (2025)
by: Zhao, Chenhui, et al.
Published: (2025)
Primitive Geometry Segment Pre-training for 3D Medical Image Segmentation
by: Tadokoro, Ryu, et al.
Published: (2024)
by: Tadokoro, Ryu, et al.
Published: (2024)
Uni-Mlip: Unified Self-supervision for Medical Vision Language Pre-training
by: Bawazir, Ameera, et al.
Published: (2024)
by: Bawazir, Ameera, et al.
Published: (2024)
Multi-modal Vision Pre-training for Medical Image Analysis
by: Rui, Shaohao, et al.
Published: (2024)
by: Rui, Shaohao, et al.
Published: (2024)
MolSpectra: Pre-training 3D Molecular Representation with Multi-modal Energy Spectra
by: Wang, Liang, et al.
Published: (2025)
by: Wang, Liang, et al.
Published: (2025)
Sculpting Holistic 3D Representation in Contrastive Language-Image-3D Pre-training
by: Gao, Yipeng, et al.
Published: (2023)
by: Gao, Yipeng, et al.
Published: (2023)
Unified Molecule Pre-training with Flexible 2D and 3D Modalities: Single and Paired Modality Integration
by: Song, Tengwei, et al.
Published: (2025)
by: Song, Tengwei, et al.
Published: (2025)
3D-MoE: A Mixture-of-Experts Multi-modal LLM for 3D Vision and Pose Diffusion via Rectified Flow
by: Ma, Yueen, et al.
Published: (2025)
by: Ma, Yueen, et al.
Published: (2025)
Boosting 3D Neuron Segmentation with 2D Vision Transformer Pre-trained on Natural Images
by: Cheng, Yik San, et al.
Published: (2024)
by: Cheng, Yik San, et al.
Published: (2024)
Multimodal 3D Genome Pre-training
by: Yang, Minghao, et al.
Published: (2025)
by: Yang, Minghao, et al.
Published: (2025)
3D Modality-Aware Pre-training for Vision-Language Model in MRI Multi-organ Abnormality Detection
by: Zhu, Haowen, et al.
Published: (2026)
by: Zhu, Haowen, et al.
Published: (2026)
Unsupervised Domain Adaptation for Low-dose CT Reconstruction via Bayesian Uncertainty Alignment
by: Chen, Kecheng, et al.
Published: (2023)
by: Chen, Kecheng, et al.
Published: (2023)
SCA3D: Enhancing Cross-modal 3D Retrieval via 3D Shape and Caption Paired Data Augmentation
by: Ren, Junlong, et al.
Published: (2025)
by: Ren, Junlong, et al.
Published: (2025)
Self Pre-training with Adaptive Mask Autoencoders for Variable-Contrast 3D Medical Imaging
by: Das, Badhan Kumar, et al.
Published: (2025)
by: Das, Badhan Kumar, et al.
Published: (2025)
Distributionally Robust Alignment for Medical Federated Vision-Language Pre-training Under Data Heterogeneity
by: Shuai, Zitao, et al.
Published: (2024)
by: Shuai, Zitao, et al.
Published: (2024)
Knowledge Transfer Scaling Laws for 3D Medical Imaging
by: Lee, Ho Hin, et al.
Published: (2026)
by: Lee, Ho Hin, et al.
Published: (2026)
Point Cloud Unsupervised Pre-training via 3D Gaussian Splatting
by: Liu, Hao, et al.
Published: (2024)
by: Liu, Hao, et al.
Published: (2024)
ConDense: Consistent 2D/3D Pre-training for Dense and Sparse Features from Multi-View Images
by: Zhang, Xiaoshuai, et al.
Published: (2024)
by: Zhang, Xiaoshuai, et al.
Published: (2024)
Retaining and Enhancing Pre-trained Knowledge in Vision-Language Models with Prompt Ensembling
by: Kim, Donggeun, et al.
Published: (2024)
by: Kim, Donggeun, et al.
Published: (2024)
3D nanostructure of CO 2 ‐mineralized steel slag
by: Linshan Li, et al.
Published: (2024)
by: Linshan Li, et al.
Published: (2024)
E3D-GPT: Enhanced 3D Visual Foundation for Medical Vision-Language Model
by: Lai, Haoran, et al.
Published: (2024)
by: Lai, Haoran, et al.
Published: (2024)
Enhancing Vision-Language Pre-training with Rich Supervisions
by: Gao, Yuan, et al.
Published: (2024)
by: Gao, Yuan, et al.
Published: (2024)
Self Pre-training with Topology- and Spatiality-aware Masked Autoencoders for 3D Medical Image Segmentation
by: Gu, Pengfei, et al.
Published: (2024)
by: Gu, Pengfei, et al.
Published: (2024)
Similar Items
-
MiM: Mask in Mask Self-Supervised Pre-Training for 3D Medical Image Analysis
by: Zhuang, Jiaxin, et al.
Published: (2024) -
Large-Scale 3D Medical Image Pre-training with Geometric Context Priors
by: Wu, Linshan, et al.
Published: (2024) -
VoCo: A Simple-yet-Effective Volume Contrastive Learning Framework for 3D Medical Image Analysis
by: Wu, Linshan, et al.
Published: (2024) -
FreeTumor: Advance Tumor Segmentation via Large-Scale Tumor Synthesis
by: Wu, Linshan, et al.
Published: (2024) -
FreeTumor: Large-Scale Generative Tumor Synthesis in Computed Tomography Images for Improving Tumor Recognition
by: Wu, Linshan, et al.
Published: (2025)