Boosting Vision Semantic Density with Anatomy Normality Modeling for Medical Vision-language Pre-training
Fuente:
arXiv
Saved in:
| Main Authors: | Cao, Weiwei, Zhang, Jianpeng, Shui, Zhongyi, Wang, Sinuo, Chen, Zeli, Li, Xi, Lu, Le, Ye, Xianghua, Liang, Tingbo, Zhang, Qi, Zhang, Ling |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Large-scale and Fine-grained Vision-language Pre-training for Enhanced CT Image Understanding
by: Shui, Zhongyi, et al.
Published: (2025)
by: Shui, Zhongyi, et al.
Published: (2025)
Anatomy-Aware Low-Dose CT Denoising via Pretrained Vision Models and Semantic-Guided Contrastive Learning
by: Wang, Runze, et al.
Published: (2025)
by: Wang, Runze, et al.
Published: (2025)
Task-Oriented Semantic Communication for Stereo-Vision 3D Object Detection
by: Cao, Zijian, et al.
Published: (2025)
by: Cao, Zijian, et al.
Published: (2025)
Low-Rank Adaptation of Pre-trained Vision Backbones for Energy-Efficient Image Coding for Machine
by: Zhang, Yichi, et al.
Published: (2025)
by: Zhang, Yichi, et al.
Published: (2025)
Multi-modal Learning with Missing Modality in Predicting Axillary Lymph Node Metastasis
by: Zhang, Shichuan, et al.
Published: (2024)
by: Zhang, Shichuan, et al.
Published: (2024)
MedFLIP: Medical Vision-and-Language Self-supervised Fast Pre-Training with Masked Autoencoder
by: Li, Lei, et al.
Published: (2024)
by: Li, Lei, et al.
Published: (2024)
Remote Sensing Semantic Segmentation Quality Assessment based on Vision Language Model
by: Shi, Huiying, et al.
Published: (2025)
by: Shi, Huiying, et al.
Published: (2025)
T3D: Advancing 3D Medical Vision-Language Pre-training by Learning Multi-View Visual Consistency
by: Liu, Che, et al.
Published: (2023)
by: Liu, Che, et al.
Published: (2023)
Leveraging Semantic Asymmetry for Precise Gross Tumor Volume Segmentation of Nasopharyngeal Carcinoma in Planning CT
by: Li, Zi, et al.
Published: (2024)
by: Li, Zi, et al.
Published: (2024)
Anatomy-Guided Surface Diffusion Model for Alzheimer's Disease Normative Modeling
by: Zhang, Jianwei, et al.
Published: (2024)
by: Zhang, Jianwei, et al.
Published: (2024)
Versatile Volumetric Medical Image Coding for Human-Machine Vision
by: Chen, Jietao, et al.
Published: (2024)
by: Chen, Jietao, et al.
Published: (2024)
HMT-UNet: A hybird Mamba-Transformer Vision UNet for Medical Image Segmentation
by: Zhang, Mingya, et al.
Published: (2024)
by: Zhang, Mingya, et al.
Published: (2024)
DVMSR: Distillated Vision Mamba for Efficient Super-Resolution
by: Lei, Xiaoyan, et al.
Published: (2024)
by: Lei, Xiaoyan, et al.
Published: (2024)
VM-UNET-V2 Rethinking Vision Mamba UNet for Medical Image Segmentation
by: Zhang, Mingya, et al.
Published: (2024)
by: Zhang, Mingya, et al.
Published: (2024)
Knowledge-enhanced Pretraining for Vision-language Pathology Foundation Model on Cancer Diagnosis
by: Zhou, Xiao, et al.
Published: (2024)
by: Zhou, Xiao, et al.
Published: (2024)
Unraveling Normal Anatomy via Fluid-Driven Anomaly Randomization
by: Liu, Peirong, et al.
Published: (2025)
by: Liu, Peirong, et al.
Published: (2025)
MeDUET: Disentangled Unified Pretraining for 3D Medical Image Synthesis and Analysis
by: Liu, Junkai, et al.
Published: (2026)
by: Liu, Junkai, et al.
Published: (2026)
Context-Aware Vision Language Foundation Models for Ocular Disease Screening in Retinal Images
by: Berger, Lucie, et al.
Published: (2025)
by: Berger, Lucie, et al.
Published: (2025)
Image Provenance Analysis via Graph Encoding with Vision Transformer
by: Zhang, Keyang, et al.
Published: (2024)
by: Zhang, Keyang, et al.
Published: (2024)
Focus on Texture: Rethinking Pre-training in Masked Autoencoders for Medical Image Classification
by: Madan, Chetan, et al.
Published: (2025)
by: Madan, Chetan, et al.
Published: (2025)
Towards Effective and Efficient Context-aware Nucleus Detection in Histopathology Whole Slide Images
by: Shui, Zhongyi, et al.
Published: (2025)
by: Shui, Zhongyi, et al.
Published: (2025)
DiSC-Med: Diffusion-based Semantic Communications for Robust Medical Image Transmission
by: Guo, Fupei, et al.
Published: (2025)
by: Guo, Fupei, et al.
Published: (2025)
Generalized User-Oriented Image Semantic Coding Empowered by Large Vision-Language Model
by: Huang, Sin-Yu, et al.
Published: (2025)
by: Huang, Sin-Yu, et al.
Published: (2025)
Generative Preprocessing for Image Compression with Pre-trained Diffusion Models
by: Guo, Mengxi, et al.
Published: (2025)
by: Guo, Mengxi, et al.
Published: (2025)
Learning Global and Local Features of Normal Brain Anatomy for Unsupervised Abnormality Detection
by: Kobayashi, Kazuma, et al.
Published: (2020)
by: Kobayashi, Kazuma, et al.
Published: (2020)
MedVisionLlama: Leveraging Pre-Trained Large Language Model Layers to Enhance Medical Image Segmentation
by: Kumar, Gurucharan Marthi Krishna, et al.
Published: (2024)
by: Kumar, Gurucharan Marthi Krishna, et al.
Published: (2024)
Scribe Verification in Chinese manuscripts using Siamese, Triplet, and Vision Transformer Neural Networks
by: Liakopoulos, Dimitrios-Chrysovalantis, et al.
Published: (2026)
by: Liakopoulos, Dimitrios-Chrysovalantis, et al.
Published: (2026)
PET2Rep: Towards Vision-Language Model-Drived Automated Radiology Report Generation for Positron Emission Tomography
by: Zhang, Yichi, et al.
Published: (2025)
by: Zhang, Yichi, et al.
Published: (2025)
Invited Paper: BitMedViT: Ternary-Quantized Vision Transformer for Medical AI Assistants on the Edge
by: Walczak, Mikolaj, et al.
Published: (2025)
by: Walczak, Mikolaj, et al.
Published: (2025)
Boosting Convolution with Efficient MLP-Permutation for Volumetric Medical Image Segmentation
by: Lin, Yi, et al.
Published: (2023)
by: Lin, Yi, et al.
Published: (2023)
Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant
by: Wang, Haonan, et al.
Published: (2025)
by: Wang, Haonan, et al.
Published: (2025)
Pre-trained Under Noise: A Framework for Robust Bone Fracture Detection in Medical Imaging
by: Hoover, Robby, et al.
Published: (2025)
by: Hoover, Robby, et al.
Published: (2025)
Self Pre-training with Adaptive Mask Autoencoders for Variable-Contrast 3D Medical Imaging
by: Das, Badhan Kumar, et al.
Published: (2025)
by: Das, Badhan Kumar, et al.
Published: (2025)
Leveraging Pre-trained Models for FF-to-FFPE Histopathological Image Translation
by: Zhang, Qilai, et al.
Published: (2024)
by: Zhang, Qilai, et al.
Published: (2024)
Vision Foundation Models in Medical Image Analysis: Advances and Challenges
by: Liang, Pengchen, et al.
Published: (2025)
by: Liang, Pengchen, et al.
Published: (2025)
Downstream Analysis of Foundational Medical Vision Models for Disease Progression
by: Demir, Basar, et al.
Published: (2025)
by: Demir, Basar, et al.
Published: (2025)
VM-DDPM: Vision Mamba Diffusion for Medical Image Synthesis
by: Ju, Zhihan, et al.
Published: (2024)
by: Ju, Zhihan, et al.
Published: (2024)
VM-UNet: Vision Mamba UNet for Medical Image Segmentation
by: Ruan, Jiacheng, et al.
Published: (2024)
by: Ruan, Jiacheng, et al.
Published: (2024)
DoseDiff: Distance-aware Diffusion Model for Dose Prediction in Radiotherapy
by: Zhang, Yiwen, et al.
Published: (2023)
by: Zhang, Yiwen, et al.
Published: (2023)
Normal and Atypical Mitosis Image Classifier using Efficient Vision Transformer
by: Qi, Xuan, et al.
Published: (2025)
by: Qi, Xuan, et al.
Published: (2025)
Similar Items
-
Large-scale and Fine-grained Vision-language Pre-training for Enhanced CT Image Understanding
by: Shui, Zhongyi, et al.
Published: (2025) -
Anatomy-Aware Low-Dose CT Denoising via Pretrained Vision Models and Semantic-Guided Contrastive Learning
by: Wang, Runze, et al.
Published: (2025) -
Task-Oriented Semantic Communication for Stereo-Vision 3D Object Detection
by: Cao, Zijian, et al.
Published: (2025) -
Low-Rank Adaptation of Pre-trained Vision Backbones for Energy-Efficient Image Coding for Machine
by: Zhang, Yichi, et al.
Published: (2025) -
Multi-modal Learning with Missing Modality in Predicting Axillary Lymph Node Metastasis
by: Zhang, Shichuan, et al.
Published: (2024)