Enhancing Representation in Medical Vision-Language Foundation Models via Multi-Scale Information Extraction Techniques
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Weijian, Li, Cheng, Zhou, Hong-Yu, Liu, Jiarun, Yang, Hao, Liang, Yong, Shi, Guangming, Zheng, Hairong, Wang, Shanshan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Enhancing Representation in Radiography-Reports Foundation Model: A Granular Alignment Algorithm Using Masked Contrastive Learning
di: Huang, Weijian, et al.
Pubblicazione: (2023)
di: Huang, Weijian, et al.
Pubblicazione: (2023)
MLIP: Medical Language-Image Pre-training with Masked Local Representation Learning
di: Liu, Jiarun, et al.
Pubblicazione: (2024)
di: Liu, Jiarun, et al.
Pubblicazione: (2024)
Enhancing the vision-language foundation model with key semantic knowledge-emphasized report refinement
di: Huang, Weijian, et al.
Pubblicazione: (2024)
di: Huang, Weijian, et al.
Pubblicazione: (2024)
Multimodal self-supervised learning for lesion localization
di: Yang, Hao, et al.
Pubblicazione: (2024)
di: Yang, Hao, et al.
Pubblicazione: (2024)
BioVFM-21M: Benchmarking and Scaling Self-Supervised Vision Foundation Models for Biomedical Image Analysis
di: Liu, Jiarun, et al.
Pubblicazione: (2025)
di: Liu, Jiarun, et al.
Pubblicazione: (2025)
Swin-UMamba: Mamba-based UNet with ImageNet-based pretraining
di: Liu, Jiarun, et al.
Pubblicazione: (2024)
di: Liu, Jiarun, et al.
Pubblicazione: (2024)
Bias-constrained multimodal intelligence for equitable and reliable clinical AI
di: Li, Cheng, et al.
Pubblicazione: (2026)
di: Li, Cheng, et al.
Pubblicazione: (2026)
Generative Artificial Intelligence in Medical Imaging: Foundations, Progress, and Clinical Translation
di: Zhou, Xuanru, et al.
Pubblicazione: (2025)
di: Zhou, Xuanru, et al.
Pubblicazione: (2025)
A multi-modal vision-language model for generalizable annotation-free pathology localization
di: Yang, Hao, et al.
Pubblicazione: (2024)
di: Yang, Hao, et al.
Pubblicazione: (2024)
Optimized Vessel Segmentation: A Structure-Agnostic Approach with Small Vessel Enhancement and Morphological Correction
di: Song, Dongning, et al.
Pubblicazione: (2024)
di: Song, Dongning, et al.
Pubblicazione: (2024)
SamRobNODDI: Q-Space Sampling-Augmented Continuous Representation Learning for Robust and Generalized NODDI
di: Xiao, Taohui, et al.
Pubblicazione: (2024)
di: Xiao, Taohui, et al.
Pubblicazione: (2024)
HAVIR: HierArchical Vision to Image Reconstruction using CLIP-Guided Versatile Diffusion
di: Zhang, Shiyi, et al.
Pubblicazione: (2025)
di: Zhang, Shiyi, et al.
Pubblicazione: (2025)
HAVIR: HierArchical Vision to Image Reconstruction using CLIP-Guided Versatile Diffusion
di: Zhang, Shiyi, et al.
Pubblicazione: (2025)
di: Zhang, Shiyi, et al.
Pubblicazione: (2025)
Look Before Acting: Enhancing Vision Foundation Representations for Vision-Language-Action Models
di: Luo, Yulin, et al.
Pubblicazione: (2026)
di: Luo, Yulin, et al.
Pubblicazione: (2026)
Towards Agentic AI Networking in 6G: A Generative Foundation Model-as-Agent Approach
di: Xiao, Yong, et al.
Pubblicazione: (2025)
di: Xiao, Yong, et al.
Pubblicazione: (2025)
Learning Emergent Modular Representations in Multi-modality Medical Vision Foundation Models
di: He, Yuting, et al.
Pubblicazione: (2026)
di: He, Yuting, et al.
Pubblicazione: (2026)
Hierarchical Fusion and Joint Aggregation: A Multi-Level Feature Representation Method for AIGC Image Quality Assessment
di: Meng, Linghe, et al.
Pubblicazione: (2025)
di: Meng, Linghe, et al.
Pubblicazione: (2025)
A Survey of Medical Vision-and-Language Applications and Their Techniques
di: Chen, Qi, et al.
Pubblicazione: (2024)
di: Chen, Qi, et al.
Pubblicazione: (2024)
Distributed Information Bottleneck Theory for Multi-Modal Task-Aware Semantic Communication
di: Zhou, Yujie, et al.
Pubblicazione: (2025)
di: Zhou, Yujie, et al.
Pubblicazione: (2025)
Efficient Medical Vision-Language Alignment Through Adapting Masked Vision Models
di: Lian, Chenyu, et al.
Pubblicazione: (2025)
di: Lian, Chenyu, et al.
Pubblicazione: (2025)
Systematic Pharmacovigilance and Genetic Validation of Medications Associated With Organizing Pneumonia: Integrating FAERS Data With Multiomics Analysis
di: Wenhao Wu, et al.
Pubblicazione: (2026)
di: Wenhao Wu, et al.
Pubblicazione: (2026)
Low-Resource Fine-Tuning for Multi-Task Structured Information Extraction with a Billion-Parameter Instruction-Tuned Model
di: Chih, Yu Cheng, et al.
Pubblicazione: (2025)
di: Chih, Yu Cheng, et al.
Pubblicazione: (2025)
Vision-Language Enhanced Foundation Model for Semi-supervised Medical Image Segmentation
di: Guo, Jiaqi, et al.
Pubblicazione: (2025)
di: Guo, Jiaqi, et al.
Pubblicazione: (2025)
A Diffusion-Driven Temporal Super-Resolution and Spatial Consistency Enhancement Framework for 4D MRI imaging
di: Zhou, Xuanru, et al.
Pubblicazione: (2025)
di: Zhou, Xuanru, et al.
Pubblicazione: (2025)
Document Parsing Unveiled: Techniques, Challenges, and Prospects for Structured Information Extraction
di: Zhang, Qintong, et al.
Pubblicazione: (2024)
di: Zhang, Qintong, et al.
Pubblicazione: (2024)
IE as Cache: Information Extraction Enhanced Agentic Reasoning
di: Lv, Hang, et al.
Pubblicazione: (2026)
di: Lv, Hang, et al.
Pubblicazione: (2026)
Scaling Dense Event-Stream Pretraining from Visual Foundation Models
di: Chen, Zhiwen, et al.
Pubblicazione: (2026)
di: Chen, Zhiwen, et al.
Pubblicazione: (2026)
MuRF: Unlocking the Multi-Scale Potential of Vision Foundation Models
di: Zou, Bocheng, et al.
Pubblicazione: (2026)
di: Zou, Bocheng, et al.
Pubblicazione: (2026)
Multi-Token Enhancing for Vision Representation Learning
di: Li, Zhong-Yu, et al.
Pubblicazione: (2024)
di: Li, Zhong-Yu, et al.
Pubblicazione: (2024)
E3D-GPT: Enhanced 3D Visual Foundation for Medical Vision-Language Model
di: Lai, Haoran, et al.
Pubblicazione: (2024)
di: Lai, Haoran, et al.
Pubblicazione: (2024)
An Explainable Biomedical Foundation Model via Large-Scale Concept-Enhanced Vision-Language Pre-training
di: Nie, Yuxiang, et al.
Pubblicazione: (2025)
di: Nie, Yuxiang, et al.
Pubblicazione: (2025)
Task-Specific Knowledge Distillation from the Vision Foundation Model for Enhanced Medical Image Segmentation
di: Liang, Pengchen, et al.
Pubblicazione: (2025)
di: Liang, Pengchen, et al.
Pubblicazione: (2025)
Vision Foundation Models in Medical Image Analysis: Advances and Challenges
di: Liang, Pengchen, et al.
Pubblicazione: (2025)
di: Liang, Pengchen, et al.
Pubblicazione: (2025)
Enhancing Phrase Representation by Information Bottleneck Guided Text Diffusion Process for Keyphrase Extraction
di: Luo, Yuanzhen, et al.
Pubblicazione: (2023)
di: Luo, Yuanzhen, et al.
Pubblicazione: (2023)
Solid‐Phase Extraction Coupled to Tandem Mass Spectrometry for Rapid Quantitation of Urinary Catecholamines and Total Metanephrines
di: Yuhan Li, et al.
Pubblicazione: (2025)
di: Yuhan Li, et al.
Pubblicazione: (2025)
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
di: Wang, Xinyang, et al.
Pubblicazione: (2024)
di: Wang, Xinyang, et al.
Pubblicazione: (2024)
Cross-Sequence Semi-Supervised Learning for Multi-Parametric MRI-Based Visual Pathway Delineation
di: Diakite, Alou, et al.
Pubblicazione: (2025)
di: Diakite, Alou, et al.
Pubblicazione: (2025)
Less Could Be Better: Parameter-efficient Fine-tuning Advances Medical Vision Foundation Models
di: Lian, Chenyu, et al.
Pubblicazione: (2024)
di: Lian, Chenyu, et al.
Pubblicazione: (2024)
Cross-Scale MAE: A Tale of Multi-Scale Exploitation in Remote Sensing
di: Tang, Maofeng, et al.
Pubblicazione: (2024)
di: Tang, Maofeng, et al.
Pubblicazione: (2024)
Enhancing Multi-task Learning Capability of Medical Generalist Foundation Model via Image-centric Multi-annotation Data
di: Zhu, Xun, et al.
Pubblicazione: (2025)
di: Zhu, Xun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Enhancing Representation in Radiography-Reports Foundation Model: A Granular Alignment Algorithm Using Masked Contrastive Learning
di: Huang, Weijian, et al.
Pubblicazione: (2023) -
MLIP: Medical Language-Image Pre-training with Masked Local Representation Learning
di: Liu, Jiarun, et al.
Pubblicazione: (2024) -
Enhancing the vision-language foundation model with key semantic knowledge-emphasized report refinement
di: Huang, Weijian, et al.
Pubblicazione: (2024) -
Multimodal self-supervised learning for lesion localization
di: Yang, Hao, et al.
Pubblicazione: (2024) -
BioVFM-21M: Benchmarking and Scaling Self-Supervised Vision Foundation Models for Biomedical Image Analysis
di: Liu, Jiarun, et al.
Pubblicazione: (2025)