A multi-modal vision-language model for generalizable annotation-free pathology localization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Hao, Zhou, Hong-Yu, Liu, Jiarun, Huang, Weijian, Li, Cheng, Li, Zhihuan, Gao, Yuanxu, Liu, Qiegen, Liang, Yong, Yang, Qi, Wu, Song, Tan, Tao, Zheng, Hairong, Zhang, Kang, Wang, Shanshan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing the vision-language foundation model with key semantic knowledge-emphasized report refinement
par: Huang, Weijian, et autres
Publié: (2024)
par: Huang, Weijian, et autres
Publié: (2024)
Multimodal self-supervised learning for lesion localization
par: Yang, Hao, et autres
Publié: (2024)
par: Yang, Hao, et autres
Publié: (2024)
Bias-constrained multimodal intelligence for equitable and reliable clinical AI
par: Li, Cheng, et autres
Publié: (2026)
par: Li, Cheng, et autres
Publié: (2026)
A multimodal vision foundation model for generalizable knee pathology
par: Yu, Kang, et autres
Publié: (2026)
par: Yu, Kang, et autres
Publié: (2026)
Enhancing Representation in Radiography-Reports Foundation Model: A Granular Alignment Algorithm Using Masked Contrastive Learning
par: Huang, Weijian, et autres
Publié: (2023)
par: Huang, Weijian, et autres
Publié: (2023)
Enhancing Representation in Medical Vision-Language Foundation Models via Multi-Scale Information Extraction Techniques
par: Huang, Weijian, et autres
Publié: (2024)
par: Huang, Weijian, et autres
Publié: (2024)
BioVFM-21M: Benchmarking and Scaling Self-Supervised Vision Foundation Models for Biomedical Image Analysis
par: Liu, Jiarun, et autres
Publié: (2025)
par: Liu, Jiarun, et autres
Publié: (2025)
MLIP: Medical Language-Image Pre-training with Masked Local Representation Learning
par: Liu, Jiarun, et autres
Publié: (2024)
par: Liu, Jiarun, et autres
Publié: (2024)
Appendix_FRDP
par: Yang, Yuanxu
Publié: (2026)
par: Yang, Yuanxu
Publié: (2026)
Optimized Vessel Segmentation: A Structure-Agnostic Approach with Small Vessel Enhancement and Morphological Correction
par: Song, Dongning, et autres
Publié: (2024)
par: Song, Dongning, et autres
Publié: (2024)
A Diffusion-Driven Temporal Super-Resolution and Spatial Consistency Enhancement Framework for 4D MRI imaging
par: Zhou, Xuanru, et autres
Publié: (2025)
par: Zhou, Xuanru, et autres
Publié: (2025)
Erratum to: Knowledge‐driven deep learning for fast MR imaging: Undersampled MR image reconstruction from supervised to un‐supervised learning (Magn Reson Med. 2024;92:496‐518)
par: Shanshan Wang, et autres
Publié: (2024)
par: Shanshan Wang, et autres
Publié: (2024)
Unified modality separation: A vision-language framework for unsupervised domain adaptation
par: Li, Xinyao, et autres
Publié: (2025)
par: Li, Xinyao, et autres
Publié: (2025)
nnMIL: A generalizable multiple instance learning framework for computational pathology
par: Luo, Xiangde, et autres
Publié: (2025)
par: Luo, Xiangde, et autres
Publié: (2025)
Swin-UMamba: Mamba-based UNet with ImageNet-based pretraining
par: Liu, Jiarun, et autres
Publié: (2024)
par: Liu, Jiarun, et autres
Publié: (2024)
Distribution matching with subset‐ k ‐space embedding for multi‐contrast MRI reconstruction
par: Yu Guan, et autres
Publié: (2025)
par: Yu Guan, et autres
Publié: (2025)
VLA-Mark: A cross modal watermark for large vision-language alignment model
par: Liu, Shuliang, et autres
Publié: (2025)
par: Liu, Shuliang, et autres
Publié: (2025)
Generalizing vision-language models to novel domains: A comprehensive survey
par: Li, Xinyao, et autres
Publié: (2025)
par: Li, Xinyao, et autres
Publié: (2025)
EventLens: Leveraging Event-Aware Pretraining and Cross-modal Linking Enhances Visual Commonsense Reasoning
par: Ma, Mingjie, et autres
Publié: (2024)
par: Ma, Mingjie, et autres
Publié: (2024)
Adaptive information fusion network for multi‐modal personality recognition
par: Yongtang Bao, et autres
Publié: (2024)
par: Yongtang Bao, et autres
Publié: (2024)
Double-Constraint Diffusion Model with Nuclear Regularization for Ultra-low-dose PET Reconstruction
par: Geng, Mengxiao, et autres
Publié: (2025)
par: Geng, Mengxiao, et autres
Publié: (2025)
Automating construction safety inspections using a multi-modal vision-language RAG framework
par: Wang, Chenxin, et autres
Publié: (2025)
par: Wang, Chenxin, et autres
Publié: (2025)
Generative Artificial Intelligence in Medical Imaging: Foundations, Progress, and Clinical Translation
par: Zhou, Xuanru, et autres
Publié: (2025)
par: Zhou, Xuanru, et autres
Publié: (2025)
Making medical vision-language models think causally across modalities with retrieval-augmented cross-modal reasoning
par: Yang, Weiqin, et autres
Publié: (2026)
par: Yang, Weiqin, et autres
Publié: (2026)
ALL-PET: A Low-resource and Low-shot PET Foundation Model in Projection Domain
par: Huang, Bin, et autres
Publié: (2025)
par: Huang, Bin, et autres
Publié: (2025)
Four-channel Imaging Based on Reconfigurable Metasurfaces: Hyperchaotic Encryption under Physical Protection
par: Li, Yifan, et autres
Publié: (2025)
par: Li, Yifan, et autres
Publié: (2025)
SmolDocling: An ultra-compact vision-language model for end-to-end multi-modal document conversion
par: Nassar, Ahmed, et autres
Publié: (2025)
par: Nassar, Ahmed, et autres
Publié: (2025)
Visual hallucination detection in large vision-language models via evidential conflict
par: Huang, Tao, et autres
Publié: (2025)
par: Huang, Tao, et autres
Publié: (2025)
Large language model-powered AI systems achieve self-replication with no human intervention
par: Pan, Xudong, et autres
Publié: (2025)
par: Pan, Xudong, et autres
Publié: (2025)
UCell: rethinking generalizability and scaling of bio-medical vision models
par: Kuang, Nicholas, et autres
Publié: (2026)
par: Kuang, Nicholas, et autres
Publié: (2026)
Datasets accompanying A multi-modal cell-free RNA language model for liquid biopsy applications
par: Exai Bio Inc.
Publié: (2025)
par: Exai Bio Inc.
Publié: (2025)
EyeCLIP: A visual-language foundation model for multi-modal ophthalmic image analysis
par: Shi, Danli, et autres
Publié: (2024)
par: Shi, Danli, et autres
Publié: (2024)
Computed tomography‐based artificial intelligence in lung disease—Chronic obstructive pulmonary disease
par: Fangfei Wang, et autres
Publié: (2024)
par: Fangfei Wang, et autres
Publié: (2024)
LLaVAction: evaluating and training multi-modal large language models for action understanding
par: Qi, Haozhe, et autres
Publié: (2025)
par: Qi, Haozhe, et autres
Publié: (2025)
Cross-modal linkage risk in clinical vision-language models
par: Arasteh, Soroosh Tayebi, et autres
Publié: (2026)
par: Arasteh, Soroosh Tayebi, et autres
Publié: (2026)
Diffusion model based on generalized map for accelerated MRI
par: Zengwei Xiao, et autres
Publié: (2024)
par: Zengwei Xiao, et autres
Publié: (2024)
Natural language is not enough: Benchmarking multi-modal generative AI for Verilog generation
par: Chang, Kaiyan, et autres
Publié: (2024)
par: Chang, Kaiyan, et autres
Publié: (2024)
Bridging the Gap between Multi-focus and Multi-modal: A Focused Integration Framework for Multi-modal Image Fusion
par: Li, Xilai, et autres
Publié: (2023)
par: Li, Xilai, et autres
Publié: (2023)
Miniaturized microscopes to study neural dynamics in freely-behaving animals
par: Zong, Weijian, et autres
Publié: (2026)
par: Zong, Weijian, et autres
Publié: (2026)
Accurate and generalizable protein-ligand binding affinity prediction with geometric deep learning
par: Li, Krinos, et autres
Publié: (2025)
par: Li, Krinos, et autres
Publié: (2025)
Documents similaires
-
Enhancing the vision-language foundation model with key semantic knowledge-emphasized report refinement
par: Huang, Weijian, et autres
Publié: (2024) -
Multimodal self-supervised learning for lesion localization
par: Yang, Hao, et autres
Publié: (2024) -
Bias-constrained multimodal intelligence for equitable and reliable clinical AI
par: Li, Cheng, et autres
Publié: (2026) -
A multimodal vision foundation model for generalizable knee pathology
par: Yu, Kang, et autres
Publié: (2026) -
Enhancing Representation in Radiography-Reports Foundation Model: A Granular Alignment Algorithm Using Masked Contrastive Learning
par: Huang, Weijian, et autres
Publié: (2023)