Multi-Aspect Knowledge-Enhanced Medical Vision-Language Pretraining with Multi-Agent Data Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Xieji, Yan, Siyuan, Liu, Yingsheng, Soyer, H. Peter, Janda, Monika, Mar, Victoria, Ge, Zongyuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MAKE: Multi-Aspect Knowledge-Enhanced Vision-Language Pretraining for Zero-shot Dermatological Assessment
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
Prompt-driven Latent Domain Generalization for Medical Image Classification
di: Yan, Siyuan, et al.
Pubblicazione: (2024)
di: Yan, Siyuan, et al.
Pubblicazione: (2024)
Derm1M: A Million-scale Vision-Language Dataset Aligned with Clinical Ontology Knowledge for Dermatology
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
DermAgent: A Self-Reflective Agentic System for Dermatological Image Analysis with Multi-Tool Reasoning and Traceable Decision-Making
di: Liu, Yize, et al.
Pubblicazione: (2026)
di: Liu, Yize, et al.
Pubblicazione: (2026)
Enhancing Vision-Language Models Generalization via Diversity-Driven Novel Feature Synthesis
di: Yan, Siyuan, et al.
Pubblicazione: (2024)
di: Yan, Siyuan, et al.
Pubblicazione: (2024)
A Vision-Language Foundation Model for Zero-shot Clinical Collaboration and Automated Concept Discovery in Dermatology
di: Yan, Siyuan, et al.
Pubblicazione: (2026)
di: Yan, Siyuan, et al.
Pubblicazione: (2026)
A Multimodal Vision Foundation Model for Clinical Dermatology
di: Yan, Siyuan, et al.
Pubblicazione: (2024)
di: Yan, Siyuan, et al.
Pubblicazione: (2024)
Supporting Data-Frame Dynamics in AI-assisted Decision Making
di: Zheng, Chengbo, et al.
Pubblicazione: (2025)
di: Zheng, Chengbo, et al.
Pubblicazione: (2025)
Delving into Out-of-Distribution Detection with Medical Vision-Language Models
di: Ju, Lie, et al.
Pubblicazione: (2025)
di: Ju, Lie, et al.
Pubblicazione: (2025)
3D Vision and Language Pretraining with Large-Scale Synthetic Data
di: Yang, Dejie, et al.
Pubblicazione: (2024)
di: Yang, Dejie, et al.
Pubblicazione: (2024)
PhenoLIP: Integrating Phenotype Ontology Knowledge into Medical Vision-Language Pretraining
di: Liang, Cheng, et al.
Pubblicazione: (2026)
di: Liang, Cheng, et al.
Pubblicazione: (2026)
MONICA: Benchmarking on Long-tailed Medical Image Classification
di: Ju, Lie, et al.
Pubblicazione: (2024)
di: Ju, Lie, et al.
Pubblicazione: (2024)
MedKCO: Medical Vision-Language Pretraining via Knowledge-Driven Cognitive Orchestration
di: Zhang, Chenran, et al.
Pubblicazione: (2026)
di: Zhang, Chenran, et al.
Pubblicazione: (2026)
Diversified and Personalized Multi-rater Medical Image Segmentation
di: Wu, Yicheng, et al.
Pubblicazione: (2024)
di: Wu, Yicheng, et al.
Pubblicazione: (2024)
Generalized Category Discovery under Domain Shift: A Frequency Domain Perspective
di: Feng, Wei, et al.
Pubblicazione: (2025)
di: Feng, Wei, et al.
Pubblicazione: (2025)
Progressive Vision-Language Prompt for Multi-Organ Multi-Class Cell Semantic Segmentation with Single Branch
di: Zhang, Qing, et al.
Pubblicazione: (2024)
di: Zhang, Qing, et al.
Pubblicazione: (2024)
MG-3D: Multi-Grained Knowledge-Enhanced 3D Medical Vision-Language Pre-training
di: Ni, Xuefeng, et al.
Pubblicazione: (2024)
di: Ni, Xuefeng, et al.
Pubblicazione: (2024)
CheXmix: Unified Generative Pretraining for Vision Language Models in Medical Imaging
di: Kumar, Ashwin, et al.
Pubblicazione: (2026)
di: Kumar, Ashwin, et al.
Pubblicazione: (2026)
MedTri: A Platform for Structured Medical Report Normalization to Enhance Vision-Language Pretraining
di: Chu, Yuetan, et al.
Pubblicazione: (2026)
di: Chu, Yuetan, et al.
Pubblicazione: (2026)
UrbanVLP: Multi-Granularity Vision-Language Pretraining for Urban Socioeconomic Indicator Prediction
di: Hao, Xixuan, et al.
Pubblicazione: (2024)
di: Hao, Xixuan, et al.
Pubblicazione: (2024)
ReactDiff: Fundamental Multiple Appropriate Facial Reaction Diffusion Model
di: Cheng, Luo, et al.
Pubblicazione: (2025)
di: Cheng, Luo, et al.
Pubblicazione: (2025)
Decomposing Disease Descriptions for Enhanced Pathology Detection: A Multi-Aspect Vision-Language Pre-training Framework
di: Phan, Vu Minh Hieu, et al.
Pubblicazione: (2024)
di: Phan, Vu Minh Hieu, et al.
Pubblicazione: (2024)
LLM-Guided Diagnostic Evidence Alignment for Medical Vision-Language Pretraining under Limited Pairing
di: Yan, Huimin, et al.
Pubblicazione: (2026)
di: Yan, Huimin, et al.
Pubblicazione: (2026)
MAL: Cluster-Masked and Multi-Task Pretraining for Enhanced xLSTM Vision Performance
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
COMPRER: A Multimodal Multi-Objective Pretraining Framework for Enhanced Medical Image Representation
di: Lutsker, Guy, et al.
Pubblicazione: (2024)
di: Lutsker, Guy, et al.
Pubblicazione: (2024)
PG-SAM: Prior-Guided SAM with Medical for Multi-organ Segmentation
di: Zhong, Yiheng, et al.
Pubblicazione: (2025)
di: Zhong, Yiheng, et al.
Pubblicazione: (2025)
MultiMedVision: Multi-Modal Medical Vision Framework
di: Li, Frank, et al.
Pubblicazione: (2026)
di: Li, Frank, et al.
Pubblicazione: (2026)
UniCompress: Enhancing Multi-Data Medical Image Compression with Knowledge Distillation
di: Yang, Runzhao, et al.
Pubblicazione: (2024)
di: Yang, Runzhao, et al.
Pubblicazione: (2024)
VILA-M3: Enhancing Vision-Language Models with Medical Expert Knowledge
di: Nath, Vishwesh, et al.
Pubblicazione: (2024)
di: Nath, Vishwesh, et al.
Pubblicazione: (2024)
Enhancing Generalization in Vision-Language-Action Models by Preserving Pretrained Representations
di: Grover, Shresth, et al.
Pubblicazione: (2025)
di: Grover, Shresth, et al.
Pubblicazione: (2025)
WISE: Weak-Supervision-Guided Step-by-Step Explanations for Multimodal LLMs in Image Classification
di: Jiang, Yiwen, et al.
Pubblicazione: (2025)
di: Jiang, Yiwen, et al.
Pubblicazione: (2025)
Controllable Skin Synthesis via Lesion-Focused Vector Autoregression Model
di: Sun, Jiajun, et al.
Pubblicazione: (2025)
di: Sun, Jiajun, et al.
Pubblicazione: (2025)
LMPT: Prompt Tuning with Class-Specific Embedding Loss for Long-tailed Multi-Label Visual Recognition
di: Xia, Peng, et al.
Pubblicazione: (2023)
di: Xia, Peng, et al.
Pubblicazione: (2023)
HGCLIP: Exploring Vision-Language Models with Graph Representations for Hierarchical Understanding
di: Xia, Peng, et al.
Pubblicazione: (2023)
di: Xia, Peng, et al.
Pubblicazione: (2023)
Confounder-Aware Medical Data Selection for Fine-Tuning Pretrained Vision Models
di: Ji, Anyang, et al.
Pubblicazione: (2025)
di: Ji, Anyang, et al.
Pubblicazione: (2025)
Enhancing Representation in Medical Vision-Language Foundation Models via Multi-Scale Information Extraction Techniques
di: Huang, Weijian, et al.
Pubblicazione: (2024)
di: Huang, Weijian, et al.
Pubblicazione: (2024)
OphCLIP: Hierarchical Retrieval-Augmented Learning for Ophthalmic Surgical Video-Language Pretraining
di: Hu, Ming, et al.
Pubblicazione: (2024)
di: Hu, Ming, et al.
Pubblicazione: (2024)
Vision-and-Language Navigation Generative Pretrained Transformer
di: Hanlin, Wen
Pubblicazione: (2024)
di: Hanlin, Wen
Pubblicazione: (2024)
Enhancing Fine-Grained Vision-Language Pretraining with Negative Augmented Samples
di: Wang, Yeyuan, et al.
Pubblicazione: (2024)
di: Wang, Yeyuan, et al.
Pubblicazione: (2024)
Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning
di: Liu, Junming, et al.
Pubblicazione: (2025)
di: Liu, Junming, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MAKE: Multi-Aspect Knowledge-Enhanced Vision-Language Pretraining for Zero-shot Dermatological Assessment
di: Yan, Siyuan, et al.
Pubblicazione: (2025) -
Prompt-driven Latent Domain Generalization for Medical Image Classification
di: Yan, Siyuan, et al.
Pubblicazione: (2024) -
Derm1M: A Million-scale Vision-Language Dataset Aligned with Clinical Ontology Knowledge for Dermatology
di: Yan, Siyuan, et al.
Pubblicazione: (2025) -
DermAgent: A Self-Reflective Agentic System for Dermatological Image Analysis with Multi-Tool Reasoning and Traceable Decision-Making
di: Liu, Yize, et al.
Pubblicazione: (2026) -
Enhancing Vision-Language Models Generalization via Diversity-Driven Novel Feature Synthesis
di: Yan, Siyuan, et al.
Pubblicazione: (2024)