MAKE: Multi-Aspect Knowledge-Enhanced Vision-Language Pretraining for Zero-shot Dermatological Assessment
Fuente:
arXiv
Salvato in:
| Autori principali: | Yan, Siyuan, Li, Xieji, Hu, Ming, Jiang, Yiwen, Yu, Zhen, Ge, Zongyuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-Aspect Knowledge-Enhanced Medical Vision-Language Pretraining with Multi-Agent Data Generation
di: Li, Xieji, et al.
Pubblicazione: (2025)
di: Li, Xieji, et al.
Pubblicazione: (2025)
Derm1M: A Million-scale Vision-Language Dataset Aligned with Clinical Ontology Knowledge for Dermatology
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
DermAgent: A Self-Reflective Agentic System for Dermatological Image Analysis with Multi-Tool Reasoning and Traceable Decision-Making
di: Liu, Yize, et al.
Pubblicazione: (2026)
di: Liu, Yize, et al.
Pubblicazione: (2026)
Enhancing Vision-Language Models Generalization via Diversity-Driven Novel Feature Synthesis
di: Yan, Siyuan, et al.
Pubblicazione: (2024)
di: Yan, Siyuan, et al.
Pubblicazione: (2024)
A Vision-Language Foundation Model for Zero-shot Clinical Collaboration and Automated Concept Discovery in Dermatology
di: Yan, Siyuan, et al.
Pubblicazione: (2026)
di: Yan, Siyuan, et al.
Pubblicazione: (2026)
BackdoorIDS: Zero-shot Backdoor Detection for Pretrained Vision Encoder
di: Huang, Siquan, et al.
Pubblicazione: (2026)
di: Huang, Siquan, et al.
Pubblicazione: (2026)
WISE: Weak-Supervision-Guided Step-by-Step Explanations for Multimodal LLMs in Image Classification
di: Jiang, Yiwen, et al.
Pubblicazione: (2025)
di: Jiang, Yiwen, et al.
Pubblicazione: (2025)
A Multimodal Vision Foundation Model for Clinical Dermatology
di: Yan, Siyuan, et al.
Pubblicazione: (2024)
di: Yan, Siyuan, et al.
Pubblicazione: (2024)
HGCLIP: Exploring Vision-Language Models with Graph Representations for Hierarchical Understanding
di: Xia, Peng, et al.
Pubblicazione: (2023)
di: Xia, Peng, et al.
Pubblicazione: (2023)
ReactDiff: Fundamental Multiple Appropriate Facial Reaction Diffusion Model
di: Cheng, Luo, et al.
Pubblicazione: (2025)
di: Cheng, Luo, et al.
Pubblicazione: (2025)
Controllable Skin Synthesis via Lesion-Focused Vector Autoregression Model
di: Sun, Jiajun, et al.
Pubblicazione: (2025)
di: Sun, Jiajun, et al.
Pubblicazione: (2025)
Interpretable Few-Shot Retinal Disease Diagnosis with Concept-Guided Prompting of Vision-Language Models
di: Mehta, Deval, et al.
Pubblicazione: (2025)
di: Mehta, Deval, et al.
Pubblicazione: (2025)
Zero-shot Generalizable Incremental Learning for Vision-Language Object Detection
di: Deng, Jieren, et al.
Pubblicazione: (2024)
di: Deng, Jieren, et al.
Pubblicazione: (2024)
Finetune Like You Pretrain: Boosting Zero-shot Adversarial Robustness in Vision-language Models
di: Xing, Songlong, et al.
Pubblicazione: (2026)
di: Xing, Songlong, et al.
Pubblicazione: (2026)
LMPT: Prompt Tuning with Class-Specific Embedding Loss for Long-tailed Multi-Label Visual Recognition
di: Xia, Peng, et al.
Pubblicazione: (2023)
di: Xia, Peng, et al.
Pubblicazione: (2023)
Knowledge Generation for Zero-shot Knowledge-based VQA
di: Cao, Rui, et al.
Pubblicazione: (2024)
di: Cao, Rui, et al.
Pubblicazione: (2024)
Multi-Token Enhancing for Vision Representation Learning
di: Li, Zhong-Yu, et al.
Pubblicazione: (2024)
di: Li, Zhong-Yu, et al.
Pubblicazione: (2024)
OphCLIP: Hierarchical Retrieval-Augmented Learning for Ophthalmic Surgical Video-Language Pretraining
di: Hu, Ming, et al.
Pubblicazione: (2024)
di: Hu, Ming, et al.
Pubblicazione: (2024)
Knowledge-Enhanced Dual-stream Zero-shot Composed Image Retrieval
di: Suo, Yucheng, et al.
Pubblicazione: (2024)
di: Suo, Yucheng, et al.
Pubblicazione: (2024)
MAL: Cluster-Masked and Multi-Task Pretraining for Enhanced xLSTM Vision Performance
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
HecVL: Hierarchical Video-Language Pretraining for Zero-shot Surgical Phase Recognition
di: Yuan, Kun, et al.
Pubblicazione: (2024)
di: Yuan, Kun, et al.
Pubblicazione: (2024)
Multi-Scale Gaussian-Language Map for Zero-shot Embodied Navigation and Reasoning
di: Zhang, Sixian, et al.
Pubblicazione: (2026)
di: Zhang, Sixian, et al.
Pubblicazione: (2026)
Trustworthy and Fair SkinGPT-R1 for Democratizing Dermatological Reasoning across Diverse Ethnicities
di: Shen, Yuhao, et al.
Pubblicazione: (2025)
di: Shen, Yuhao, et al.
Pubblicazione: (2025)
3D Vision and Language Pretraining with Large-Scale Synthetic Data
di: Yang, Dejie, et al.
Pubblicazione: (2024)
di: Yang, Dejie, et al.
Pubblicazione: (2024)
FILP-3D: Enhancing 3D Few-shot Class-incremental Learning with Pre-trained Vision-Language Models
di: Xu, Wan, et al.
Pubblicazione: (2023)
di: Xu, Wan, et al.
Pubblicazione: (2023)
Combining Knowledge Graph and LLMs for Enhanced Zero-shot Visual Question Answering
di: Tao, Qian, et al.
Pubblicazione: (2025)
di: Tao, Qian, et al.
Pubblicazione: (2025)
Unified Language-driven Zero-shot Domain Adaptation
di: Yang, Senqiao, et al.
Pubblicazione: (2024)
di: Yang, Senqiao, et al.
Pubblicazione: (2024)
Zero-shot Vision-Language Reranking for Cross-View Geolocalization
di: Erzurumlu, Yunus Talha, et al.
Pubblicazione: (2026)
di: Erzurumlu, Yunus Talha, et al.
Pubblicazione: (2026)
Label Propagation for Zero-shot Classification with Vision-Language Models
di: Stojnić, Vladan, et al.
Pubblicazione: (2024)
di: Stojnić, Vladan, et al.
Pubblicazione: (2024)
Compositional Zero-shot Learning via Progressive Language-based Observations
di: Li, Lin, et al.
Pubblicazione: (2023)
di: Li, Lin, et al.
Pubblicazione: (2023)
Generalized Category Discovery under Domain Shift: A Frequency Domain Perspective
di: Feng, Wei, et al.
Pubblicazione: (2025)
di: Feng, Wei, et al.
Pubblicazione: (2025)
Zero-shot Action Localization via the Confidence of Large Vision-Language Models
di: Aklilu, Josiah, et al.
Pubblicazione: (2024)
di: Aklilu, Josiah, et al.
Pubblicazione: (2024)
Diffusion Model Driven Test-Time Image Adaptation for Robust Skin Lesion Classification
di: Hu, Ming, et al.
Pubblicazione: (2024)
di: Hu, Ming, et al.
Pubblicazione: (2024)
Benchmarking Vision-Language and Multimodal Large Language Models in Zero-shot and Few-shot Scenarios: A study on Christian Iconography
di: Spinaci, Gianmarco, et al.
Pubblicazione: (2025)
di: Spinaci, Gianmarco, et al.
Pubblicazione: (2025)
MM-Skin: Enhancing Dermatology Vision-Language Model with an Image-Text Dataset Derived from Textbooks
di: Zeng, Wenqi, et al.
Pubblicazione: (2025)
di: Zeng, Wenqi, et al.
Pubblicazione: (2025)
Synthesizing Knowledge-enhanced Features for Real-world Zero-shot Food Detection
di: Zhou, Pengfei, et al.
Pubblicazione: (2024)
di: Zhou, Pengfei, et al.
Pubblicazione: (2024)
MICM: Rethinking Unsupervised Pretraining for Enhanced Few-shot Learning
di: Zhang, Zhenyu, et al.
Pubblicazione: (2024)
di: Zhang, Zhenyu, et al.
Pubblicazione: (2024)
Enhancing Zero-shot Counting via Language-guided Exemplar Learning
di: Wang, Mingjie, et al.
Pubblicazione: (2024)
di: Wang, Mingjie, et al.
Pubblicazione: (2024)
Zero-shot image privacy classification with Vision-Language Models
di: Baia, Alina Elena, et al.
Pubblicazione: (2025)
di: Baia, Alina Elena, et al.
Pubblicazione: (2025)
Efficient Self-supervised Vision Pretraining with Local Masked Reconstruction
di: Chen, Jun, et al.
Pubblicazione: (2022)
di: Chen, Jun, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Multi-Aspect Knowledge-Enhanced Medical Vision-Language Pretraining with Multi-Agent Data Generation
di: Li, Xieji, et al.
Pubblicazione: (2025) -
Derm1M: A Million-scale Vision-Language Dataset Aligned with Clinical Ontology Knowledge for Dermatology
di: Yan, Siyuan, et al.
Pubblicazione: (2025) -
DermAgent: A Self-Reflective Agentic System for Dermatological Image Analysis with Multi-Tool Reasoning and Traceable Decision-Making
di: Liu, Yize, et al.
Pubblicazione: (2026) -
Enhancing Vision-Language Models Generalization via Diversity-Driven Novel Feature Synthesis
di: Yan, Siyuan, et al.
Pubblicazione: (2024) -
A Vision-Language Foundation Model for Zero-shot Clinical Collaboration and Automated Concept Discovery in Dermatology
di: Yan, Siyuan, et al.
Pubblicazione: (2026)