Efficient Medical Vision-Language Alignment Through Adapting Masked Vision Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Lian, Chenyu, Zhou, Hong-Yu, Liang, Dongyun, Qin, Jing, Wang, Liansheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Evidential Reasoning Advances Interpretable Real-World Disease Screening
di: Lian, Chenyu, et al.
Pubblicazione: (2026)
di: Lian, Chenyu, et al.
Pubblicazione: (2026)
Less Could Be Better: Parameter-efficient Fine-tuning Advances Medical Vision Foundation Models
di: Lian, Chenyu, et al.
Pubblicazione: (2024)
di: Lian, Chenyu, et al.
Pubblicazione: (2024)
BenchReAD: A systematic benchmark for retinal anomaly detection
di: Lian, Chenyu, et al.
Pubblicazione: (2025)
di: Lian, Chenyu, et al.
Pubblicazione: (2025)
Concept-Guided Noisy Negative Suppression for Zero-Shot Classification and Grounding of Chest X-Ray Findings
di: Lian, Chenyu, et al.
Pubblicazione: (2026)
di: Lian, Chenyu, et al.
Pubblicazione: (2026)
AdaptVision: Efficient Vision-Language Models via Adaptive Visual Acquisition
di: Lin, Zichuan, et al.
Pubblicazione: (2025)
di: Lin, Zichuan, et al.
Pubblicazione: (2025)
Adapting Vision-Language Models Without Labels: A Comprehensive Survey
di: Dong, Hao, et al.
Pubblicazione: (2025)
di: Dong, Hao, et al.
Pubblicazione: (2025)
Adapting Vision-Language Models for Evaluating World Models
di: Hendriksen, Mariya, et al.
Pubblicazione: (2025)
di: Hendriksen, Mariya, et al.
Pubblicazione: (2025)
Masking Teacher and Reinforcing Student for Distilling Vision-Language Models
di: Lee, Byung-Kwan, et al.
Pubblicazione: (2025)
di: Lee, Byung-Kwan, et al.
Pubblicazione: (2025)
FastVLM: Efficient Vision Encoding for Vision Language Models
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2024)
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2024)
Improvise, Adapt, Overcome -- Telescopic Adapters for Efficient Fine-tuning of Vision Language Models in Medical Imaging
di: Mishra, Ujjwal, et al.
Pubblicazione: (2025)
di: Mishra, Ujjwal, et al.
Pubblicazione: (2025)
Look Through Masks: Towards Masked Face Recognition with De-Occlusion Distillation
di: Li, Chenyu, et al.
Pubblicazione: (2024)
di: Li, Chenyu, et al.
Pubblicazione: (2024)
Freeze the backbones: A Parameter-Efficient Contrastive Approach to Robust Medical Vision-Language Pre-training
di: Qin, Jiuming, et al.
Pubblicazione: (2024)
di: Qin, Jiuming, et al.
Pubblicazione: (2024)
RIV: Recursive Introspection Mask Diffusion Vision Language Model
di: Li, YuQian, et al.
Pubblicazione: (2025)
di: Li, YuQian, et al.
Pubblicazione: (2025)
Visual Modality Prompt for Adapting Vision-Language Object Detectors
di: Medeiros, Heitor R., et al.
Pubblicazione: (2024)
di: Medeiros, Heitor R., et al.
Pubblicazione: (2024)
Anatomy-VLM: A Fine-grained Vision-Language Model for Medical Interpretation
di: Gu, Difei, et al.
Pubblicazione: (2025)
di: Gu, Difei, et al.
Pubblicazione: (2025)
FG-CLIP 2: A Bilingual Fine-grained Vision-Language Alignment Model
di: Xie, Chunyu, et al.
Pubblicazione: (2025)
di: Xie, Chunyu, et al.
Pubblicazione: (2025)
Jailbreaking Vision-Language Models Through the Visual Modality
di: Azulay, Aharon, et al.
Pubblicazione: (2026)
di: Azulay, Aharon, et al.
Pubblicazione: (2026)
Enhancing Medical Large Vision-Language Models via Alignment Distillation
di: Chang, Aofei, et al.
Pubblicazione: (2025)
di: Chang, Aofei, et al.
Pubblicazione: (2025)
RadAlign: Advancing Radiology Report Generation with Vision-Language Concept Alignment
di: Gu, Difei, et al.
Pubblicazione: (2025)
di: Gu, Difei, et al.
Pubblicazione: (2025)
Robust Pre-Training of Medical Vision-and-Language Models with Domain-Invariant Multi-Modal Masked Reconstruction
di: Filvantorkaman, Melika, et al.
Pubblicazione: (2026)
di: Filvantorkaman, Melika, et al.
Pubblicazione: (2026)
Post-pre-training for Modality Alignment in Vision-Language Foundation Models
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2025)
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2025)
Learning Emergent Modular Representations in Multi-modality Medical Vision Foundation Models
di: He, Yuting, et al.
Pubblicazione: (2026)
di: He, Yuting, et al.
Pubblicazione: (2026)
Efficient Few-Shot Learning in Remote Sensing: Fusing Vision and Vision-Language Models
di: Chua, Jia Yun, et al.
Pubblicazione: (2025)
di: Chua, Jia Yun, et al.
Pubblicazione: (2025)
Topological Alignment of Shared Vision-Language Embedding Space
di: You, Junwon, et al.
Pubblicazione: (2025)
di: You, Junwon, et al.
Pubblicazione: (2025)
ZipVL: Efficient Large Vision-Language Models with Dynamic Token Sparsification
di: He, Yefei, et al.
Pubblicazione: (2024)
di: He, Yefei, et al.
Pubblicazione: (2024)
PETAR: Localized Findings Generation with Mask-Aware Vision-Language Modeling for PET Automated Reporting
di: Maqbool, Danyal, et al.
Pubblicazione: (2025)
di: Maqbool, Danyal, et al.
Pubblicazione: (2025)
Improving Medical Large Vision-Language Models with Abnormal-Aware Feedback
di: Zhou, Yucheng, et al.
Pubblicazione: (2025)
di: Zhou, Yucheng, et al.
Pubblicazione: (2025)
A Survey on Efficient Vision-Language-Action Models
di: Yu, Zhaoshu, et al.
Pubblicazione: (2025)
di: Yu, Zhaoshu, et al.
Pubblicazione: (2025)
Safety Alignment for Vision Language Models
di: Liu, Zhendong, et al.
Pubblicazione: (2024)
di: Liu, Zhendong, et al.
Pubblicazione: (2024)
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning
di: Yang, Senqiao, et al.
Pubblicazione: (2025)
di: Yang, Senqiao, et al.
Pubblicazione: (2025)
Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement
di: Wang, Xiyao, et al.
Pubblicazione: (2024)
di: Wang, Xiyao, et al.
Pubblicazione: (2024)
TinyAlign: Boosting Lightweight Vision-Language Models by Mitigating Modal Alignment Bottlenecks
di: Hu, Yuanze, et al.
Pubblicazione: (2025)
di: Hu, Yuanze, et al.
Pubblicazione: (2025)
MirrorCheck: Efficient Adversarial Defense for Vision-Language Models
di: Fares, Samar, et al.
Pubblicazione: (2024)
di: Fares, Samar, et al.
Pubblicazione: (2024)
Refer to Any Segmentation Mask Group With Vision-Language Prompts
di: Cao, Shengcao, et al.
Pubblicazione: (2025)
di: Cao, Shengcao, et al.
Pubblicazione: (2025)
Adapting Vision-Language Models for E-commerce Understanding at Scale
di: Nulli, Matteo, et al.
Pubblicazione: (2026)
di: Nulli, Matteo, et al.
Pubblicazione: (2026)
Distilling Out-of-Distribution Robustness from Vision-Language Foundation Models
di: Zhou, Andy, et al.
Pubblicazione: (2023)
di: Zhou, Andy, et al.
Pubblicazione: (2023)
Skill-Conditioned Visual Geolocation for Vision-Language Models
di: Yang, Chenjie, et al.
Pubblicazione: (2026)
di: Yang, Chenjie, et al.
Pubblicazione: (2026)
Inverse-LLaVA: Eliminating Alignment Pre-training Through Text-to-Vision Mapping
di: Zhan, Xuhui, et al.
Pubblicazione: (2025)
di: Zhan, Xuhui, et al.
Pubblicazione: (2025)
Analyzing Fine-Grained Alignment and Enhancing Vision Understanding in Multimodal Language Models
di: Jiang, Jiachen, et al.
Pubblicazione: (2025)
di: Jiang, Jiachen, et al.
Pubblicazione: (2025)
To Trust Or Not To Trust Your Vision-Language Model's Prediction
di: Dong, Hao, et al.
Pubblicazione: (2025)
di: Dong, Hao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Evidential Reasoning Advances Interpretable Real-World Disease Screening
di: Lian, Chenyu, et al.
Pubblicazione: (2026) -
Less Could Be Better: Parameter-efficient Fine-tuning Advances Medical Vision Foundation Models
di: Lian, Chenyu, et al.
Pubblicazione: (2024) -
BenchReAD: A systematic benchmark for retinal anomaly detection
di: Lian, Chenyu, et al.
Pubblicazione: (2025) -
Concept-Guided Noisy Negative Suppression for Zero-Shot Classification and Grounding of Chest X-Ray Findings
di: Lian, Chenyu, et al.
Pubblicazione: (2026) -
AdaptVision: Efficient Vision-Language Models via Adaptive Visual Acquisition
di: Lin, Zichuan, et al.
Pubblicazione: (2025)