Leveraging Vision-Language Foundation Models to Reveal Hidden Image-Attribute Relationships in Medical Imaging
Fuente:
arXiv
Salvato in:
| Autori principali: | Kumar, Amar, Kriz, Anita, Pertzov, Barak, Arbel, Tal |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PRISM: High-Resolution & Precise Counterfactual Medical Image Generation using Language-guided Stable Diffusion
di: Kumar, Amar, et al.
Pubblicazione: (2025)
di: Kumar, Amar, et al.
Pubblicazione: (2025)
Pixel Perfect MegaMed: A Megapixel-Scale Vision-Language Foundation Model for Generating High Resolution Medical Images
di: TehraniNasab, Zahra, et al.
Pubblicazione: (2025)
di: TehraniNasab, Zahra, et al.
Pubblicazione: (2025)
RL4Med-DDPO: Reinforcement Learning for Controlled Guidance Towards Diverse Medical Image Generation using Vision-Language Foundation Models
di: Saremi, Parham, et al.
Pubblicazione: (2025)
di: Saremi, Parham, et al.
Pubblicazione: (2025)
Language-Guided Trajectory Traversal in Disentangled Stable Diffusion Latent Space for Factorized Medical Image Generation
di: TehraniNasab, Zahra, et al.
Pubblicazione: (2025)
di: TehraniNasab, Zahra, et al.
Pubblicazione: (2025)
Prompt4Trust: A Reinforcement Learning Prompt Augmentation Framework for Clinically-Aligned Confidence Calibration in Multimodal Large Language Models
di: Kriz, Anita, et al.
Pubblicazione: (2025)
di: Kriz, Anita, et al.
Pubblicazione: (2025)
AURA: A Multi-Modal Medical Agent for Understanding, Reasoning & Annotation
di: Fathi, Nima, et al.
Pubblicazione: (2025)
di: Fathi, Nima, et al.
Pubblicazione: (2025)
Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation
di: Yu, Wenjun, et al.
Pubblicazione: (2025)
di: Yu, Wenjun, et al.
Pubblicazione: (2025)
Improving Robustness and Reliability in Medical Image Classification with Latent-Guided Diffusion and Nested-Ensembles
di: Shen, Xing, et al.
Pubblicazione: (2023)
di: Shen, Xing, et al.
Pubblicazione: (2023)
DeCoDEx: Confounder Detector Guidance for Improved Diffusion-based Counterfactual Explanations
di: Fathi, Nima, et al.
Pubblicazione: (2024)
di: Fathi, Nima, et al.
Pubblicazione: (2024)
Conditional Diffusion Models are Medical Image Classifiers that Provide Explainability and Uncertainty for Free
di: Favero, Gian Mario, et al.
Pubblicazione: (2025)
di: Favero, Gian Mario, et al.
Pubblicazione: (2025)
Imagining Alternatives: Towards High-Resolution 3D Counterfactual Medical Image Generation via Language Guidance
di: Mohamed, Mohamed, et al.
Pubblicazione: (2025)
di: Mohamed, Mohamed, et al.
Pubblicazione: (2025)
Vision-Language Enhanced Foundation Model for Semi-supervised Medical Image Segmentation
di: Guo, Jiaqi, et al.
Pubblicazione: (2025)
di: Guo, Jiaqi, et al.
Pubblicazione: (2025)
HyperFusion: A Hypernetwork Approach to Multimodal Integration of Tabular and Medical Imaging Data for Predictive Modeling
di: Duenias, Daniel, et al.
Pubblicazione: (2024)
di: Duenias, Daniel, et al.
Pubblicazione: (2024)
Adapting Vision-Language Foundation Model for Next Generation Medical Ultrasound Image Analysis
di: Qu, Jingguo, et al.
Pubblicazione: (2025)
di: Qu, Jingguo, et al.
Pubblicazione: (2025)
GuiDINO: Rethinking Vision Foundation Model in Medical Image Segmentation
di: Liang, Zhuonan, et al.
Pubblicazione: (2026)
di: Liang, Zhuonan, et al.
Pubblicazione: (2026)
Building a General SimCLR Self-Supervised Foundation Model Across Neurological Diseases to Advance 3D Brain MRI Diagnoses
di: Kaczmarek, Emily, et al.
Pubblicazione: (2025)
di: Kaczmarek, Emily, et al.
Pubblicazione: (2025)
Discovering Latent Graphs with GFlowNets for Diverse Conditional Image Generation
di: Trang, Bailey, et al.
Pubblicazione: (2025)
di: Trang, Bailey, et al.
Pubblicazione: (2025)
6 Fingers, 1 Kidney: Natural Adversarial Medical Images Reveal Critical Weaknesses of Vision-Language Models
di: Mayer, Leon, et al.
Pubblicazione: (2025)
di: Mayer, Leon, et al.
Pubblicazione: (2025)
Exposing and Mitigating Calibration Biases and Demographic Unfairness in MLLM Few-Shot In-Context Learning for Medical Image Classification
di: Shen, Xing, et al.
Pubblicazione: (2025)
di: Shen, Xing, et al.
Pubblicazione: (2025)
Image-aware Evaluation of Generated Medical Reports
di: Dawidowicz, Gefen, et al.
Pubblicazione: (2024)
di: Dawidowicz, Gefen, et al.
Pubblicazione: (2024)
Mirage: Unveiling Hidden Artifacts in Synthetic Images with Large Vision-Language Models
di: Sharma, Pranav, et al.
Pubblicazione: (2025)
di: Sharma, Pranav, et al.
Pubblicazione: (2025)
Leveraging Vision-Language Models for Improving Domain Generalization in Image Classification
di: Addepalli, Sravanti, et al.
Pubblicazione: (2023)
di: Addepalli, Sravanti, et al.
Pubblicazione: (2023)
Uncertainty-Aware Vision-Language Segmentation for Medical Imaging
di: Das, Aryan, et al.
Pubblicazione: (2026)
di: Das, Aryan, et al.
Pubblicazione: (2026)
TAP into the Patch Tokens: Leveraging Vision Foundation Model Features for AI-Generated Image Detection
di: Abdullah, Ahmed, et al.
Pubblicazione: (2026)
di: Abdullah, Ahmed, et al.
Pubblicazione: (2026)
Medical Image Registration Meets Vision Foundation Model: Prototype Learning and Contour Awareness
di: Xu, Hao, et al.
Pubblicazione: (2025)
di: Xu, Hao, et al.
Pubblicazione: (2025)
Leveraging Medical Foundation Model Features in Graph Neural Network-Based Retrieval of Breast Histopathology Images
di: Saeidi, Nematollah, et al.
Pubblicazione: (2024)
di: Saeidi, Nematollah, et al.
Pubblicazione: (2024)
Continual Unlearning for Foundational Text-to-Image Models without Generalization Erosion
di: Thakral, Kartik, et al.
Pubblicazione: (2025)
di: Thakral, Kartik, et al.
Pubblicazione: (2025)
Fine-Grained Erasure in Text-to-Image Diffusion-based Foundation Models
di: Thakral, Kartik, et al.
Pubblicazione: (2025)
di: Thakral, Kartik, et al.
Pubblicazione: (2025)
Data Adaptive Traceback for Vision-Language Foundation Models in Image Classification
di: Peng, Wenshuo, et al.
Pubblicazione: (2024)
di: Peng, Wenshuo, et al.
Pubblicazione: (2024)
MedVisionLlama: Leveraging Pre-Trained Large Language Model Layers to Enhance Medical Image Segmentation
di: Kumar, Gurucharan Marthi Krishna, et al.
Pubblicazione: (2024)
di: Kumar, Gurucharan Marthi Krishna, et al.
Pubblicazione: (2024)
Calibrated and Robust Foundation Models for Vision-Language and Medical Image Tasks Under Distribution Shift
di: Khan, Behraj, et al.
Pubblicazione: (2025)
di: Khan, Behraj, et al.
Pubblicazione: (2025)
Task-Specific Knowledge Distillation from the Vision Foundation Model for Enhanced Medical Image Segmentation
di: Liang, Pengchen, et al.
Pubblicazione: (2025)
di: Liang, Pengchen, et al.
Pubblicazione: (2025)
Adversarial Robustness Analysis of Vision-Language Models in Medical Image Segmentation
di: Budathoki, Anjila, et al.
Pubblicazione: (2025)
di: Budathoki, Anjila, et al.
Pubblicazione: (2025)
UMIT: Unifying Medical Imaging Tasks via Vision-Language Models
di: Yu, Haiyang, et al.
Pubblicazione: (2025)
di: Yu, Haiyang, et al.
Pubblicazione: (2025)
Are Vision Foundation Models Foundational for Electron Microscopy Image Segmentation?
di: Fuster-Barceló, Caterina, et al.
Pubblicazione: (2026)
di: Fuster-Barceló, Caterina, et al.
Pubblicazione: (2026)
Vision Foundation Models in Medical Image Analysis: Advances and Challenges
di: Liang, Pengchen, et al.
Pubblicazione: (2025)
di: Liang, Pengchen, et al.
Pubblicazione: (2025)
Demographic Bias of Expert-Level Vision-Language Foundation Models in Medical Imaging
di: Yang, Yuzhe, et al.
Pubblicazione: (2024)
di: Yang, Yuzhe, et al.
Pubblicazione: (2024)
FIDAVL: Fake Image Detection and Attribution using Vision-Language Model
di: Keita, Mamadou, et al.
Pubblicazione: (2024)
di: Keita, Mamadou, et al.
Pubblicazione: (2024)
Training-free Conditional Image Embedding Framework Leveraging Large Vision Language Models
di: Kawarada, Masayuki, et al.
Pubblicazione: (2025)
di: Kawarada, Masayuki, et al.
Pubblicazione: (2025)
Pix2Next: Leveraging Vision Foundation Models for RGB to NIR Image Translation
di: Jin, Youngwan, et al.
Pubblicazione: (2024)
di: Jin, Youngwan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PRISM: High-Resolution & Precise Counterfactual Medical Image Generation using Language-guided Stable Diffusion
di: Kumar, Amar, et al.
Pubblicazione: (2025) -
Pixel Perfect MegaMed: A Megapixel-Scale Vision-Language Foundation Model for Generating High Resolution Medical Images
di: TehraniNasab, Zahra, et al.
Pubblicazione: (2025) -
RL4Med-DDPO: Reinforcement Learning for Controlled Guidance Towards Diverse Medical Image Generation using Vision-Language Foundation Models
di: Saremi, Parham, et al.
Pubblicazione: (2025) -
Language-Guided Trajectory Traversal in Disentangled Stable Diffusion Latent Space for Factorized Medical Image Generation
di: TehraniNasab, Zahra, et al.
Pubblicazione: (2025) -
Prompt4Trust: A Reinforcement Learning Prompt Augmentation Framework for Clinically-Aligned Confidence Calibration in Multimodal Large Language Models
di: Kriz, Anita, et al.
Pubblicazione: (2025)