Multimodal Carotid Risk Stratification with Large Vision-Language Models: Benchmarking, Fine-Tuning, and Clinical Insights
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tsolissou, Daphne, Ganitidis, Theofanis, Mitsis, Konstantinos, CHristodoulidis, Stergios, Vakalopoulou, Maria, Nikita, Konstantina |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sustaining model performance for covid-19 detection from dynamic audio data: Development and evaluation of a comprehensive drift-adaptive framework
par: Ganitidis, Theofanis, et autres
Publié: (2024)
par: Ganitidis, Theofanis, et autres
Publié: (2024)
On the Risk of Misleading Reports: Diagnosing Textual Biases in Multimodal Clinical AI
par: Restrepo, David, et autres
Publié: (2025)
par: Restrepo, David, et autres
Publié: (2025)
Medical Context Distorts Decisions in Clinical Vision Language Models
par: Restrepo, David, et autres
Publié: (2026)
par: Restrepo, David, et autres
Publié: (2026)
Full Conformal Adaptation of Medical Vision-Language Models
par: Silva-Rodríguez, Julio, et autres
Publié: (2025)
par: Silva-Rodríguez, Julio, et autres
Publié: (2025)
SoC: Semantic Orthogonal Calibration for Test-Time Prompt Tuning
par: Fillioux, Leo, et autres
Publié: (2026)
par: Fillioux, Leo, et autres
Publié: (2026)
SGPMIL: Sparse Gaussian Process Multiple Instance Learning
par: Lolos, Andreas, et autres
Publié: (2025)
par: Lolos, Andreas, et autres
Publié: (2025)
OCTOPUS: Enhancing the Spatial-Awareness of Vision SSMs with Multi-Dimensional Scans and Traversal Selection
par: Mahatha, Kunal, et autres
Publié: (2026)
par: Mahatha, Kunal, et autres
Publié: (2026)
Mask-HybridGNet: Graph-based segmentation with emergent anatomical correspondence from pixel-level supervision
par: Gaggion, Nicolás, et autres
Publié: (2026)
par: Gaggion, Nicolás, et autres
Publié: (2026)
Fairness and Robustness of CLIP-Based Models for Chest X-rays
par: Sourget, Théo, et autres
Publié: (2025)
par: Sourget, Théo, et autres
Publié: (2025)
CAPRMIL: Context-Aware Patch Representations for Multiple Instance Learning
par: Lolos, Andreas, et autres
Publié: (2025)
par: Lolos, Andreas, et autres
Publié: (2025)
BayesAdapter: enhanced uncertainty estimation in CLIP few-shot adaptation
par: Morales-Álvarez, Pablo, et autres
Publié: (2024)
par: Morales-Álvarez, Pablo, et autres
Publié: (2024)
PVeRA: Probabilistic Vector-Based Random Matrix Adaptation
par: Fillioux, Leo, et autres
Publié: (2025)
par: Fillioux, Leo, et autres
Publié: (2025)
FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models
par: Zheng, Weiying, et autres
Publié: (2025)
par: Zheng, Weiying, et autres
Publié: (2025)
Exploring Real-Time Super-Resolution: Benchmarking and Fine-Tuning for Streaming Content
par: Bogatyrev, Evgeney, et autres
Publié: (2026)
par: Bogatyrev, Evgeney, et autres
Publié: (2026)
Controllable Latent Space Augmentation for Digital Pathology
par: Boutaj, Sofiène, et autres
Publié: (2025)
par: Boutaj, Sofiène, et autres
Publié: (2025)
ViG-Bias: Visually Grounded Bias Discovery and Mitigation
par: Marani, Badr-Eddine, et autres
Publié: (2024)
par: Marani, Badr-Eddine, et autres
Publié: (2024)
ViSurf: Visual Supervised-and-Reinforcement Fine-Tuning for Large Vision-and-Language Models
par: Liu, Yuqi, et autres
Publié: (2025)
par: Liu, Yuqi, et autres
Publié: (2025)
MERGETUNE: Continued Fine-Tuning of Vision-Language Models
par: Wang, Wenqing, et autres
Publié: (2026)
par: Wang, Wenqing, et autres
Publié: (2026)
Language Integration in Fine-Tuning Multimodal Large Language Models for Image-Based Regression
par: Jennings, Roy H., et autres
Publié: (2025)
par: Jennings, Roy H., et autres
Publié: (2025)
LMOD: A Large Multimodal Ophthalmology Dataset and Benchmark for Large Vision-Language Models
par: Qin, Zhenyue, et autres
Publié: (2024)
par: Qin, Zhenyue, et autres
Publié: (2024)
Temporal Gains, Spatial Costs: Revisiting Video Fine-Tuning in Multimodal Large Language Models
par: Zhang, Linghao, et autres
Publié: (2026)
par: Zhang, Linghao, et autres
Publié: (2026)
Multimodal Large Language Models as Image Classifiers
par: Kisel, Nikita, et autres
Publié: (2026)
par: Kisel, Nikita, et autres
Publié: (2026)
VGRP-Bench: Visual Grid Reasoning Puzzle Benchmark for Large Vision-Language Models
par: Ren, Yufan, et autres
Publié: (2025)
par: Ren, Yufan, et autres
Publié: (2025)
Attention-driven GUI Grounding: Leveraging Pretrained Multimodal Large Language Models without Fine-Tuning
par: Xu, Hai-Ming, et autres
Publié: (2024)
par: Xu, Hai-Ming, et autres
Publié: (2024)
Mamba-driven MRI-to-CT Synthesis for MRI-only Radiotherapy Planning
par: Barmpounakis, Konstantinos, et autres
Publié: (2026)
par: Barmpounakis, Konstantinos, et autres
Publié: (2026)
A modular framework for automated evaluation of procedural content generation in serious games with deep reinforcement learning agents
par: Kalafatis, Eleftherios, et autres
Publié: (2025)
par: Kalafatis, Eleftherios, et autres
Publié: (2025)
Learning Domain Knowledge in Multimodal Large Language Models through Reinforcement Fine-Tuning
par: Cao, Qinglong, et autres
Publié: (2026)
par: Cao, Qinglong, et autres
Publié: (2026)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
par: Lan, Long, et autres
Publié: (2024)
par: Lan, Long, et autres
Publié: (2024)
Beyond Accuracy Optimization: Computer Vision Losses for Large Language Model Fine-Tuning
par: Cambrin, Daniele Rege, et autres
Publié: (2024)
par: Cambrin, Daniele Rege, et autres
Publié: (2024)
Benchmarking Large Vision-Language Models on Fine-Grained Image Tasks: A Comprehensive Evaluation
par: Yu, Hong-Tao, et autres
Publié: (2025)
par: Yu, Hong-Tao, et autres
Publié: (2025)
MemLens: Benchmarking Multimodal Long-Term Memory in Large Vision-Language Models
par: Ren, Xiyu, et autres
Publié: (2026)
par: Ren, Xiyu, et autres
Publié: (2026)
Hierarchy-Aware Fine-Tuning of Vision-Language Models
par: Li, Jiayu, et autres
Publié: (2025)
par: Li, Jiayu, et autres
Publié: (2025)
Remodeling Semantic Relationships in Vision-Language Fine-Tuning
par: Wu, Xiangyang, et autres
Publié: (2025)
par: Wu, Xiangyang, et autres
Publié: (2025)
Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models
par: Sun, Haoyuan, et autres
Publié: (2025)
par: Sun, Haoyuan, et autres
Publié: (2025)
Fine-Tuning a Large Vision-Language Model for Artwork's Scoring and Critique
par: Zhang, Zhehan, et autres
Publié: (2026)
par: Zhang, Zhehan, et autres
Publié: (2026)
PPGL-Swarm: Integrated Multimodal Risk Stratification and Hereditary Syndrome Detection in Pheochromocytoma and Paraganglioma
par: Liu, Zelin, et autres
Publié: (2026)
par: Liu, Zelin, et autres
Publié: (2026)
Parameter-Efficient Fine-Tuning Medical Multimodal Large Language Models for Medical Visual Grounding
par: He, Jinlong, et autres
Publié: (2024)
par: He, Jinlong, et autres
Publié: (2024)
Class Adaptive Conformal Training
par: Marani, Badr-Eddine, et autres
Publié: (2026)
par: Marani, Badr-Eddine, et autres
Publié: (2026)
Are foundation models for computer vision good conformal predictors?
par: Fillioux, Leo, et autres
Publié: (2024)
par: Fillioux, Leo, et autres
Publié: (2024)
To See is Not to Learn: Protecting Multimodal Data from Unauthorized Fine-Tuning of Large Vision-Language Model
par: Zhao, Chengshuai, et autres
Publié: (2026)
par: Zhao, Chengshuai, et autres
Publié: (2026)
Documents similaires
-
Sustaining model performance for covid-19 detection from dynamic audio data: Development and evaluation of a comprehensive drift-adaptive framework
par: Ganitidis, Theofanis, et autres
Publié: (2024) -
On the Risk of Misleading Reports: Diagnosing Textual Biases in Multimodal Clinical AI
par: Restrepo, David, et autres
Publié: (2025) -
Medical Context Distorts Decisions in Clinical Vision Language Models
par: Restrepo, David, et autres
Publié: (2026) -
Full Conformal Adaptation of Medical Vision-Language Models
par: Silva-Rodríguez, Julio, et autres
Publié: (2025) -
SoC: Semantic Orthogonal Calibration for Test-Time Prompt Tuning
par: Fillioux, Leo, et autres
Publié: (2026)