FMBench: Benchmarking Fairness in Multimodal Large Language Models on Medical Tasks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Peiran, Liu, Che, Chen, Canyu, Li, Jun, Bercea, Cosmin I., Arcucci, Rossella |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Abnormality Grounding for Vision Language Models with Knowledge Descriptions
par: Li, Jun, et autres
Publié: (2025)
par: Li, Jun, et autres
Publié: (2025)
Knowledge to Sight: Reasoning over Visual Attributes via Knowledge Decomposition for Abnormality Grounding
par: Li, Jun, et autres
Publié: (2025)
par: Li, Jun, et autres
Publié: (2025)
How Does Diverse Interpretability of Textual Prompts Impact Medical Vision-Language Zero-Shot Tasks?
par: Wang, Sicheng, et autres
Publié: (2024)
par: Wang, Sicheng, et autres
Publié: (2024)
How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study
par: Liu, Che, et autres
Publié: (2025)
par: Liu, Che, et autres
Publié: (2025)
Utilizing Synthetic Data for Medical Vision-Language Pre-training: Bypassing the Need for Real Images
par: Liu, Che, et autres
Publié: (2023)
par: Liu, Che, et autres
Publié: (2023)
Freeze the backbones: A Parameter-Efficient Contrastive Approach to Robust Medical Vision-Language Pre-training
par: Qin, Jiuming, et autres
Publié: (2024)
par: Qin, Jiuming, et autres
Publié: (2024)
Argus: Benchmarking and Enhancing Vision-Language Models for 3D Radiology Report Generation
par: Liu, Che, et autres
Publié: (2024)
par: Liu, Che, et autres
Publié: (2024)
Does DINOv3 Set a New Medical Vision Standard? Benchmarking 2D and 3D Classification, Segmentation, and Registration
par: Liu, Che, et autres
Publié: (2025)
par: Liu, Che, et autres
Publié: (2025)
BIMCV-R: A Landmark Dataset for 3D CT Text-Image Retrieval
par: Chen, Yinda, et autres
Publié: (2024)
par: Chen, Yinda, et autres
Publié: (2024)
Wasserstein-Aligned Localisation for VLM-Based Distributional OOD Detection in Medical Imaging
par: Kainz, Bernhard, et autres
Publié: (2026)
par: Kainz, Bernhard, et autres
Publié: (2026)
Denoising Diffusion Models for Anomaly Localization in Medical Images
par: Bercea, Cosmin I., et autres
Publié: (2024)
par: Bercea, Cosmin I., et autres
Publié: (2024)
Can Medical Vision-Language Pre-training Succeed with Purely Synthetic Data?
par: Liu, Che, et autres
Publié: (2024)
par: Liu, Che, et autres
Publié: (2024)
Diffusion Models with Implicit Guidance for Medical Anomaly Detection
par: Bercea, Cosmin I., et autres
Publié: (2024)
par: Bercea, Cosmin I., et autres
Publié: (2024)
Semantic Alignment of Unimodal Medical Text and Vision Representations
par: Di Folco, Maxime, et autres
Publié: (2025)
par: Di Folco, Maxime, et autres
Publié: (2025)
IMITATE: Clinical Prior Guided Hierarchical Vision-Language Pre-training
par: Liu, Che, et autres
Publié: (2023)
par: Liu, Che, et autres
Publié: (2023)
G2D: From Global to Dense Radiography Representation Learning via Vision-Language Pre-training
par: Liu, Che, et autres
Publié: (2023)
par: Liu, Che, et autres
Publié: (2023)
Ice-FMBench: A Foundation Model Benchmark for Sea Ice Type Segmentation
par: Taleghan, Samira Alkaee, et autres
Publié: (2025)
par: Taleghan, Samira Alkaee, et autres
Publié: (2025)
BOTM: Echocardiography Segmentation via Bi-directional Optimal Token Matching
par: Liu, Zhihua, et autres
Publié: (2025)
par: Liu, Zhihua, et autres
Publié: (2025)
Fair-MoE: Fairness-Oriented Mixture of Experts in Vision-Language Models
par: Wang, Peiran, et autres
Publié: (2025)
par: Wang, Peiran, et autres
Publié: (2025)
Towards Universal Unsupervised Anomaly Detection in Medical Imaging
par: Bercea, Cosmin I., et autres
Publié: (2024)
par: Bercea, Cosmin I., et autres
Publié: (2024)
ST-Think: How Multimodal Large Language Models Reason About 4D Worlds from Ego-Centric Videos
par: Wu, Peiran, et autres
Publié: (2025)
par: Wu, Peiran, et autres
Publié: (2025)
Noise2Noise Denoising of CRISM Hyperspectral Data
par: Platt, Robert, et autres
Publié: (2024)
par: Platt, Robert, et autres
Publié: (2024)
Influence of Classification Task and Distribution Shift Type on OOD Detection in Fetal Ultrasound
par: Wong, Chun Kit, et autres
Publié: (2025)
par: Wong, Chun Kit, et autres
Publié: (2025)
Med-UniC: Unifying Cross-Lingual Medical Vision-Language Pre-Training by Diminishing Bias
par: Wan, Zhongwei, et autres
Publié: (2023)
par: Wan, Zhongwei, et autres
Publié: (2023)
Language Models Meet Anomaly Detection for Better Interpretability and Generalizability
par: Li, Jun, et autres
Publié: (2024)
par: Li, Jun, et autres
Publié: (2024)
FairMedFM: Fairness Benchmarking for Medical Imaging Foundation Models
par: Jin, Ruinan, et autres
Publié: (2024)
par: Jin, Ruinan, et autres
Publié: (2024)
Interpretable Bilingual Multimodal Large Language Model for Diverse Biomedical Tasks
par: Wang, Lehan, et autres
Publié: (2024)
par: Wang, Lehan, et autres
Publié: (2024)
LMOD: A Large Multimodal Ophthalmology Dataset and Benchmark for Large Vision-Language Models
par: Qin, Zhenyue, et autres
Publié: (2024)
par: Qin, Zhenyue, et autres
Publié: (2024)
Interpretable Representation Learning of Cardiac MRI via Attribute Regularization
par: Di Folco, Maxime, et autres
Publié: (2024)
par: Di Folco, Maxime, et autres
Publié: (2024)
MIHBench: Benchmarking and Mitigating Multi-Image Hallucinations in Multimodal Large Language Models
par: Li, Jiale, et autres
Publié: (2025)
par: Li, Jiale, et autres
Publié: (2025)
SHIELD : An Evaluation Benchmark for Face Spoofing and Forgery Detection with Multimodal Large Language Models
par: Shi, Yichen, et autres
Publié: (2024)
par: Shi, Yichen, et autres
Publié: (2024)
Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space
par: Trinh, Quoc-Huy, et autres
Publié: (2026)
par: Trinh, Quoc-Huy, et autres
Publié: (2026)
Benchmarking Egocentric Clinical Intent Understanding Capability for Medical Multimodal Large Language Models
par: Liu, Shaonan, et autres
Publié: (2026)
par: Liu, Shaonan, et autres
Publié: (2026)
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
par: Ding, Meidan, et autres
Publié: (2025)
par: Ding, Meidan, et autres
Publié: (2025)
MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models
par: Fu, Chaoyou, et autres
Publié: (2023)
par: Fu, Chaoyou, et autres
Publié: (2023)
VP-Bench: A Comprehensive Benchmark for Visual Prompting in Multimodal Large Language Models
par: Xu, Mingjie, et autres
Publié: (2025)
par: Xu, Mingjie, et autres
Publié: (2025)
LMOD+: A Comprehensive Multimodal Dataset and Benchmark for Developing and Evaluating Multimodal Large Language Models in Ophthalmology
par: Qin, Zhenyue, et autres
Publié: (2025)
par: Qin, Zhenyue, et autres
Publié: (2025)
Task Preference Optimization: Improving Multimodal Large Language Models with Vision Task Alignment
par: Yan, Ziang, et autres
Publié: (2024)
par: Yan, Ziang, et autres
Publié: (2024)
LocBAM: Advancing 3D Patch-Based Image Segmentation by Integrating Location Contex
par: Hooft, Donnate, et autres
Publié: (2026)
par: Hooft, Donnate, et autres
Publié: (2026)
Demystifying the Visual Quality Paradox in Multimodal Large Language Models
par: Xing, Shuo, et autres
Publié: (2025)
par: Xing, Shuo, et autres
Publié: (2025)
Documents similaires
-
Enhancing Abnormality Grounding for Vision Language Models with Knowledge Descriptions
par: Li, Jun, et autres
Publié: (2025) -
Knowledge to Sight: Reasoning over Visual Attributes via Knowledge Decomposition for Abnormality Grounding
par: Li, Jun, et autres
Publié: (2025) -
How Does Diverse Interpretability of Textual Prompts Impact Medical Vision-Language Zero-Shot Tasks?
par: Wang, Sicheng, et autres
Publié: (2024) -
How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study
par: Liu, Che, et autres
Publié: (2025) -
Utilizing Synthetic Data for Medical Vision-Language Pre-training: Bypassing the Need for Real Images
par: Liu, Che, et autres
Publié: (2023)