XBench: A Comprehensive Benchmark for Visual-Language Explanations in Chest Radiography
Fuente:
arXiv
Saved in:
| Main Authors: | Luo, Haozhe, Shu, Shelley Zixin, Zhou, Ziyu, Otalora, Sebastian, Reyes, Mauricio |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Hybrid Explanation-Guided Learning for Transformer-Based Chest X-Ray Diagnosis
by: Shu, Shelley Zixin, et al.
Published: (2025)
by: Shu, Shelley Zixin, et al.
Published: (2025)
On the Interplay of Human-AI Alignment,Fairness, and Performance Trade-offs in Medical Imaging
by: Luo, Haozhe, et al.
Published: (2025)
by: Luo, Haozhe, et al.
Published: (2025)
KEPIL: Knowledge-Enhanced Prompt-Image Learning for Prompt-Robust Disease Detection
by: Luo, Haozhe, et al.
Published: (2026)
by: Luo, Haozhe, et al.
Published: (2026)
Learning Anatomically Consistent Embedding for Chest Radiography
by: Zhou, Ziyu, et al.
Published: (2023)
by: Zhou, Ziyu, et al.
Published: (2023)
Beyond the First Read: AI-Assisted Perceptual Error Detection in Chest Radiography Accounting for Interobserver Variability
by: Vutukuri, Adhrith, et al.
Published: (2025)
by: Vutukuri, Adhrith, et al.
Published: (2025)
WeNLEX: Weakly Supervised Natural Language Explanations for Multilabel Chest X-ray Classification
by: Rio-Torto, Isabel, et al.
Published: (2026)
by: Rio-Torto, Isabel, et al.
Published: (2026)
A Generative Foundation Model for Chest Radiography
by: Ji, Yuanfeng, et al.
Published: (2025)
by: Ji, Yuanfeng, et al.
Published: (2025)
SurgXBench: Explainable Vision-Language Model Benchmark for Surgery
by: Cheng, Jiajun, et al.
Published: (2025)
by: Cheng, Jiajun, et al.
Published: (2025)
Towards A Comprehensive Visual Saliency Explanation Framework for AI-based Face Recognition Systems
by: Lu, Yuhang, et al.
Published: (2024)
by: Lu, Yuhang, et al.
Published: (2024)
Weakly Supervised Pneumonia Localization from Chest X-Rays Using Deep Neural Network and Grad-CAM Explanations
by: Shahi, Kiran, et al.
Published: (2025)
by: Shahi, Kiran, et al.
Published: (2025)
Rethinking Visual Attribution for Chest X-ray Reasoning in Large Vision Language Models
by: Xiong, Guangzhi, et al.
Published: (2026)
by: Xiong, Guangzhi, et al.
Published: (2026)
Random Direct Preference Optimization for Radiography Report Generation
by: Samokhin, Valentin, et al.
Published: (2025)
by: Samokhin, Valentin, et al.
Published: (2025)
On The Coherence of Quantitative Evaluation of Visual Explanations
by: Vandersmissen, Benjamin, et al.
Published: (2023)
by: Vandersmissen, Benjamin, et al.
Published: (2023)
Visual Para-Thinker: Divide-and-Conquer Reasoning for Visual Comprehension
by: Xu, Haoran, et al.
Published: (2026)
by: Xu, Haoran, et al.
Published: (2026)
CLDTracker: A Comprehensive Language Description for Visual Tracking
by: Alansari, Mohamad, et al.
Published: (2025)
by: Alansari, Mohamad, et al.
Published: (2025)
CXReasonBench: A Benchmark for Evaluating Structured Diagnostic Reasoning in Chest X-rays
by: Lee, Hyungyung, et al.
Published: (2025)
by: Lee, Hyungyung, et al.
Published: (2025)
Decomposing Complex Visual Comprehension into Atomic Visual Skills for Vision Language Models
by: Chae, Hyunsik, et al.
Published: (2025)
by: Chae, Hyunsik, et al.
Published: (2025)
BenchCAD: A Comprehensive, Industry-Standard Benchmark for Programmatic CAD
by: Zhang, Haozhe, et al.
Published: (2026)
by: Zhang, Haozhe, et al.
Published: (2026)
CDH-Bench: A Commonsense-Driven Hallucination Benchmark for Evaluating Visual Fidelity in Vision-Language Models
by: Chen, Kesheng, et al.
Published: (2026)
by: Chen, Kesheng, et al.
Published: (2026)
MMAD: A Comprehensive Benchmark for Multimodal Large Language Models in Industrial Anomaly Detection
by: Jiang, Xi, et al.
Published: (2024)
by: Jiang, Xi, et al.
Published: (2024)
ERGeoBench:A Comprehensive Benchmark for Embodied Reasoning and Geo-localization in Multimodal Large Language Models
by: Xue, Kaiwen, et al.
Published: (2026)
by: Xue, Kaiwen, et al.
Published: (2026)
PunchBench: Benchmarking MLLMs in Multimodal Punchline Comprehension
by: Ouyang, Kun, et al.
Published: (2024)
by: Ouyang, Kun, et al.
Published: (2024)
Argus: Benchmarking and Enhancing Vision-Language Models for 3D Radiology Report Generation
by: Liu, Che, et al.
Published: (2024)
by: Liu, Che, et al.
Published: (2024)
From Illusion to Intention: Visual Rationale Learning for Vision-Language Reasoning
by: Wang, Changpeng, et al.
Published: (2025)
by: Wang, Changpeng, et al.
Published: (2025)
CRRG-CLIP: Automatic Generation of Chest Radiology Reports and Classification of Chest Radiographs
by: Xu, Jianfei, et al.
Published: (2024)
by: Xu, Jianfei, et al.
Published: (2024)
Explanation-Driven Counterfactual Testing for Faithfulness in Vision-Language Model Explanations
by: Ding, Sihao, et al.
Published: (2025)
by: Ding, Sihao, et al.
Published: (2025)
Rethinking Visual Counterfactual Explanations Through Region Constraint
by: Sobieski, Bartlomiej, et al.
Published: (2024)
by: Sobieski, Bartlomiej, et al.
Published: (2024)
Following the Diagnostic Trace: Visual Cognition-guided Cooperative Network for Chest X-Ray Diagnosis
by: Wu, Shaoxuan, et al.
Published: (2026)
by: Wu, Shaoxuan, et al.
Published: (2026)
H2VU-Benchmark: A Comprehensive Benchmark for Hierarchical Holistic Video Understanding
by: Wu, Qi, et al.
Published: (2025)
by: Wu, Qi, et al.
Published: (2025)
Video-RAG: Visually-aligned Retrieval-Augmented Long Video Comprehension
by: Luo, Yongdong, et al.
Published: (2024)
by: Luo, Yongdong, et al.
Published: (2024)
VLM-RobustBench: A Comprehensive Benchmark for Robustness of Vision-Language Models
by: Saxena, Rohit, et al.
Published: (2026)
by: Saxena, Rohit, et al.
Published: (2026)
V-CECE: Visual Counterfactual Explanations via Conceptual Edits
by: Spanos, Nikolaos, et al.
Published: (2025)
by: Spanos, Nikolaos, et al.
Published: (2025)
GEMeX: A Large-Scale, Groundable, and Explainable Medical VQA Benchmark for Chest X-ray Diagnosis
by: Liu, Bo, et al.
Published: (2024)
by: Liu, Bo, et al.
Published: (2024)
Anatomically-Grounded Fact Checking of Automated Chest X-ray Reports
by: Mahmood, R., et al.
Published: (2024)
by: Mahmood, R., et al.
Published: (2024)
Chest X-ray Pneumothorax Segmentation Using EfficientNet-B4 Transfer Learning in a U-Net Architecture
by: Roque, Alvaro Aranibar, et al.
Published: (2025)
by: Roque, Alvaro Aranibar, et al.
Published: (2025)
Perceiving Beyond Language Priors: Enhancing Visual Comprehension and Attention in Multimodal Models
by: Ghatkesar, Aarti, et al.
Published: (2025)
by: Ghatkesar, Aarti, et al.
Published: (2025)
SciVerse: Unveiling the Knowledge Comprehension and Visual Reasoning of LMMs on Multi-modal Scientific Problems
by: Guo, Ziyu, et al.
Published: (2025)
by: Guo, Ziyu, et al.
Published: (2025)
VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model
by: Wang, Sibo, et al.
Published: (2024)
by: Wang, Sibo, et al.
Published: (2024)
Grounded Knowledge-Enhanced Medical Vision-Language Pre-training for Chest X-Ray
by: Deng, Qiao, et al.
Published: (2024)
by: Deng, Qiao, et al.
Published: (2024)
From Pixels to Explanations: Interpretable Diabetic Retinopathy Grading with CNN-Transformer Ensembles, Visual Explainability and Vision-Language Models
by: Khokhar, Pir Bakhsh, et al.
Published: (2026)
by: Khokhar, Pir Bakhsh, et al.
Published: (2026)
Similar Items
-
Hybrid Explanation-Guided Learning for Transformer-Based Chest X-Ray Diagnosis
by: Shu, Shelley Zixin, et al.
Published: (2025) -
On the Interplay of Human-AI Alignment,Fairness, and Performance Trade-offs in Medical Imaging
by: Luo, Haozhe, et al.
Published: (2025) -
KEPIL: Knowledge-Enhanced Prompt-Image Learning for Prompt-Robust Disease Detection
by: Luo, Haozhe, et al.
Published: (2026) -
Learning Anatomically Consistent Embedding for Chest Radiography
by: Zhou, Ziyu, et al.
Published: (2023) -
Beyond the First Read: AI-Assisted Perceptual Error Detection in Chest Radiography Accounting for Interobserver Variability
by: Vutukuri, Adhrith, et al.
Published: (2025)