Barriers in Integrating Medical Visual Question Answering into Radiology Workflows: A Scoping Review and Clinicians' Insights
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mishra, Deepali, Silpasuwanchai, Chaklam, Modi, Ashutosh, Sushil, Madhumita, Chumnanvej, Sorayouth |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models
par: Shah, Arya, et autres
Publié: (2026)
par: Shah, Arya, et autres
Publié: (2026)
SycoPhantasy: Quantifying Sycophancy and Hallucination in Small Open Weight VLMs for Vision-Language Scoring of Fantasy Characters
par: Shah, Arya, et autres
Publié: (2026)
par: Shah, Arya, et autres
Publié: (2026)
UCSF-PDGM-VQA: Visual Question Answering dataset for brain tumor MRI interpretation
par: Ghosh, Shiv, et autres
Publié: (2026)
par: Ghosh, Shiv, et autres
Publié: (2026)
From Overload to Convergence: Supporting Multi-Issue Human-AI Negotiation with Bayesian Visualization
par: Parmar, Mehul, et autres
Publié: (2026)
par: Parmar, Mehul, et autres
Publié: (2026)
Gaslight, Gatekeep, V1-V3: Early Visual Cortex Alignment Shields Vision-Language Models from Sycophantic Manipulation
par: Shah, Arya, et autres
Publié: (2026)
par: Shah, Arya, et autres
Publié: (2026)
Grounding Chest X-Ray Visual Question Answering with Generated Radiology Reports
par: Serra, Francesco Dalla, et autres
Publié: (2025)
par: Serra, Francesco Dalla, et autres
Publié: (2025)
Hallucination Benchmark in Medical Visual Question Answering
par: Wu, Jinge, et autres
Publié: (2024)
par: Wu, Jinge, et autres
Publié: (2024)
DermaBench: A Clinician-Annotated Benchmark Dataset for Dermatology Visual Question Answering and Reasoning
par: Yilmaz, Abdurrahim, et autres
Publié: (2026)
par: Yilmaz, Abdurrahim, et autres
Publié: (2026)
Multimodal Integration of Human-Like Attention in Visual Question Answering
par: Sood, Ekta, et autres
Publié: (2021)
par: Sood, Ekta, et autres
Publié: (2021)
Advancing Vietnamese Visual Question Answering with Transformer and Convolutional Integration
par: Nguyen, Ngoc Son, et autres
Publié: (2024)
par: Nguyen, Ngoc Son, et autres
Publié: (2024)
Selectively Answering Visual Questions
par: Eisenschlos, Julian Martin, et autres
Publié: (2024)
par: Eisenschlos, Julian Martin, et autres
Publié: (2024)
How Good LLMs Are at Answering Bangla Medical Visual Questions? Dataset and Benchmarking
par: Ahmed, Rafid, et autres
Publié: (2026)
par: Ahmed, Rafid, et autres
Publié: (2026)
LaPA: Latent Prompt Assist Model For Medical Visual Question Answering
par: Gu, Tiancheng, et autres
Publié: (2024)
par: Gu, Tiancheng, et autres
Publié: (2024)
Fusion of Domain-Adapted Vision and Language Models for Medical Visual Question Answering
par: Ha, Cuong Nhat, et autres
Publié: (2024)
par: Ha, Cuong Nhat, et autres
Publié: (2024)
Free Form Medical Visual Question Answering in Radiology
par: Narayanan, Abhishek, et autres
Publié: (2024)
par: Narayanan, Abhishek, et autres
Publié: (2024)
MOTOR: Multimodal Optimal Transport via Grounded Retrieval in Medical Visual Question Answering
par: Shaaban, Mai A., et autres
Publié: (2025)
par: Shaaban, Mai A., et autres
Publié: (2025)
RadImageNet-VQA: A Large-Scale CT and MRI Dataset for Radiologic Visual Question Answering
par: Butsanets, Léo, et autres
Publié: (2025)
par: Butsanets, Léo, et autres
Publié: (2025)
Integrating Image Features with Convolutional Sequence-to-sequence Network for Multilingual Visual Question Answering
par: Thai, Triet Minh, et autres
Publié: (2023)
par: Thai, Triet Minh, et autres
Publié: (2023)
A Gaze-grounded Visual Question Answering Dataset for Clarifying Ambiguous Japanese Questions
par: Inadumi, Shun, et autres
Publié: (2024)
par: Inadumi, Shun, et autres
Publié: (2024)
CommVQA: Situating Visual Question Answering in Communicative Contexts
par: Naik, Nandita Shankar, et autres
Publié: (2024)
par: Naik, Nandita Shankar, et autres
Publié: (2024)
GeReA: Question-Aware Prompt Captions for Knowledge-based Visual Question Answering
par: Ma, Ziyu, et autres
Publié: (2024)
par: Ma, Ziyu, et autres
Publié: (2024)
Computed Tomography Visual Question Answering with Cross-modal Feature Graphing
par: Tian, Yuanhe, et autres
Publié: (2025)
par: Tian, Yuanhe, et autres
Publié: (2025)
Large Vision-Language Models for Remote Sensing Visual Question Answering
par: Siripong, Surasakdi, et autres
Publié: (2024)
par: Siripong, Surasakdi, et autres
Publié: (2024)
Design as Desired: Utilizing Visual Question Answering for Multimodal Pre-training
par: Su, Tongkun, et autres
Publié: (2024)
par: Su, Tongkun, et autres
Publié: (2024)
Investigating Prompting Techniques for Zero- and Few-Shot Visual Question Answering
par: Awal, Rabiul, et autres
Publié: (2023)
par: Awal, Rabiul, et autres
Publié: (2023)
AIM: Asymmetric Information Masking for Visual Question Answering Continual Learning
par: Zhang, Peifeng, et autres
Publié: (2026)
par: Zhang, Peifeng, et autres
Publié: (2026)
Overcoming Language Priors for Visual Question Answering Based on Knowledge Distillation
par: Peng, Daowan, et autres
Publié: (2025)
par: Peng, Daowan, et autres
Publié: (2025)
Prompting Medical Large Vision-Language Models to Diagnose Pathologies by Visual Question Answering
par: Guo, Danfeng, et autres
Publié: (2024)
par: Guo, Danfeng, et autres
Publié: (2024)
Towards Perceiving Small Visual Details in Zero-shot Visual Question Answering with Multimodal LLMs
par: Zhang, Jiarui, et autres
Publié: (2023)
par: Zhang, Jiarui, et autres
Publié: (2023)
Natural Language Understanding and Inference with MLLM in Visual Question Answering: A Survey
par: Kuang, Jiayi, et autres
Publié: (2024)
par: Kuang, Jiayi, et autres
Publié: (2024)
ChitroJera: A Regionally Relevant Visual Question Answering Dataset for Bangla
par: Barua, Deeparghya Dutta, et autres
Publié: (2024)
par: Barua, Deeparghya Dutta, et autres
Publié: (2024)
LOVA3: Learning to Visual Question Answering, Asking and Assessment
par: Zhao, Henry Hengyuan, et autres
Publié: (2024)
par: Zhao, Henry Hengyuan, et autres
Publié: (2024)
Exploring Diverse Methods in Visual Question Answering
par: Li, Panfeng, et autres
Publié: (2024)
par: Li, Panfeng, et autres
Publié: (2024)
When Big Models Train Small Ones: Label-Free Model Parity Alignment for Efficient Visual Question Answering using Small VLMs
par: Penamakuri, Abhirama Subramanyam, et autres
Publié: (2025)
par: Penamakuri, Abhirama Subramanyam, et autres
Publié: (2025)
Relevance-aware Multi-context Contrastive Decoding for Retrieval-augmented Visual Question Answering
par: Kim, Jongha, et autres
Publié: (2026)
par: Kim, Jongha, et autres
Publié: (2026)
Dynamic Clue Bottlenecks: Towards Interpretable-by-Design Visual Question Answering
par: Fu, Xingyu, et autres
Publié: (2023)
par: Fu, Xingyu, et autres
Publié: (2023)
II-MMR: Identifying and Improving Multi-modal Multi-hop Reasoning in Visual Question Answering
par: Kil, Jihyung, et autres
Publié: (2024)
par: Kil, Jihyung, et autres
Publié: (2024)
PDF-MVQA: A Dataset for Multimodal Information Retrieval in PDF-based Visual Question Answering
par: Ding, Yihao, et autres
Publié: (2024)
par: Ding, Yihao, et autres
Publié: (2024)
Pretraining Vision-Language Model for Difference Visual Question Answering in Longitudinal Chest X-rays
par: Cho, Yeongjae, et autres
Publié: (2024)
par: Cho, Yeongjae, et autres
Publié: (2024)
VQA-MHUG: A Gaze Dataset to Study Multimodal Neural Attention in Visual Question Answering
par: Sood, Ekta, et autres
Publié: (2021)
par: Sood, Ekta, et autres
Publié: (2021)
Documents similaires
-
Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models
par: Shah, Arya, et autres
Publié: (2026) -
SycoPhantasy: Quantifying Sycophancy and Hallucination in Small Open Weight VLMs for Vision-Language Scoring of Fantasy Characters
par: Shah, Arya, et autres
Publié: (2026) -
UCSF-PDGM-VQA: Visual Question Answering dataset for brain tumor MRI interpretation
par: Ghosh, Shiv, et autres
Publié: (2026) -
From Overload to Convergence: Supporting Multi-Issue Human-AI Negotiation with Bayesian Visualization
par: Parmar, Mehul, et autres
Publié: (2026) -
Gaslight, Gatekeep, V1-V3: Early Visual Cortex Alignment Shields Vision-Language Models from Sycophantic Manipulation
par: Shah, Arya, et autres
Publié: (2026)