MedExQA: Medical Question Answering Benchmark with Multiple Explanations
Fuente:
arXiv
Salvato in:
| Autori principali: | Kim, Yunsoo, Wu, Jinge, Abdulle, Yusuf, Wu, Honghan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hallucination Benchmark in Medical Visual Question Answering
di: Wu, Jinge, et al.
Pubblicazione: (2024)
di: Wu, Jinge, et al.
Pubblicazione: (2024)
Enhancing Human-Computer Interaction in Chest X-ray Analysis using Vision and Language Model with Eye Gaze Patterns
di: Kim, Yunsoo, et al.
Pubblicazione: (2024)
di: Kim, Yunsoo, et al.
Pubblicazione: (2024)
BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain
di: Kim, Yunsoo, et al.
Pubblicazione: (2025)
di: Kim, Yunsoo, et al.
Pubblicazione: (2025)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
di: Wei, Jianhui, et al.
Pubblicazione: (2025)
di: Wei, Jianhui, et al.
Pubblicazione: (2025)
SLaVA-CXR: Small Language and Vision Assistant for Chest X-ray Report Automation
di: Wu, Jinge, et al.
Pubblicazione: (2024)
di: Wu, Jinge, et al.
Pubblicazione: (2024)
Adversarial Attacks on VQA-NLE: Exposing and Alleviating Inconsistencies in Visual Question Answering Explanations
di: Yeh, Yahsin, et al.
Pubblicazione: (2025)
di: Yeh, Yahsin, et al.
Pubblicazione: (2025)
LLM-MedQA: Enhancing Medical Question Answering through Case Studies in Large Language Models
di: Yang, Hang, et al.
Pubblicazione: (2024)
di: Yang, Hang, et al.
Pubblicazione: (2024)
PerMedCQA: Benchmarking Large Language Models on Medical Consumer Question Answering in Persian Language
di: Jamali, Naghmeh, et al.
Pubblicazione: (2025)
di: Jamali, Naghmeh, et al.
Pubblicazione: (2025)
SensorQA: A Question Answering Benchmark for Daily-Life Monitoring
di: Reichman, Benjamin, et al.
Pubblicazione: (2025)
di: Reichman, Benjamin, et al.
Pubblicazione: (2025)
RJUA-MedDQA: A Multimodal Benchmark for Medical Document Question Answering and Clinical Reasoning
di: Jin, Congyun, et al.
Pubblicazione: (2024)
di: Jin, Congyun, et al.
Pubblicazione: (2024)
MedPAIR: Measuring Physicians and AI Relevance Alignment in Medical Question Answering
di: Hao, Yuexing, et al.
Pubblicazione: (2025)
di: Hao, Yuexing, et al.
Pubblicazione: (2025)
A Benchmark for Long-Form Medical Question Answering
di: Hosseini, Pedram, et al.
Pubblicazione: (2024)
di: Hosseini, Pedram, et al.
Pubblicazione: (2024)
MedHopQA: A Disease-Centered Multi-Hop Reasoning Benchmark and Evaluation Framework for LLM-Based Biomedical Question Answering
di: Islamaj, Rezarta, et al.
Pubblicazione: (2026)
di: Islamaj, Rezarta, et al.
Pubblicazione: (2026)
MedLM: Exploring Language Models for Medical Question Answering Systems
di: Yagnik, Niraj, et al.
Pubblicazione: (2024)
di: Yagnik, Niraj, et al.
Pubblicazione: (2024)
RadEyeVideo: Enhancing general-domain Large Vision Language Model for chest X-ray analysis with video representations of eye gaze
di: Kim, Yunsoo, et al.
Pubblicazione: (2025)
di: Kim, Yunsoo, et al.
Pubblicazione: (2025)
RepLiQA: A Question-Answering Dataset for Benchmarking LLMs on Unseen Reference Content
di: Monteiro, Joao, et al.
Pubblicazione: (2024)
di: Monteiro, Joao, et al.
Pubblicazione: (2024)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
di: Mastrokostas, Charalampos, et al.
Pubblicazione: (2026)
di: Mastrokostas, Charalampos, et al.
Pubblicazione: (2026)
Uncertainty Estimation of Large Language Models in Medical Question Answering
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
MizanQA: Benchmarking Large Language Models on Moroccan Legal Question Answering
di: Bahaj, Adil, et al.
Pubblicazione: (2025)
di: Bahaj, Adil, et al.
Pubblicazione: (2025)
Collaboration among Multiple Large Language Models for Medical Question Answering
di: Shang, Kexin, et al.
Pubblicazione: (2025)
di: Shang, Kexin, et al.
Pubblicazione: (2025)
MedBioRAG: Semantic Search and Retrieval-Augmented Generation with Large Language Models for Medical and Biological QA
di: Kim, Seonok
Pubblicazione: (2025)
di: Kim, Seonok
Pubblicazione: (2025)
To Reason or Not to: Selective Chain-of-Thought in Medical Question Answering
di: Zhan, Zaifu, et al.
Pubblicazione: (2026)
di: Zhan, Zaifu, et al.
Pubblicazione: (2026)
WikiMixQA: A Multimodal Benchmark for Question Answering over Tables and Charts
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
FanOutQA: A Multi-Hop, Multi-Document Question Answering Benchmark for Large Language Models
di: Zhu, Andrew, et al.
Pubblicazione: (2024)
di: Zhu, Andrew, et al.
Pubblicazione: (2024)
MedBioLM: Optimizing Medical and Biological QA with Fine-Tuned Large Language Models and Retrieval-Augmented Generation
di: Kim, Seonok
Pubblicazione: (2025)
di: Kim, Seonok
Pubblicazione: (2025)
QA-TOOLBOX: Conversational Question-Answering for process task guidance in manufacturing
di: Manuvinakurike, Ramesh, et al.
Pubblicazione: (2024)
di: Manuvinakurike, Ramesh, et al.
Pubblicazione: (2024)
pdfQA: Diverse, Challenging, and Realistic Question Answering over PDFs
di: Schimanski, Tobias, et al.
Pubblicazione: (2026)
di: Schimanski, Tobias, et al.
Pubblicazione: (2026)
MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding
di: Zuo, Yuxin, et al.
Pubblicazione: (2025)
di: Zuo, Yuxin, et al.
Pubblicazione: (2025)
Memory-QA: Answering Recall Questions Based on Multimodal Memories
di: Jiang, Hongda, et al.
Pubblicazione: (2025)
di: Jiang, Hongda, et al.
Pubblicazione: (2025)
From Retrieval to Generation: Unifying External and Parametric Knowledge for Medical Question Answering
di: Li, Lei, et al.
Pubblicazione: (2025)
di: Li, Lei, et al.
Pubblicazione: (2025)
Biomedical Entity Linking as Multiple Choice Question Answering
di: Lin, Zhenxi, et al.
Pubblicazione: (2024)
di: Lin, Zhenxi, et al.
Pubblicazione: (2024)
KoBBQ: Korean Bias Benchmark for Question Answering
di: Jin, Jiho, et al.
Pubblicazione: (2023)
di: Jin, Jiho, et al.
Pubblicazione: (2023)
FairMedQA: Benchmarking Bias in Large Language Models for Medical Question Answering
di: Xiao, Ying, et al.
Pubblicazione: (2025)
di: Xiao, Ying, et al.
Pubblicazione: (2025)
FinTextQA: A Dataset for Long-form Financial Question Answering
di: Chen, Jian, et al.
Pubblicazione: (2024)
di: Chen, Jian, et al.
Pubblicazione: (2024)
Look & Mark: Leveraging Radiologist Eye Fixations and Bounding boxes in Multimodal Large Language Models for Chest X-ray Report Generation
di: Kim, Yunsoo, et al.
Pubblicazione: (2025)
di: Kim, Yunsoo, et al.
Pubblicazione: (2025)
ExpliCIT-QA: Explainable Code-Based Image Table Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
Improving LLM Reliability with RAG in Religious Question-Answering: MufassirQAS
di: Alan, Ahmet Yusuf, et al.
Pubblicazione: (2024)
di: Alan, Ahmet Yusuf, et al.
Pubblicazione: (2024)
Efficient Medical Question Answering with Knowledge-Augmented Question Generation
di: Khlaut, Julien, et al.
Pubblicazione: (2024)
di: Khlaut, Julien, et al.
Pubblicazione: (2024)
MedExpQA: Multilingual Benchmarking of Large Language Models for Medical Question Answering
di: Alonso, Iñigo, et al.
Pubblicazione: (2024)
di: Alonso, Iñigo, et al.
Pubblicazione: (2024)
MMToM-QA: Multimodal Theory of Mind Question Answering
di: Jin, Chuanyang, et al.
Pubblicazione: (2024)
di: Jin, Chuanyang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Hallucination Benchmark in Medical Visual Question Answering
di: Wu, Jinge, et al.
Pubblicazione: (2024) -
Enhancing Human-Computer Interaction in Chest X-ray Analysis using Vision and Language Model with Eye Gaze Patterns
di: Kim, Yunsoo, et al.
Pubblicazione: (2024) -
BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain
di: Kim, Yunsoo, et al.
Pubblicazione: (2025) -
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
di: Wei, Jianhui, et al.
Pubblicazione: (2025) -
SLaVA-CXR: Small Language and Vision Assistant for Chest X-ray Report Automation
di: Wu, Jinge, et al.
Pubblicazione: (2024)