MedExpQA: Multilingual Benchmarking of Large Language Models for Medical Question Answering
Fuente:
arXiv
Salvato in:
| Autori principali: | Alonso, Iñigo, Oronoz, Maite, Agerri, Rodrigo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Effects of Cross-lingual Evidence in Multilingual Medical Question Answering
di: Yeginbergen, Anar, et al.
Pubblicazione: (2026)
di: Yeginbergen, Anar, et al.
Pubblicazione: (2026)
Dynamic Knowledge Integration for Evidence-Driven Counter-Argument Generation with Large Language Models
di: Yeginbergen, Anar, et al.
Pubblicazione: (2025)
di: Yeginbergen, Anar, et al.
Pubblicazione: (2025)
Multilingual Medical Reasoning for Question Answering with Large Language Models
di: Ferrazzi, Pietro, et al.
Pubblicazione: (2025)
di: Ferrazzi, Pietro, et al.
Pubblicazione: (2025)
Argument Mining in Data Scarce Settings: Cross-lingual Transfer and Few-shot Techniques
di: Yeginbergen, Anar, et al.
Pubblicazione: (2024)
di: Yeginbergen, Anar, et al.
Pubblicazione: (2024)
MedExQA: Medical Question Answering Benchmark with Multiple Explanations
di: Kim, Yunsoo, et al.
Pubblicazione: (2024)
di: Kim, Yunsoo, et al.
Pubblicazione: (2024)
Benchmarking Critical Questions Generation: A Challenging Reasoning Task for Large Language Models
di: Figueras, Banca Calvo, et al.
Pubblicazione: (2025)
di: Figueras, Banca Calvo, et al.
Pubblicazione: (2025)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
di: Mastrokostas, Charalampos, et al.
Pubblicazione: (2026)
di: Mastrokostas, Charalampos, et al.
Pubblicazione: (2026)
LLM-MedQA: Enhancing Medical Question Answering through Case Studies in Large Language Models
di: Yang, Hang, et al.
Pubblicazione: (2024)
di: Yang, Hang, et al.
Pubblicazione: (2024)
AfriMed-QA: A Pan-African, Multi-Specialty, Medical Question-Answering Benchmark Dataset
di: Olatunji, Tobi, et al.
Pubblicazione: (2024)
di: Olatunji, Tobi, et al.
Pubblicazione: (2024)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
di: Wei, Jianhui, et al.
Pubblicazione: (2025)
di: Wei, Jianhui, et al.
Pubblicazione: (2025)
PerMedCQA: Benchmarking Large Language Models on Medical Consumer Question Answering in Persian Language
di: Jamali, Naghmeh, et al.
Pubblicazione: (2025)
di: Jamali, Naghmeh, et al.
Pubblicazione: (2025)
MedAraBench: Large-Scale Arabic Medical Question Answering Dataset and Benchmark
di: Abu-Daoud, Mouath, et al.
Pubblicazione: (2026)
di: Abu-Daoud, Mouath, et al.
Pubblicazione: (2026)
MedREQAL: Examining Medical Knowledge Recall of Large Language Models via Question Answering
di: Vladika, Juraj, et al.
Pubblicazione: (2024)
di: Vladika, Juraj, et al.
Pubblicazione: (2024)
PeruMedQA: Benchmarking Large Language Models (LLMs) on Peruvian Medical Exams -- Dataset Construction and Evaluation
di: Carrillo-Larco, Rodrigo M., et al.
Pubblicazione: (2025)
di: Carrillo-Larco, Rodrigo M., et al.
Pubblicazione: (2025)
MizanQA: Benchmarking Large Language Models on Moroccan Legal Question Answering
di: Bahaj, Adil, et al.
Pubblicazione: (2025)
di: Bahaj, Adil, et al.
Pubblicazione: (2025)
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
di: Chen, Hanjie, et al.
Pubblicazione: (2024)
di: Chen, Hanjie, et al.
Pubblicazione: (2024)
M2QA: Multi-domain Multilingual Question Answering
di: Engländer, Leon, et al.
Pubblicazione: (2024)
di: Engländer, Leon, et al.
Pubblicazione: (2024)
MedFuzz: Exploring the Robustness of Large Language Models in Medical Question Answering
di: Ness, Robert Osazuwa, et al.
Pubblicazione: (2024)
di: Ness, Robert Osazuwa, et al.
Pubblicazione: (2024)
CasiMedicos-Arg: A Medical Question Answering Dataset Annotated with Explanatory Argumentative Structures
di: Sviridova, Ekaterina, et al.
Pubblicazione: (2024)
di: Sviridova, Ekaterina, et al.
Pubblicazione: (2024)
MKG-Rank: Enhancing Large Language Models with Knowledge Graph for Multilingual Medical Question Answering
di: Li, Feiyang, et al.
Pubblicazione: (2025)
di: Li, Feiyang, et al.
Pubblicazione: (2025)
MedPriv-Bench: Benchmarking the Privacy-Utility Trade-off of Large Language Models in Medical Open-End Question Answering
di: Guan, Shaowei, et al.
Pubblicazione: (2026)
di: Guan, Shaowei, et al.
Pubblicazione: (2026)
HistoryBankQA: Multilingual Temporal Question Answering on Historical Events
di: Mandal, Biswadip, et al.
Pubblicazione: (2025)
di: Mandal, Biswadip, et al.
Pubblicazione: (2025)
QA-prompting: Improving Summarization with Large Language Models using Question-Answering
di: Sinha, Neelabh
Pubblicazione: (2025)
di: Sinha, Neelabh
Pubblicazione: (2025)
PRIV-QA: Privacy-Preserving Question Answering for Cloud Large Language Models
di: Li, Guangwei, et al.
Pubblicazione: (2025)
di: Li, Guangwei, et al.
Pubblicazione: (2025)
EconLogicQA: A Question-Answering Benchmark for Evaluating Large Language Models in Economic Sequential Reasoning
di: Quan, Yinzhu, et al.
Pubblicazione: (2024)
di: Quan, Yinzhu, et al.
Pubblicazione: (2024)
MedLM: Exploring Language Models for Medical Question Answering Systems
di: Yagnik, Niraj, et al.
Pubblicazione: (2024)
di: Yagnik, Niraj, et al.
Pubblicazione: (2024)
POLYCHARTQA: Benchmarking Large Vision-Language Models with Multilingual Chart Question Answering
di: Xu, Yichen, et al.
Pubblicazione: (2025)
di: Xu, Yichen, et al.
Pubblicazione: (2025)
Critical Questions Generation: Motivation and Challenges
di: Figueras, Blanca Calvo, et al.
Pubblicazione: (2024)
di: Figueras, Blanca Calvo, et al.
Pubblicazione: (2024)
Cross-lingual Argument Mining in the Medical Domain
di: Yeginbergen, Anar, et al.
Pubblicazione: (2023)
di: Yeginbergen, Anar, et al.
Pubblicazione: (2023)
MedConceptsQA: Open Source Medical Concepts QA Benchmark
di: Shoham, Ofir Ben, et al.
Pubblicazione: (2024)
di: Shoham, Ofir Ben, et al.
Pubblicazione: (2024)
RephQA: Evaluating Readability of Large Language Models in Public Health Question Answering
di: Qiu, Weikang, et al.
Pubblicazione: (2025)
di: Qiu, Weikang, et al.
Pubblicazione: (2025)
ThReadMed-QA: A Multi-Turn Medical Dialogue Benchmark from Real Patient Questions
di: Munnangi, Monica, et al.
Pubblicazione: (2026)
di: Munnangi, Monica, et al.
Pubblicazione: (2026)
FanOutQA: A Multi-Hop, Multi-Document Question Answering Benchmark for Large Language Models
di: Zhu, Andrew, et al.
Pubblicazione: (2024)
di: Zhu, Andrew, et al.
Pubblicazione: (2024)
Metaphor and Large Language Models: When Surface Features Matter More than Deep Understanding
di: Sanchez-Bayona, Elisa, et al.
Pubblicazione: (2025)
di: Sanchez-Bayona, Elisa, et al.
Pubblicazione: (2025)
EuropeMedQA Study Protocol: A Multilingual, Multimodal Medical Examination Dataset for Language Model Evaluation
di: Causio, Francesco Andrea, et al.
Pubblicazione: (2026)
di: Causio, Francesco Andrea, et al.
Pubblicazione: (2026)
Language Independent Stance Detection: Social Interaction-based Embeddings and Large Language Models
di: de Landa, Joseba Fernandez, et al.
Pubblicazione: (2022)
di: de Landa, Joseba Fernandez, et al.
Pubblicazione: (2022)
DiversityMedQA: Assessing Demographic Biases in Medical Diagnosis using Large Language Models
di: Rawat, Rajat, et al.
Pubblicazione: (2024)
di: Rawat, Rajat, et al.
Pubblicazione: (2024)
VisualSimpleQA: A Benchmark for Decoupled Evaluation of Large Vision-Language Models in Fact-Seeking Question Answering
di: Wang, Yanling, et al.
Pubblicazione: (2025)
di: Wang, Yanling, et al.
Pubblicazione: (2025)
MULTITAT: Benchmarking Multilingual Table-and-Text Question Answering
di: Zhang, Xuanliang, et al.
Pubblicazione: (2025)
di: Zhang, Xuanliang, et al.
Pubblicazione: (2025)
BEnQA: A Question Answering and Reasoning Benchmark for Bengali and English
di: Shafayat, Sheikh, et al.
Pubblicazione: (2024)
di: Shafayat, Sheikh, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Effects of Cross-lingual Evidence in Multilingual Medical Question Answering
di: Yeginbergen, Anar, et al.
Pubblicazione: (2026) -
Dynamic Knowledge Integration for Evidence-Driven Counter-Argument Generation with Large Language Models
di: Yeginbergen, Anar, et al.
Pubblicazione: (2025) -
Multilingual Medical Reasoning for Question Answering with Large Language Models
di: Ferrazzi, Pietro, et al.
Pubblicazione: (2025) -
Argument Mining in Data Scarce Settings: Cross-lingual Transfer and Few-shot Techniques
di: Yeginbergen, Anar, et al.
Pubblicazione: (2024) -
MedExQA: Medical Question Answering Benchmark with Multiple Explanations
di: Kim, Yunsoo, et al.
Pubblicazione: (2024)