Pattern Recognition or Medical Knowledge? The Problem with Multiple-Choice Questions in Medicine
Fuente:
arXiv
Guardado en:
| Autores principales: | Griot, Maxime, Vanderdonckt, Jean, Yuksel, Demet, Hemptinne, Coralie |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Generating Multiple-Choice Knowledge Questions with Interpretable Difficulty Estimation using Knowledge Graphs and Large Language Models
por: Şakiroğlu, Mehmet Can, et al.
Publicado: (2026)
por: Şakiroğlu, Mehmet Can, et al.
Publicado: (2026)
Generating Plausible Distractors for Multiple-Choice Questions via Student Choice Prediction
por: Lee, Yooseop, et al.
Publicado: (2025)
por: Lee, Yooseop, et al.
Publicado: (2025)
Biomedical Entity Linking as Multiple Choice Question Answering
por: Lin, Zhenxi, et al.
Publicado: (2024)
por: Lin, Zhenxi, et al.
Publicado: (2024)
Option-ID Based Elimination For Multiple Choice Questions
por: Zhu, Zhenhao, et al.
Publicado: (2025)
por: Zhu, Zhenhao, et al.
Publicado: (2025)
Anchored Answers: Unravelling Positional Bias in GPT-2's Multiple-Choice Questions
por: Li, Ruizhe, et al.
Publicado: (2024)
por: Li, Ruizhe, et al.
Publicado: (2024)
A Study on Large Language Models' Limitations in Multiple-Choice Question Answering
por: Khatun, Aisha, et al.
Publicado: (2024)
por: Khatun, Aisha, et al.
Publicado: (2024)
UnibucLLM: Harnessing LLMs for Automated Prediction of Item Difficulty and Response Time for Multiple-Choice Questions
por: Rogoz, Ana-Cristina, et al.
Publicado: (2024)
por: Rogoz, Ana-Cristina, et al.
Publicado: (2024)
MEG: Medical Knowledge-Augmented Large Language Models for Question Answering
por: Cabello, Laura, et al.
Publicado: (2024)
por: Cabello, Laura, et al.
Publicado: (2024)
Answer Matching Outperforms Multiple Choice for Language Model Evaluation
por: Chandak, Nikhil, et al.
Publicado: (2025)
por: Chandak, Nikhil, et al.
Publicado: (2025)
Multiple Choice Learning of Low-Rank Adapters for Language Modeling
por: Letzelter, Victor, et al.
Publicado: (2025)
por: Letzelter, Victor, et al.
Publicado: (2025)
Interpretable Question Answering with Knowledge Graphs
por: Aneja, Kartikeya, et al.
Publicado: (2025)
por: Aneja, Kartikeya, et al.
Publicado: (2025)
Automated Generation of Challenging Multiple-Choice Questions for Vision Language Model Evaluation
por: Zhang, Yuhui, et al.
Publicado: (2025)
por: Zhang, Yuhui, et al.
Publicado: (2025)
Probabilities of Chat LLMs Are Miscalibrated but Still Predict Correctness on Multiple-Choice Q&A
por: Plaut, Benjamin, et al.
Publicado: (2024)
por: Plaut, Benjamin, et al.
Publicado: (2024)
Temporal Knowledge Graph Question Answering: A Survey
por: Su, Miao, et al.
Publicado: (2024)
por: Su, Miao, et al.
Publicado: (2024)
COMPKE: Complex Question Answering under Knowledge Editing
por: Cheng, Keyuan, et al.
Publicado: (2025)
por: Cheng, Keyuan, et al.
Publicado: (2025)
ChameleonLLM: Batch-Aware Dynamic Low-Rank Adaptation via Inference-Time Clusters
por: Yuksel, Kamer Ali, et al.
Publicado: (2025)
por: Yuksel, Kamer Ali, et al.
Publicado: (2025)
Augmenting Math Word Problems via Iterative Question Composing
por: Liu, Haoxiong, et al.
Publicado: (2024)
por: Liu, Haoxiong, et al.
Publicado: (2024)
MedLM: Exploring Language Models for Medical Question Answering Systems
por: Yagnik, Niraj, et al.
Publicado: (2024)
por: Yagnik, Niraj, et al.
Publicado: (2024)
Multi-hop Question Answering under Temporal Knowledge Editing
por: Cheng, Keyuan, et al.
Publicado: (2024)
por: Cheng, Keyuan, et al.
Publicado: (2024)
Examining LLMs' Uncertainty Expression Towards Questions Outside Parametric Knowledge
por: Liu, Genglin, et al.
Publicado: (2023)
por: Liu, Genglin, et al.
Publicado: (2023)
A Systematic Study of Retrieval Pipeline Design for Retrieval-Augmented Medical Question Answering
por: Sultana, Nusrat, et al.
Publicado: (2026)
por: Sultana, Nusrat, et al.
Publicado: (2026)
Evidence-Focused Fact Summarization for Knowledge-Augmented Zero-Shot Question Answering
por: Ko, Sungho, et al.
Publicado: (2024)
por: Ko, Sungho, et al.
Publicado: (2024)
Retrieval-enhanced Knowledge Editing in Language Models for Multi-Hop Question Answering
por: Shi, Yucheng, et al.
Publicado: (2024)
por: Shi, Yucheng, et al.
Publicado: (2024)
LinkQ: An LLM-Assisted Visual Interface for Knowledge Graph Question-Answering
por: Li, Harry, et al.
Publicado: (2024)
por: Li, Harry, et al.
Publicado: (2024)
Empirical Characterization of Rationale Stability Under Controlled Perturbations for Explainable Pattern Recognition
por: Sakib, Abu Noman Md, et al.
Publicado: (2026)
por: Sakib, Abu Noman Md, et al.
Publicado: (2026)
MediaMind: Revolutionizing Media Monitoring using Agentification
por: Gunduz, Ahmet, et al.
Publicado: (2025)
por: Gunduz, Ahmet, et al.
Publicado: (2025)
Automated Generation and Tagging of Knowledge Components from Multiple-Choice Questions
por: Moore, Steven, et al.
Publicado: (2024)
por: Moore, Steven, et al.
Publicado: (2024)
A Large-Scale Benchmark for Evaluating Large Language Models on Medical Question Answering in Romanian
por: Rogoz, Ana-Cristina, et al.
Publicado: (2025)
por: Rogoz, Ana-Cristina, et al.
Publicado: (2025)
Mechanistic Interpretability as Statistical Estimation: A Variance Analysis
por: Méloux, Maxime, et al.
Publicado: (2025)
por: Méloux, Maxime, et al.
Publicado: (2025)
PAACE: A Plan-Aware Automated Agent Context Engineering Framework
por: Yuksel, Kamer Ali
Publicado: (2025)
por: Yuksel, Kamer Ali
Publicado: (2025)
Large Language Models in Fire Engineering: An Examination of Technical Questions Against Domain Knowledge
por: Hostetter, Haley, et al.
Publicado: (2024)
por: Hostetter, Haley, et al.
Publicado: (2024)
Jingfang: An LLM-Based Multi-Agent System for Precise Medical Consultation and Syndrome Differentiation in Traditional Chinese Medicine
por: Yang, Yehan, et al.
Publicado: (2025)
por: Yang, Yehan, et al.
Publicado: (2025)
Word-Sequence Entropy: Towards Uncertainty Estimation in Free-Form Medical Question Answering Applications and Beyond
por: Wang, Zhiyuan, et al.
Publicado: (2024)
por: Wang, Zhiyuan, et al.
Publicado: (2024)
Logic Programming on Knowledge Graph Networks And its Application in Medical Domain
por: Wang, Chuanqing, et al.
Publicado: (2026)
por: Wang, Chuanqing, et al.
Publicado: (2026)
ContextGPT: Infusing LLMs Knowledge into Neuro-Symbolic Activity Recognition Models
por: Arrotta, Luca, et al.
Publicado: (2024)
por: Arrotta, Luca, et al.
Publicado: (2024)
Everything, Everywhere, All at Once: Is Mechanistic Interpretability Identifiable?
por: Méloux, Maxime, et al.
Publicado: (2025)
por: Méloux, Maxime, et al.
Publicado: (2025)
Structured Extraction of Real World Medical Knowledge using LLMs for Summarization and Search
por: Kim, Edward, et al.
Publicado: (2024)
por: Kim, Edward, et al.
Publicado: (2024)
Differentiating Choices via Commonality for Multiple-Choice Question Answering
por: Deng, Wenqing, et al.
Publicado: (2024)
por: Deng, Wenqing, et al.
Publicado: (2024)
Diagnosing Retrieval Bias Under Multiple In-Context Knowledge Updates in Large Language Models
por: Qiao, Boyu, et al.
Publicado: (2026)
por: Qiao, Boyu, et al.
Publicado: (2026)
Influence of visual acuity on monocular face perception and exploration: Evidence from gaze‐contingency
por: Nathan Hupin, et al.
Publicado: (2024)
por: Nathan Hupin, et al.
Publicado: (2024)
Ejemplares similares
-
Generating Multiple-Choice Knowledge Questions with Interpretable Difficulty Estimation using Knowledge Graphs and Large Language Models
por: Şakiroğlu, Mehmet Can, et al.
Publicado: (2026) -
Generating Plausible Distractors for Multiple-Choice Questions via Student Choice Prediction
por: Lee, Yooseop, et al.
Publicado: (2025) -
Biomedical Entity Linking as Multiple Choice Question Answering
por: Lin, Zhenxi, et al.
Publicado: (2024) -
Option-ID Based Elimination For Multiple Choice Questions
por: Zhu, Zhenhao, et al.
Publicado: (2025) -
Anchored Answers: Unravelling Positional Bias in GPT-2's Multiple-Choice Questions
por: Li, Ruizhe, et al.
Publicado: (2024)