On the Performance of an Explainable Language Model on PubMedQA
Fuente:
arXiv
Guardado en:
| Autores principales: | Srinivasan, Venkat, Jatav, Vishaal, Chandrababu, Anushka, Sharma, Geetika |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Gyan: An Explainable Neuro-Symbolic Language Model
por: Srinivasan, Venkat, et al.
Publicado: (2026)
por: Srinivasan, Venkat, et al.
Publicado: (2026)
A Large-Language Model Framework for Relative Timeline Extraction from PubMed Case Reports
por: Wang, Jing, et al.
Publicado: (2025)
por: Wang, Jing, et al.
Publicado: (2025)
Gender-Neutral Large Language Models for Medical Applications: Reducing Bias in PubMed Abstracts
por: Schaefer, Elizabeth, et al.
Publicado: (2025)
por: Schaefer, Elizabeth, et al.
Publicado: (2025)
MedExpQA: Multilingual Benchmarking of Large Language Models for Medical Question Answering
por: Alonso, Iñigo, et al.
Publicado: (2024)
por: Alonso, Iñigo, et al.
Publicado: (2024)
DiversityMedQA: Assessing Demographic Biases in Medical Diagnosis using Large Language Models
por: Rawat, Rajat, et al.
Publicado: (2024)
por: Rawat, Rajat, et al.
Publicado: (2024)
PubMed-OCR: PMC Open Access OCR Annotations
por: Heidenreich, Hunter, et al.
Publicado: (2026)
por: Heidenreich, Hunter, et al.
Publicado: (2026)
MedConceptsQA: Open Source Medical Concepts QA Benchmark
por: Shoham, Ofir Ben, et al.
Publicado: (2024)
por: Shoham, Ofir Ben, et al.
Publicado: (2024)
PubMedCausal: A Span-Level Annotated Corpus for Causal Relation Extraction in Biomedical Text
por: Kunle-John, Ifeoluwa, et al.
Publicado: (2026)
por: Kunle-John, Ifeoluwa, et al.
Publicado: (2026)
PubMed-Ophtha: An open resource for training ophthalmology vision-language models on scientific literature
por: Hallitschke, Verena Jasmin, et al.
Publicado: (2026)
por: Hallitschke, Verena Jasmin, et al.
Publicado: (2026)
Harnessing PubMed User Query Logs for Post Hoc Explanations of Recommended Similar Articles
por: Shin, Ashley, et al.
Publicado: (2024)
por: Shin, Ashley, et al.
Publicado: (2024)
PMOA-TTS: Introducing the PubMed Open Access Textual Times Series Corpus
por: Noroozizadeh, Shahriar, et al.
Publicado: (2025)
por: Noroozizadeh, Shahriar, et al.
Publicado: (2025)
IHC-LLMiner: Automated extraction of tumour immunohistochemical profiles from PubMed abstracts using large language models
por: Kim, Yunsoo, et al.
Publicado: (2025)
por: Kim, Yunsoo, et al.
Publicado: (2025)
Efficient Fairness Testing in Large Language Models: Prioritizing Metamorphic Relations for Bias Detection
por: Giramata, Suavis, et al.
Publicado: (2025)
por: Giramata, Suavis, et al.
Publicado: (2025)
AlzheimerRAG: Multimodal Retrieval Augmented Generation for Clinical Use Cases using PubMed articles
por: Lahiri, Aritra Kumar, et al.
Publicado: (2024)
por: Lahiri, Aritra Kumar, et al.
Publicado: (2024)
PeruMedQA: Benchmarking Large Language Models (LLMs) on Peruvian Medical Exams -- Dataset Construction and Evaluation
por: Carrillo-Larco, Rodrigo M., et al.
Publicado: (2025)
por: Carrillo-Larco, Rodrigo M., et al.
Publicado: (2025)
MedBioRAG: Semantic Search and Retrieval-Augmented Generation with Large Language Models for Medical and Biological QA
por: Kim, Seonok
Publicado: (2025)
por: Kim, Seonok
Publicado: (2025)
EuropeMedQA Study Protocol: A Multilingual, Multimodal Medical Examination Dataset for Language Model Evaluation
por: Causio, Francesco Andrea, et al.
Publicado: (2026)
por: Causio, Francesco Andrea, et al.
Publicado: (2026)
UETQuintet at BioCreative IX -- MedHopQA: Enhancing Biomedical QA with Selective Multi-hop Reasoning and Contextual Retrieval
por: Nguyen, Quoc-An, et al.
Publicado: (2026)
por: Nguyen, Quoc-An, et al.
Publicado: (2026)
LLM-MedQA: Enhancing Medical Question Answering through Case Studies in Large Language Models
por: Yang, Hang, et al.
Publicado: (2024)
por: Yang, Hang, et al.
Publicado: (2024)
MedBioLM: Optimizing Medical and Biological QA with Fine-Tuned Large Language Models and Retrieval-Augmented Generation
por: Kim, Seonok
Publicado: (2025)
por: Kim, Seonok
Publicado: (2025)
Masking in Multi-hop QA: An Analysis of How Language Models Perform with Context Permutation
por: Huang, Wenyu, et al.
Publicado: (2025)
por: Huang, Wenyu, et al.
Publicado: (2025)
MedExQA: Medical Question Answering Benchmark with Multiple Explanations
por: Kim, Yunsoo, et al.
Publicado: (2024)
por: Kim, Yunsoo, et al.
Publicado: (2024)
This Treatment Works, Right? Evaluating LLM Sensitivity to Patient Question Framing in Medical QA
por: Yun, Hye Sun, et al.
Publicado: (2026)
por: Yun, Hye Sun, et al.
Publicado: (2026)
MedCPT: Contrastive Pre-trained Transformers with Large-scale PubMed Search Logs for Zero-shot Biomedical Information Retrieval
por: Jin, Qiao, et al.
Publicado: (2023)
por: Jin, Qiao, et al.
Publicado: (2023)
Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models
por: Yang, Haoyan, et al.
Publicado: (2024)
por: Yang, Haoyan, et al.
Publicado: (2024)
No "Zero-Shot" Without Exponential Data: Pretraining Concept Frequency Determines Multimodal Model Performance
por: Udandarao, Vishaal, et al.
Publicado: (2024)
por: Udandarao, Vishaal, et al.
Publicado: (2024)
Recurrent Confidence Chain: Temporal-Aware Uncertainty Quantification in Large Language Models
por: Mao, Zhenjiang, et al.
Publicado: (2026)
por: Mao, Zhenjiang, et al.
Publicado: (2026)
AfriMed-QA: A Pan-African, Multi-Specialty, Medical Question-Answering Benchmark Dataset
por: Olatunji, Tobi, et al.
Publicado: (2024)
por: Olatunji, Tobi, et al.
Publicado: (2024)
MedFrameQA: A Multi-Image Medical VQA Benchmark for Clinical Reasoning
por: Yu, Suhao, et al.
Publicado: (2025)
por: Yu, Suhao, et al.
Publicado: (2025)
MedLM: Exploring Language Models for Medical Question Answering Systems
por: Yagnik, Niraj, et al.
Publicado: (2024)
por: Yagnik, Niraj, et al.
Publicado: (2024)
Beyond MedQA: Towards Real-world Clinical Decision Making in the Era of LLMs
por: Xiao, Yunpeng, et al.
Publicado: (2025)
por: Xiao, Yunpeng, et al.
Publicado: (2025)
A Sober Look at Progress in Language Model Reasoning: Pitfalls and Paths to Reproducibility
por: Hochlehnert, Andreas, et al.
Publicado: (2025)
por: Hochlehnert, Andreas, et al.
Publicado: (2025)
ThReadMed-QA: A Multi-Turn Medical Dialogue Benchmark from Real Patient Questions
por: Munnangi, Monica, et al.
Publicado: (2026)
por: Munnangi, Monica, et al.
Publicado: (2026)
WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation
por: Matos, João, et al.
Publicado: (2024)
por: Matos, João, et al.
Publicado: (2024)
CiteME: Can Language Models Accurately Cite Scientific Claims?
por: Press, Ori, et al.
Publicado: (2024)
por: Press, Ori, et al.
Publicado: (2024)
SANSKRITI: A Comprehensive Benchmark for Evaluating Language Models' Knowledge of Indian Culture
por: Maji, Arijit, et al.
Publicado: (2025)
por: Maji, Arijit, et al.
Publicado: (2025)
RePPL: Recalibrating Perplexity by Uncertainty in Semantic Propagation and Language Generation for Explainable QA Hallucination Detection
por: Huang, Yiming, et al.
Publicado: (2025)
por: Huang, Yiming, et al.
Publicado: (2025)
MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding
por: Zuo, Yuxin, et al.
Publicado: (2025)
por: Zuo, Yuxin, et al.
Publicado: (2025)
Improving QA Model Performance with Cartographic Inoculation
por: Chen, Allen, et al.
Publicado: (2024)
por: Chen, Allen, et al.
Publicado: (2024)
CosmicFish-HRM: Adaptive Reasoning via Hierarchical Recurrent Mechanisms in Compact Language Models
por: Lakkapragada, Venkat Akhil
Publicado: (2026)
por: Lakkapragada, Venkat Akhil
Publicado: (2026)
Ejemplares similares
-
Gyan: An Explainable Neuro-Symbolic Language Model
por: Srinivasan, Venkat, et al.
Publicado: (2026) -
A Large-Language Model Framework for Relative Timeline Extraction from PubMed Case Reports
por: Wang, Jing, et al.
Publicado: (2025) -
Gender-Neutral Large Language Models for Medical Applications: Reducing Bias in PubMed Abstracts
por: Schaefer, Elizabeth, et al.
Publicado: (2025) -
MedExpQA: Multilingual Benchmarking of Large Language Models for Medical Question Answering
por: Alonso, Iñigo, et al.
Publicado: (2024) -
DiversityMedQA: Assessing Demographic Biases in Medical Diagnosis using Large Language Models
por: Rawat, Rajat, et al.
Publicado: (2024)