EpiQAL: Benchmarking Large Language Models in Epidemiological Question Answering and Reasoning
Fuente:
arXiv
Saved in:
| Main Authors: | Wei, Mingyang, Min, Dehai, Liu, Zewen, Xie, Yuzhang, Wu, Guanchen, Zhang, Ziyang, Yang, Carl, Lau, Max S. Y., He, Qi, Cheng, Lu, Jin, Wei |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
EpiLearn: A Python Library for Machine Learning in Epidemic Modeling
by: Liu, Zewen, et al.
Published: (2024)
by: Liu, Zewen, et al.
Published: (2024)
Epidemiology-Aware Neural ODE with Continuous Disease Transmission Graph
by: Wan, Guancheng, et al.
Published: (2024)
by: Wan, Guancheng, et al.
Published: (2024)
Towards Automatic Evaluation and Selection of PHI De-identification Models via Multi-Agent Collaboration
by: Wu, Guanchen, et al.
Published: (2025)
by: Wu, Guanchen, et al.
Published: (2025)
Can Large Language Models Adequately Perform Symbolic Reasoning Over Time Series?
by: Liu, Zewen, et al.
Published: (2025)
by: Liu, Zewen, et al.
Published: (2025)
Utilizing Large Language Models for Zero-Shot Medical Ontology Extension from Clinical Notes
by: Wu, Guanchen, et al.
Published: (2025)
by: Wu, Guanchen, et al.
Published: (2025)
Pre-training Epidemic Time Series Forecasters with Compartmental Prototypes
by: Liu, Zewen, et al.
Published: (2025)
by: Liu, Zewen, et al.
Published: (2025)
Temporal Knowledge Question Answering via Abstract Reasoning Induction
by: Chen, Ziyang, et al.
Published: (2023)
by: Chen, Ziyang, et al.
Published: (2023)
Verifiable Rewards Beyond Math and Code: Lightweight Corpus-Grounded Process Supervision for Factual Question Answering
by: Fan, Shicheng, et al.
Published: (2026)
by: Fan, Shicheng, et al.
Published: (2026)
A Review of Graph Neural Networks in Epidemic Modeling
by: Liu, Zewen, et al.
Published: (2024)
by: Liu, Zewen, et al.
Published: (2024)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
by: Ding, Jing, et al.
Published: (2025)
by: Ding, Jing, et al.
Published: (2025)
Latent Thoughts Tuning: Bridging Context and Reasoning with Fused Information in Latent Tokens
by: Liu, Weihao, et al.
Published: (2026)
by: Liu, Weihao, et al.
Published: (2026)
Higher-order Interaction Matters: Dynamic Hypergraph Neural Networks for Epidemic Modeling
by: Liu, Songyuan, et al.
Published: (2025)
by: Liu, Songyuan, et al.
Published: (2025)
Exploring the Impact of Table-to-Text Methods on Augmenting LLM-based Question Answering with Domain Hybrid Data
by: Min, Dehai, et al.
Published: (2024)
by: Min, Dehai, et al.
Published: (2024)
Joint Multi-Facts Reasoning Network For Complex Temporal Question Answering Over Knowledge Graph
by: Huang, Rikui, et al.
Published: (2024)
by: Huang, Rikui, et al.
Published: (2024)
RoboSurg-VQA: A Multimodal Benchmark for Surgical Segmentation-Aware Visual Question Answering
by: Zhang, Chengyi, et al.
Published: (2026)
by: Zhang, Chengyi, et al.
Published: (2026)
RJUA-MedDQA: A Multimodal Benchmark for Medical Document Question Answering and Clinical Reasoning
by: Jin, Congyun, et al.
Published: (2024)
by: Jin, Congyun, et al.
Published: (2024)
PARSE: An Open-Domain Reasoning Question Answering Benchmark for Persian
by: Mozafari, Jamshid, et al.
Published: (2026)
by: Mozafari, Jamshid, et al.
Published: (2026)
MTBench: A Multimodal Time Series Benchmark for Temporal Reasoning and Question Answering
by: Chen, Jialin, et al.
Published: (2025)
by: Chen, Jialin, et al.
Published: (2025)
Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan
by: Yao, Jui-Ming, et al.
Published: (2025)
by: Yao, Jui-Ming, et al.
Published: (2025)
TCM-Ladder: A Benchmark for Multimodal Question Answering on Traditional Chinese Medicine
by: Xie, Jiacheng, et al.
Published: (2025)
by: Xie, Jiacheng, et al.
Published: (2025)
DebateQA: Evaluating Question Answering on Debatable Knowledge
by: Xu, Rongwu, et al.
Published: (2024)
by: Xu, Rongwu, et al.
Published: (2024)
Reading Between the Timelines: RAG for Answering Diachronic Questions
by: Lau, Kwun Hang, et al.
Published: (2025)
by: Lau, Kwun Hang, et al.
Published: (2025)
POLYCHARTQA: Benchmarking Large Vision-Language Models with Multilingual Chart Question Answering
by: Xu, Yichen, et al.
Published: (2025)
by: Xu, Yichen, et al.
Published: (2025)
Classes of Universal Epi- and Monomorphisms in Quasi-Abelian Categories
by: Zinchenko, Max
Published: (2026)
by: Zinchenko, Max
Published: (2026)
PathISE: Learning Informative Path Supervision for Knowledge Graph Question Answering
by: Gao, Shengxiang, et al.
Published: (2026)
by: Gao, Shengxiang, et al.
Published: (2026)
Visually Interpretable Subtask Reasoning for Visual Question Answering
by: Cheng, Yu, et al.
Published: (2025)
by: Cheng, Yu, et al.
Published: (2025)
LLM-MINE: Large Language Model based Alzheimer's Disease and Related Dementias Phenotypes Mining from Clinical Notes
by: Shao, Mingchen, et al.
Published: (2026)
by: Shao, Mingchen, et al.
Published: (2026)
QoSDiff: An Implicit Topological Embedding Learning Framework Leveraging Denoising Diffusion and Adversarial Attention for Robust QoS Prediction
by: Du, Guanchen, et al.
Published: (2025)
by: Du, Guanchen, et al.
Published: (2025)
BEnQA: A Question Answering and Reasoning Benchmark for Bengali and English
by: Shafayat, Sheikh, et al.
Published: (2024)
by: Shafayat, Sheikh, et al.
Published: (2024)
KERAP: A Knowledge-Enhanced Reasoning Approach for Accurate Zero-shot Diagnosis Prediction Using Multi-agent LLMs
by: Xie, Yuzhang, et al.
Published: (2025)
by: Xie, Yuzhang, et al.
Published: (2025)
QAL-Check: Quantum Alignment Logic Model Checker (Artifact)
by: Anonymous
Published: (2026)
by: Anonymous
Published: (2026)
QAL-BP: An Augmented Lagrangian Quantum Approach for Bin Packing
by: Cellini, Lorenzo, et al.
Published: (2023)
by: Cellini, Lorenzo, et al.
Published: (2023)
Token Constraint Decoding Improves Robustness on Question Answering for Large Language Models
by: Yao, Jui-Ming, et al.
Published: (2025)
by: Yao, Jui-Ming, et al.
Published: (2025)
KoBBQ: Korean Bias Benchmark for Question Answering
by: Jin, Jiho, et al.
Published: (2023)
by: Jin, Jiho, et al.
Published: (2023)
MIRAGE: Knowledge Graph-Guided Cross-Cohort MRI Synthesis for Alzheimer's Disease Prediction
by: Wu, Guanchen, et al.
Published: (2026)
by: Wu, Guanchen, et al.
Published: (2026)
From Prompt to Physical Action: Structured Backdoor Attacks on LLM-Mediated Robotic Control Systems
by: Xie, Mingyang, et al.
Published: (2026)
by: Xie, Mingyang, et al.
Published: (2026)
Multilingual Medical Reasoning for Question Answering with Large Language Models
by: Ferrazzi, Pietro, et al.
Published: (2025)
by: Ferrazzi, Pietro, et al.
Published: (2025)
MTVQA: Benchmarking Multilingual Text-Centric Visual Question Answering
by: Tang, Jingqun, et al.
Published: (2024)
by: Tang, Jingqun, et al.
Published: (2024)
Unlocking Temporal Question Answering for Large Language Models with Tailor-Made Reasoning Logic
by: Li, Xingxuan, et al.
Published: (2023)
by: Li, Xingxuan, et al.
Published: (2023)
Assessing Modality Bias in Video Question Answering Benchmarks with Multimodal Large Language Models
by: Park, Jean, et al.
Published: (2024)
by: Park, Jean, et al.
Published: (2024)
Similar Items
-
EpiLearn: A Python Library for Machine Learning in Epidemic Modeling
by: Liu, Zewen, et al.
Published: (2024) -
Epidemiology-Aware Neural ODE with Continuous Disease Transmission Graph
by: Wan, Guancheng, et al.
Published: (2024) -
Towards Automatic Evaluation and Selection of PHI De-identification Models via Multi-Agent Collaboration
by: Wu, Guanchen, et al.
Published: (2025) -
Can Large Language Models Adequately Perform Symbolic Reasoning Over Time Series?
by: Liu, Zewen, et al.
Published: (2025) -
Utilizing Large Language Models for Zero-Shot Medical Ontology Extension from Clinical Notes
by: Wu, Guanchen, et al.
Published: (2025)