MedHopQA: A Disease-Centered Multi-Hop Reasoning Benchmark and Evaluation Framework for LLM-Based Biomedical Question Answering
Fuente:
arXiv
Saved in:
| Main Authors: | Islamaj, Rezarta, Leaman, Robert, Chan, Joey, Wan, Nicholas, Jin, Qiao, Xie, Natalie, Wilbur, John, Tian, Shubo, Yeganova, Lana, Lai, Po-Ting, Wei, Chih-Hsuan, Yang, Yifan, Ge, Yao, Zhu, Qingqing, Wang, Zhizheng, Lu, Zhiyong |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Condition-Gated Reasoning for Context-Dependent Biomedical Question Answering
by: Parekh, Jash Rajesh, et al.
Published: (2026)
by: Parekh, Jash Rajesh, et al.
Published: (2026)
Overview of the MedHopQA track at BioCreative IX: track description, participation and evaluation of systems for multi-hop medical question answering
by: Islamaj, Rezarta, et al.
Published: (2026)
by: Islamaj, Rezarta, et al.
Published: (2026)
What Do Biomedical NER and Entity Linking Benchmarks Measure? A Corpus-Centric Diagnostic Framework
by: Leaman, Robert, et al.
Published: (2026)
by: Leaman, Robert, et al.
Published: (2026)
UETQuintet at BioCreative IX -- MedHopQA: Enhancing Biomedical QA with Selective Multi-hop Reasoning and Contextual Retrieval
by: Nguyen, Quoc-An, et al.
Published: (2026)
by: Nguyen, Quoc-An, et al.
Published: (2026)
MedCPT: Contrastive Pre-trained Transformers with Large-scale PubMed Search Logs for Zero-shot Biomedical Information Retrieval
by: Jin, Qiao, et al.
Published: (2023)
by: Jin, Qiao, et al.
Published: (2023)
Enhancing Biomedical Relation Extraction with Directionality
by: Lai, Po-Ting, et al.
Published: (2025)
by: Lai, Po-Ting, et al.
Published: (2025)
Opportunities and Challenges for ChatGPT and Large Language Models in Biomedicine and Health
by: Tian, Shubo, et al.
Published: (2023)
by: Tian, Shubo, et al.
Published: (2023)
PubTator 3.0: an AI-powered Literature Resource for Unlocking Biomedical Knowledge
by: Wei, Chih-Hsuan, et al.
Published: (2024)
by: Wei, Chih-Hsuan, et al.
Published: (2024)
PubMed and Beyond: Biomedical Literature Search in the Age of Artificial Intelligence
by: Jin, Qiao, et al.
Published: (2023)
by: Jin, Qiao, et al.
Published: (2023)
Exploring Anti-Aging Literature via ConvexTopics and Large Language Models
by: Yeganova, Lana E., et al.
Published: (2026)
by: Yeganova, Lana E., et al.
Published: (2026)
Med-V1: Small Language Models for Zero-shot and Scalable Biomedical Evidence Attribution
by: Jin, Qiao, et al.
Published: (2026)
by: Jin, Qiao, et al.
Published: (2026)
Knowledge-guided Contextual Gene Set Analysis Using Large Language Models
by: Wang, Zhizheng, et al.
Published: (2025)
by: Wang, Zhizheng, et al.
Published: (2025)
Large Language Models Meet Biomedical Knowledge Graphs for Mechanistically Grounded Therapeutic Prioritization
by: Wei, Chih-Hsuan, et al.
Published: (2026)
by: Wei, Chih-Hsuan, et al.
Published: (2026)
GeneAgent: Self-verification Language Agent for Gene Set Knowledge Discovery using Domain Databases
by: Wang, Zhizheng, et al.
Published: (2024)
by: Wang, Zhizheng, et al.
Published: (2024)
Knowledge Editing with Dynamic Knowledge Graphs for Multi-Hop Question Answering
by: Lu, Yifan, et al.
Published: (2024)
by: Lu, Yifan, et al.
Published: (2024)
Question Calibration and Multi-Hop Modeling for Temporal Question Answering
by: Xue, Chao, et al.
Published: (2024)
by: Xue, Chao, et al.
Published: (2024)
Multi-Hop Reasoning for Question Answering with Hyperbolic Representations
by: Welz, Simon, et al.
Published: (2025)
by: Welz, Simon, et al.
Published: (2025)
FanOutQA: A Multi-Hop, Multi-Document Question Answering Benchmark for Large Language Models
by: Zhu, Andrew, et al.
Published: (2024)
by: Zhu, Andrew, et al.
Published: (2024)
End-to-End Beam Retrieval for Multi-Hop Question Answering
by: Zhang, Jiahao, et al.
Published: (2023)
by: Zhang, Jiahao, et al.
Published: (2023)
PRISM: Agentic Retrieval with LLMs for Multi-Hop Question Answering
by: Nahid, Md Mahadi Hasan, et al.
Published: (2025)
by: Nahid, Md Mahadi Hasan, et al.
Published: (2025)
EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
by: Zhuang, Ziyuan, et al.
Published: (2024)
by: Zhuang, Ziyuan, et al.
Published: (2024)
DeepRAG: Integrating Hierarchical Reasoning and Process Supervision for Biomedical Multi-Hop QA
by: Ji, Yuelyu, et al.
Published: (2025)
by: Ji, Yuelyu, et al.
Published: (2025)
DocHop-QA: Towards Multi-Hop Reasoning over Multimodal Document Collections
by: Park, Jiwon, et al.
Published: (2025)
by: Park, Jiwon, et al.
Published: (2025)
NovelHopQA: Diagnosing Multi-Hop Reasoning Failures in Long Narrative Contexts
by: Gupta, Abhay, et al.
Published: (2025)
by: Gupta, Abhay, et al.
Published: (2025)
Resource-Friendly Dynamic Enhancement Chain for Multi-Hop Question Answering
by: Ji, Binquan, et al.
Published: (2025)
by: Ji, Binquan, et al.
Published: (2025)
MDER-DR: Multi-Hop Question Answering with Entity-Centric Summaries
by: Campi, Riccardo, et al.
Published: (2026)
by: Campi, Riccardo, et al.
Published: (2026)
Knowledge Editing for Multi-Hop Question Answering Using Semantic Analysis
by: Simon, Dominic, et al.
Published: (2025)
by: Simon, Dominic, et al.
Published: (2025)
A Method for Multi-Hop Question Answering on Persian Knowledge Graph
by: Ghafouri, Arash, et al.
Published: (2025)
by: Ghafouri, Arash, et al.
Published: (2025)
Memory-Aware and Uncertainty-Guided Retrieval for Multi-Hop Question Answering
by: Ji, Yuelyu, et al.
Published: (2025)
by: Ji, Yuelyu, et al.
Published: (2025)
Credible Plan-Driven RAG Method for Multi-Hop Question Answering
by: Zhang, Ningning, et al.
Published: (2025)
by: Zhang, Ningning, et al.
Published: (2025)
BanglaMedQA and BanglaMMedBench: Evaluating Retrieval-Augmented Generation Strategies for Bangla Biomedical Question Answering
by: Sultana, Sadia, et al.
Published: (2025)
by: Sultana, Sadia, et al.
Published: (2025)
Few-Shot Data Synthesis for Open Domain Multi-Hop Question Answering
by: Chen, Mingda, et al.
Published: (2023)
by: Chen, Mingda, et al.
Published: (2023)
Metacognitive Behavioral Tuning of Large Language Models for Multi-Hop Question Answering
by: Kim, Ik-hwan, et al.
Published: (2026)
by: Kim, Ik-hwan, et al.
Published: (2026)
RASER: Recoverability-Aware Selective Escalation Router for Multi-Hop Question Answering
by: Li, Yuyang, et al.
Published: (2026)
by: Li, Yuyang, et al.
Published: (2026)
FrugalRAG: Less is More in RL Finetuning for Multi-Hop Question Answering
by: Java, Abhinav, et al.
Published: (2025)
by: Java, Abhinav, et al.
Published: (2025)
Bridging Dual Knowledge Graphs for Multi-Hop Question Answering in Construction Safety
by: Zhang, Yuxin, et al.
Published: (2025)
by: Zhang, Yuxin, et al.
Published: (2025)
Retrieval-enhanced Knowledge Editing in Language Models for Multi-Hop Question Answering
by: Shi, Yucheng, et al.
Published: (2024)
by: Shi, Yucheng, et al.
Published: (2024)
Mitigating Lost-in-Retrieval Problems in Retrieval Augmented Multi-Hop Question Answering
by: Zhu, Rongzhi, et al.
Published: (2025)
by: Zhu, Rongzhi, et al.
Published: (2025)
Reasoning in Trees: Improving Retrieval-Augmented Generation for Multi-Hop Question Answering
by: Shi, Yuling, et al.
Published: (2026)
by: Shi, Yuling, et al.
Published: (2026)
Fine-Tuning vs. RAG for Multi-Hop Question Answering with Novel Knowledge
by: Yang, Zhuoyi, et al.
Published: (2026)
by: Yang, Zhuoyi, et al.
Published: (2026)
Similar Items
-
Condition-Gated Reasoning for Context-Dependent Biomedical Question Answering
by: Parekh, Jash Rajesh, et al.
Published: (2026) -
Overview of the MedHopQA track at BioCreative IX: track description, participation and evaluation of systems for multi-hop medical question answering
by: Islamaj, Rezarta, et al.
Published: (2026) -
What Do Biomedical NER and Entity Linking Benchmarks Measure? A Corpus-Centric Diagnostic Framework
by: Leaman, Robert, et al.
Published: (2026) -
UETQuintet at BioCreative IX -- MedHopQA: Enhancing Biomedical QA with Selective Multi-hop Reasoning and Contextual Retrieval
by: Nguyen, Quoc-An, et al.
Published: (2026) -
MedCPT: Contrastive Pre-trained Transformers with Large-scale PubMed Search Logs for Zero-shot Biomedical Information Retrieval
by: Jin, Qiao, et al.
Published: (2023)