StepGap: A Hybrid NLI-LLM Checker for Step-Level Evidence-Gap Detectionin Multi-Hop Question Answering
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ji, Yuelyu, Li, Zhuochun, Ji, Hui, He, Daqing |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Memory-Aware and Uncertainty-Guided Retrieval for Multi-Hop Question Answering
par: Ji, Yuelyu, et autres
Publié: (2025)
par: Ji, Yuelyu, et autres
Publié: (2025)
Retrieval--Reasoning Processes for Multi-hop Question Answering: A Four-Axis Design Framework and Empirical Trends
par: Ji, Yuelyu, et autres
Publié: (2026)
par: Ji, Yuelyu, et autres
Publié: (2026)
Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation
par: Ji, Yuelyu, et autres
Publié: (2025)
par: Ji, Yuelyu, et autres
Publié: (2025)
ReasoningRank: Teaching Student Models to Rank through Reasoning-Based Knowledge Distillation
par: Ji, Yuelyu, et autres
Publié: (2024)
par: Ji, Yuelyu, et autres
Publié: (2024)
Learning from Committee: Reasoning Distillation from a Mixture of Teachers with Peer-Review
par: Li, Zhuochun, et autres
Publié: (2024)
par: Li, Zhuochun, et autres
Publié: (2024)
Bias Evaluation and Mitigation in Retrieval-Augmented Medical Question-Answering Systems
par: Ji, Yuelyu, et autres
Publié: (2025)
par: Ji, Yuelyu, et autres
Publié: (2025)
RAG-RLRC-LaySum at BioLaySumm: Integrating Retrieval-Augmented Generation and Readability Control for Layman Summarization of Biomedical Texts
par: Ji, Yuelyu, et autres
Publié: (2024)
par: Ji, Yuelyu, et autres
Publié: (2024)
DeepRAG: Integrating Hierarchical Reasoning and Process Supervision for Biomedical Multi-Hop QA
par: Ji, Yuelyu, et autres
Publié: (2025)
par: Ji, Yuelyu, et autres
Publié: (2025)
StepChain GraphRAG: Reasoning Over Knowledge Graphs for Multi-Hop Question Answering
par: Ni, Tengjun, et autres
Publié: (2025)
par: Ni, Tengjun, et autres
Publié: (2025)
What Makes a Medical Checker Trainable? Diagnosing Signal Collapse and Reward Hacking in Checker-Guided RAG for Biomedical QA
par: Ji, Yuelyu, et autres
Publié: (2026)
par: Ji, Yuelyu, et autres
Publié: (2026)
BELLE: A Bi-Level Multi-Agent Reasoning Framework for Multi-Hop Question Answering
par: Zhang, Taolin, et autres
Publié: (2025)
par: Zhang, Taolin, et autres
Publié: (2025)
Rethinking LLM-as-a-Judge: Representation-as-a-Judge with Small Language Models via Semantic Capacity Asymmetry
par: Li, Zhuochun, et autres
Publié: (2026)
par: Li, Zhuochun, et autres
Publié: (2026)
Resource-Friendly Dynamic Enhancement Chain for Multi-Hop Question Answering
par: Ji, Binquan, et autres
Publié: (2025)
par: Ji, Binquan, et autres
Publié: (2025)
Question Calibration and Multi-Hop Modeling for Temporal Question Answering
par: Xue, Chao, et autres
Publié: (2024)
par: Xue, Chao, et autres
Publié: (2024)
Knowledge Editing with Dynamic Knowledge Graphs for Multi-Hop Question Answering
par: Lu, Yifan, et autres
Publié: (2024)
par: Lu, Yifan, et autres
Publié: (2024)
Effects of Different Prompts on the Quality of GPT-4 Responses to Dementia Care Questions
par: Li, Zhuochun, et autres
Publié: (2024)
par: Li, Zhuochun, et autres
Publié: (2024)
LLM-Based Multi-Hop Question Answering with Knowledge Graph Integration in Evolving Environments
par: Chen, Ruirui, et autres
Publié: (2024)
par: Chen, Ruirui, et autres
Publié: (2024)
End-to-End Beam Retrieval for Multi-Hop Question Answering
par: Zhang, Jiahao, et autres
Publié: (2023)
par: Zhang, Jiahao, et autres
Publié: (2023)
Multi-Hop Reasoning for Question Answering with Hyperbolic Representations
par: Welz, Simon, et autres
Publié: (2025)
par: Welz, Simon, et autres
Publié: (2025)
Narrowing the Knowledge Evaluation Gap: Open-Domain Question Answering with Multi-Granularity Answers
par: Yona, Gal, et autres
Publié: (2024)
par: Yona, Gal, et autres
Publié: (2024)
CompactRAG: Reducing LLM Calls and Token Overhead in Multi-Hop Question Answering
par: Yang, Hao, et autres
Publié: (2026)
par: Yang, Hao, et autres
Publié: (2026)
An Analysis of Decoding Methods for LLM-based Agents for Faithful Multi-Hop Question Answering
par: Murphy, Alexander, et autres
Publié: (2025)
par: Murphy, Alexander, et autres
Publié: (2025)
MINTQA: A Multi-Hop Question Answering Benchmark for Evaluating LLMs on New and Tail Knowledge
par: He, Jie, et autres
Publié: (2024)
par: He, Jie, et autres
Publié: (2024)
MRAG-Suite: A Diagnostic Evaluation Platform for Visual Retrieval-Augmented Generation
par: Ji, Yuelyu, et autres
Publié: (2025)
par: Ji, Yuelyu, et autres
Publié: (2025)
ComposeRAG: A Modular and Composable RAG for Corpus-Grounded Multi-Hop Question Answering
par: Wu, Ruofan, et autres
Publié: (2025)
par: Wu, Ruofan, et autres
Publié: (2025)
Consistency-Aware Parameter-Preserving Knowledge Editing Framework for Multi-Hop Question Answering
par: Deng, Lingwen, et autres
Publié: (2025)
par: Deng, Lingwen, et autres
Publié: (2025)
Let's Verify Math Questions Step by Step
par: Shen, Chengyu, et autres
Publié: (2025)
par: Shen, Chengyu, et autres
Publié: (2025)
Mind the Gap Between Spatial Reasoning and Acting! Step-by-Step Evaluation of Agents With Spatial-Gym
par: Kaesberg, Lars Benedikt, et autres
Publié: (2026)
par: Kaesberg, Lars Benedikt, et autres
Publié: (2026)
EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
par: Zhuang, Ziyuan, et autres
Publié: (2024)
par: Zhuang, Ziyuan, et autres
Publié: (2024)
Learning to Reason for Multi-Step Retrieval of Personal Context in Personalized Question Answering
par: Amirizaniani, Maryam, et autres
Publié: (2026)
par: Amirizaniani, Maryam, et autres
Publié: (2026)
Mitigating the Risk of Health Inequity Exacerbated by Large Language Models
par: Ji, Yuelyu, et autres
Publié: (2024)
par: Ji, Yuelyu, et autres
Publié: (2024)
Assertion Detection Large Language Model In-context Learning LoRA Fine-tuning
par: Ji, Yuelyu, et autres
Publié: (2024)
par: Ji, Yuelyu, et autres
Publié: (2024)
ReCoQA: A Benchmark for Tool-Augmented and Multi-Step Reasoning in Real Estate Question and Answering
par: Zhang, Yindong, et autres
Publié: (2026)
par: Zhang, Yindong, et autres
Publié: (2026)
ConRAG: Consensus-Driven Multi-View Retrieval for Multi-Hop Question Answering
par: Zhu, Yikai, et autres
Publié: (2026)
par: Zhu, Yikai, et autres
Publié: (2026)
Inference Scaled GraphRAG: Improving Multi Hop Question Answering on Knowledge Graphs
par: Thompson, Travis, et autres
Publié: (2025)
par: Thompson, Travis, et autres
Publié: (2025)
FactCG: Enhancing Fact Checkers with Graph-Based Multi-Hop Data
par: Lei, Deren, et autres
Publié: (2025)
par: Lei, Deren, et autres
Publié: (2025)
Few-Shot Data Synthesis for Open Domain Multi-Hop Question Answering
par: Chen, Mingda, et autres
Publié: (2023)
par: Chen, Mingda, et autres
Publié: (2023)
FrugalRAG: Less is More in RL Finetuning for Multi-Hop Question Answering
par: Java, Abhinav, et autres
Publié: (2025)
par: Java, Abhinav, et autres
Publié: (2025)
Mitigating Lost-in-Retrieval Problems in Retrieval Augmented Multi-Hop Question Answering
par: Zhu, Rongzhi, et autres
Publié: (2025)
par: Zhu, Rongzhi, et autres
Publié: (2025)
Review-Then-Refine: A Dynamic Framework for Multi-Hop Question Answering with Temporal Adaptability
par: Chen, Xiangsen, et autres
Publié: (2024)
par: Chen, Xiangsen, et autres
Publié: (2024)
Documents similaires
-
Memory-Aware and Uncertainty-Guided Retrieval for Multi-Hop Question Answering
par: Ji, Yuelyu, et autres
Publié: (2025) -
Retrieval--Reasoning Processes for Multi-hop Question Answering: A Four-Axis Design Framework and Empirical Trends
par: Ji, Yuelyu, et autres
Publié: (2026) -
Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation
par: Ji, Yuelyu, et autres
Publié: (2025) -
ReasoningRank: Teaching Student Models to Rank through Reasoning-Based Knowledge Distillation
par: Ji, Yuelyu, et autres
Publié: (2024) -
Learning from Committee: Reasoning Distillation from a Mixture of Teachers with Peer-Review
par: Li, Zhuochun, et autres
Publié: (2024)