RAG-Zeval: Towards Robust and Interpretable Evaluation on RAG Responses through End-to-End Rule-Guided Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Kun, Li, Yunxiang, Zhang, Tianhua, Luo, Hongyin, Wu, Xixin, Glass, James, Meng, Helen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TreePS-RAG: Tree-based Process Supervision for Reinforcement Learning in Agentic RAG
par: Zhang, Tianhua, et autres
Publié: (2026)
par: Zhang, Tianhua, et autres
Publié: (2026)
Decoding on Graphs: Faithful and Sound Reasoning on Knowledge Graphs through Generation of Well-Formed Chains
par: Li, Kun, et autres
Publié: (2024)
par: Li, Kun, et autres
Publié: (2024)
Adaptive Query Rewriting: Aligning Rewriters through Marginal Probability of Conversational Answers
par: Zhang, Tianhua, et autres
Publié: (2024)
par: Zhang, Tianhua, et autres
Publié: (2024)
Generate, Discriminate, Evolve: Enhancing Context Faithfulness via Fine-Grained Sentence-Level Self-Evolution
par: Li, Kun, et autres
Publié: (2025)
par: Li, Kun, et autres
Publié: (2025)
Natural Language Embedded Programs for Hybrid Language Symbolic Reasoning
par: Zhang, Tianhua, et autres
Publié: (2023)
par: Zhang, Tianhua, et autres
Publié: (2023)
End-to-End Agentic RAG System Training for Traceable Diagnostic Reasoning
par: Zheng, Qiaoyu, et autres
Publié: (2025)
par: Zheng, Qiaoyu, et autres
Publié: (2025)
OpenRAG: Optimizing RAG End-to-End via In-Context Retrieval Learning
par: Zhou, Jiawei, et autres
Publié: (2025)
par: Zhou, Jiawei, et autres
Publié: (2025)
Devising a Set of Compact and Explainable Spoken Language Feature for Screening Alzheimer's Disease
par: Li, Junan, et autres
Publié: (2024)
par: Li, Junan, et autres
Publié: (2024)
Towards Agentic RAG with Deep Reasoning: A Survey of RAG-Reasoning Systems in LLMs
par: Li, Yangning, et autres
Publié: (2025)
par: Li, Yangning, et autres
Publié: (2025)
Stochastic RAG: End-to-End Retrieval-Augmented Generation through Expected Utility Maximization
par: Zamani, Hamed, et autres
Publié: (2024)
par: Zamani, Hamed, et autres
Publié: (2024)
EmoRAG: Evaluating RAG Robustness to Symbolic Perturbations
par: Zhou, Xinyun, et autres
Publié: (2025)
par: Zhou, Xinyun, et autres
Publié: (2025)
Graph-R1: Towards Agentic GraphRAG Framework via End-to-end Reinforcement Learning
par: Luo, Haoran, et autres
Publié: (2025)
par: Luo, Haoran, et autres
Publié: (2025)
An End-to-End Ukrainian RAG for Local Deployment. Optimized Hybrid Search and Lightweight Generation
par: Trokhymovych, Mykola, et autres
Publié: (2026)
par: Trokhymovych, Mykola, et autres
Publié: (2026)
BioRAG: A RAG-LLM Framework for Biological Question Reasoning
par: Wang, Chengrui, et autres
Publié: (2024)
par: Wang, Chengrui, et autres
Publié: (2024)
THREAD: Thinking Deeper with Recursive Spawning
par: Schroeder, Philip, et autres
Publié: (2024)
par: Schroeder, Philip, et autres
Publié: (2024)
SIRAG: Towards Stable and Interpretable RAG with A Process-Supervised Multi-Agent Framework
par: Wang, Junlin, et autres
Publié: (2025)
par: Wang, Junlin, et autres
Publié: (2025)
Rethinking Machine Ethics -- Can LLMs Perform Moral Reasoning through the Lens of Moral Theories?
par: Zhou, Jingyan, et autres
Publié: (2023)
par: Zhou, Jingyan, et autres
Publié: (2023)
ROVER: Recursive Reasoning Over Videos with Vision-Language Models for Embodied Tasks
par: Schroeder, Philip, et autres
Publié: (2025)
par: Schroeder, Philip, et autres
Publié: (2025)
RQ-RAG: Learning to Refine Queries for Retrieval Augmented Generation
par: Chan, Chi-Min, et autres
Publié: (2024)
par: Chan, Chi-Min, et autres
Publié: (2024)
CARE-RAG - Clinical Assessment and Reasoning in RAG
par: Potluri, Deepthi, et autres
Publié: (2025)
par: Potluri, Deepthi, et autres
Publié: (2025)
End-to-End Chatbot Evaluation with Adaptive Reasoning and Uncertainty Filtering
par: Dang, Nhi, et autres
Publié: (2026)
par: Dang, Nhi, et autres
Publié: (2026)
RuleRAG: Rule-Guided Retrieval-Augmented Generation with Language Models for Question Answering
par: Chen, Zhongwu, et autres
Publié: (2024)
par: Chen, Zhongwu, et autres
Publié: (2024)
UR$^2$: Unify RAG and Reasoning through Reinforcement Learning
par: Li, Weitao, et autres
Publié: (2025)
par: Li, Weitao, et autres
Publié: (2025)
Towards End-to-End Model-Agnostic Explanations for RAG Systems
par: Sudhi, Viju, et autres
Publié: (2025)
par: Sudhi, Viju, et autres
Publié: (2025)
Causal-Counterfactual RAG: The Integration of Causal-Counterfactual Reasoning into RAG
par: Khadilkar, Harshad, et autres
Publié: (2025)
par: Khadilkar, Harshad, et autres
Publié: (2025)
LatentRAG: Latent Reasoning and Retrieval for Efficient Agentic RAG
par: Zheng, Yijia, et autres
Publié: (2026)
par: Zheng, Yijia, et autres
Publié: (2026)
Zero-RAG: Towards Retrieval-Augmented Generation with Zero Redundant Knowledge
par: Luo, Qi, et autres
Publié: (2025)
par: Luo, Qi, et autres
Publié: (2025)
Truth or Mirage? Towards End-to-End Factuality Evaluation with LLM-Oasis
par: Scirè, Alessandro, et autres
Publié: (2024)
par: Scirè, Alessandro, et autres
Publié: (2024)
URO-Bench: Towards Comprehensive Evaluation for End-to-End Spoken Dialogue Models
par: Yan, Ruiqi, et autres
Publié: (2025)
par: Yan, Ruiqi, et autres
Publié: (2025)
Beyond Factual Accuracy: Evaluating Global Reasoning Integrity in RAG Systems with LogicScore
par: Yan, Zhichao, et autres
Publié: (2026)
par: Yan, Zhichao, et autres
Publié: (2026)
Injecting linguistic knowledge into BERT for Dialogue State Tracking
par: Feng, Xiaohan, et autres
Publié: (2023)
par: Feng, Xiaohan, et autres
Publié: (2023)
TextlessRAG: End-to-End Visual Document RAG by Speech Without Text
par: Xie, Peijin, et autres
Publié: (2025)
par: Xie, Peijin, et autres
Publié: (2025)
Purple-teaming LLMs with Adversarial Defender Training
par: Zhou, Jingyan, et autres
Publié: (2024)
par: Zhou, Jingyan, et autres
Publié: (2024)
Generating Leakage-Free Benchmarks for Robust RAG Evaluation
par: Liu, Jiayi, et autres
Publié: (2026)
par: Liu, Jiayi, et autres
Publié: (2026)
DistRAG: Towards Distance-Based Spatial Reasoning in LLMs
par: Schneider, Nicole R, et autres
Publié: (2025)
par: Schneider, Nicole R, et autres
Publié: (2025)
Retrieval is Not Enough: Enhancing RAG Reasoning through Test-Time Critique and Optimization
par: Wei, Jiaqi, et autres
Publié: (2025)
par: Wei, Jiaqi, et autres
Publié: (2025)
WavBench: Benchmarking Reasoning, Colloquialism, and Paralinguistics for End-to-End Spoken Dialogue Models
par: Li, Yangzhuo, et autres
Publié: (2026)
par: Li, Yangzhuo, et autres
Publié: (2026)
From Large to Super-Tiny: End-to-End Optimization for Cost-Efficient LLMs
par: Ni, Jiliang, et autres
Publié: (2025)
par: Ni, Jiliang, et autres
Publié: (2025)
The Multi-Round Diagnostic RAG Framework for Emulating Clinical Reasoning
par: Sun, Penglei, et autres
Publié: (2025)
par: Sun, Penglei, et autres
Publié: (2025)
PrismRAG: Boosting RAG Factuality with Distractor Resilience and Strategized Reasoning
par: Kachuee, Mohammad, et autres
Publié: (2025)
par: Kachuee, Mohammad, et autres
Publié: (2025)
Documents similaires
-
TreePS-RAG: Tree-based Process Supervision for Reinforcement Learning in Agentic RAG
par: Zhang, Tianhua, et autres
Publié: (2026) -
Decoding on Graphs: Faithful and Sound Reasoning on Knowledge Graphs through Generation of Well-Formed Chains
par: Li, Kun, et autres
Publié: (2024) -
Adaptive Query Rewriting: Aligning Rewriters through Marginal Probability of Conversational Answers
par: Zhang, Tianhua, et autres
Publié: (2024) -
Generate, Discriminate, Evolve: Enhancing Context Faithfulness via Fine-Grained Sentence-Level Self-Evolution
par: Li, Kun, et autres
Publié: (2025) -
Natural Language Embedded Programs for Hybrid Language Symbolic Reasoning
par: Zhang, Tianhua, et autres
Publié: (2023)