Know Your RAG: Dataset Taxonomy and Generation Strategies for Evaluating RAG Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | de Lima, Rafael Teixeira, Gupta, Shubham, Berrospi, Cesar, Mishra, Lokesh, Dolfi, Michele, Staar, Peter, Vagenas, Panagiotis |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Statements: Universal Information Extraction from Tables with Large Language Models for ESG KPIs
par: Mishra, Lokesh, et autres
Publié: (2024)
par: Mishra, Lokesh, et autres
Publié: (2024)
ChemQuery: A Natural Language Query‐Driven Service for Comprehensive Exploration of Chemistry Patent Literature
par: Shubham Gupta, et autres
Publié: (2025)
par: Shubham Gupta, et autres
Publié: (2025)
ESG Accountability Made Easy: DocQA at Your Service
par: Mishra, Lokesh, et autres
Publié: (2023)
par: Mishra, Lokesh, et autres
Publié: (2023)
SoK: Agentic Retrieval-Augmented Generation (RAG): Taxonomy, Architectures, Evaluation, and Research Directions
par: Mishra, Saroj, et autres
Publié: (2026)
par: Mishra, Saroj, et autres
Publié: (2026)
NyayaRAG: Realistic Legal Judgment Prediction with RAG under the Indian Common Law System
par: Nigam, Shubham Kumar, et autres
Publié: (2025)
par: Nigam, Shubham Kumar, et autres
Publié: (2025)
RAGtifier: Evaluating RAG Generation Approaches of State-of-the-Art RAG Systems for the SIGIR LiveRAG Competition
par: Cofala, Tim, et autres
Publié: (2025)
par: Cofala, Tim, et autres
Publié: (2025)
RAGEval: Scenario Specific RAG Evaluation Dataset Generation Framework
par: Zhu, Kunlun, et autres
Publié: (2024)
par: Zhu, Kunlun, et autres
Publié: (2024)
Causal-Counterfactual RAG: The Integration of Causal-Counterfactual Reasoning into RAG
par: Khadilkar, Harshad, et autres
Publié: (2025)
par: Khadilkar, Harshad, et autres
Publié: (2025)
StratRAG: A Multi-Hop Retrieval Evaluation Dataset for Retrieval-Augmented Generation Systems
par: Patodiya, Aryan
Publié: (2026)
par: Patodiya, Aryan
Publié: (2026)
RAG Playground: A Framework for Systematic Evaluation of Retrieval Strategies and Prompt Engineering in RAG Systems
par: Papadimitriou, Ioannis, et autres
Publié: (2024)
par: Papadimitriou, Ioannis, et autres
Publié: (2024)
RAG vs. GraphRAG: A Systematic Evaluation and Key Insights
par: Han, Haoyu, et autres
Publié: (2025)
par: Han, Haoyu, et autres
Publié: (2025)
Can LLMs Be Trusted for Evaluating RAG Systems? A Survey of Methods and Datasets
par: Brehme, Lorenz, et autres
Publié: (2025)
par: Brehme, Lorenz, et autres
Publié: (2025)
The Viability of Crowdsourcing for RAG Evaluation
par: Gienapp, Lukas, et autres
Publié: (2025)
par: Gienapp, Lukas, et autres
Publié: (2025)
Orchestrating Specialized Agents for Trustworthy Enterprise RAG
par: You, Xincheng, et autres
Publié: (2026)
par: You, Xincheng, et autres
Publié: (2026)
TC-RAG:Turing-Complete RAG's Case study on Medical LLM Systems
par: Jiang, Xinke, et autres
Publié: (2024)
par: Jiang, Xinke, et autres
Publié: (2024)
AMAQA: A Metadata-based QA Dataset for RAG Systems
par: Bruni, Davide, et autres
Publié: (2025)
par: Bruni, Davide, et autres
Publié: (2025)
Worse than Zero-shot? A Fact-Checking Dataset for Evaluating the Robustness of RAG Against Misleading Retrievals
par: Zeng, Linda, et autres
Publié: (2025)
par: Zeng, Linda, et autres
Publié: (2025)
Do We Still Need GraphRAG? Benchmarking RAG and GraphRAG for Agentic Search Systems
par: Fan, Dongzhe, et autres
Publié: (2026)
par: Fan, Dongzhe, et autres
Publié: (2026)
Evaluating Multi-Hop Reasoning in RAG Systems: A Comparison of LLM-Based Retriever Evaluation Strategies
par: Brehme, Lorenz, et autres
Publié: (2026)
par: Brehme, Lorenz, et autres
Publié: (2026)
HtmlRAG: HTML is Better Than Plain Text for Modeling Retrieved Knowledge in RAG Systems
par: Tan, Jiejun, et autres
Publié: (2024)
par: Tan, Jiejun, et autres
Publié: (2024)
Knowing When Not to Answer: Lightweight KB-Aligned OOD Detection for Safe RAG
par: Triantafyllopoulos, Ilias, et autres
Publié: (2025)
par: Triantafyllopoulos, Ilias, et autres
Publié: (2025)
WeKnow-RAG: An Adaptive Approach for Retrieval-Augmented Generation Integrating Web Search and Knowledge Graphs
par: Xie, Weijian, et autres
Publié: (2024)
par: Xie, Weijian, et autres
Publié: (2024)
RAG-IGBench: Innovative Evaluation for RAG-based Interleaved Generation in Open-domain Question Answering
par: Zhang, Rongyang, et autres
Publié: (2025)
par: Zhang, Rongyang, et autres
Publié: (2025)
RAGRouter-Bench: A Dataset and Benchmark for Adaptive RAG Routing
par: Wang, Ziqi, et autres
Publié: (2026)
par: Wang, Ziqi, et autres
Publié: (2026)
LURE-RAG: Lightweight Utility-driven Reranking for Efficient RAG
par: Chandra, Manish, et autres
Publié: (2026)
par: Chandra, Manish, et autres
Publié: (2026)
MHTS: Multi-Hop Tree Structure Framework for Generating Difficulty-Controllable QA Datasets for RAG Evaluation
par: Lee, Jeongsoo, et autres
Publié: (2025)
par: Lee, Jeongsoo, et autres
Publié: (2025)
Your RAG is Unfair: Exposing Fairness Vulnerabilities in Retrieval-Augmented Generation via Backdoor Attacks
par: Bagwe, Gaurav, et autres
Publié: (2025)
par: Bagwe, Gaurav, et autres
Publié: (2025)
Is Relevance Propagated from Retriever to Generator in RAG?
par: Tian, Fangzheng, et autres
Publié: (2025)
par: Tian, Fangzheng, et autres
Publié: (2025)
Constructing and Evaluating Declarative RAG Pipelines in PyTerrier
par: Macdonald, Craig, et autres
Publié: (2025)
par: Macdonald, Craig, et autres
Publié: (2025)
LARAG: Link-Aware Retrieval Strategy for RAG Systems in Hyperlinked Technical Documentation
par: Bolognesi, Giorgia, et autres
Publié: (2026)
par: Bolognesi, Giorgia, et autres
Publié: (2026)
Modular RAG: Transforming RAG Systems into LEGO-like Reconfigurable Frameworks
par: Gao, Yunfan, et autres
Publié: (2024)
par: Gao, Yunfan, et autres
Publié: (2024)
PersonaRAG: Enhancing Retrieval-Augmented Generation Systems with User-Centric Agents
par: Zerhoudi, Saber, et autres
Publié: (2024)
par: Zerhoudi, Saber, et autres
Publié: (2024)
DMQR-RAG: Diverse Multi-Query Rewriting for RAG
par: Li, Zhicong, et autres
Publié: (2024)
par: Li, Zhicong, et autres
Publié: (2024)
Who Stole Your Data? A Method for Detecting Unauthorized RAG Theft
par: Liu, Peiyang, et autres
Publié: (2025)
par: Liu, Peiyang, et autres
Publié: (2025)
Knowing You Don't Know: Learning When to Continue Search in Multi-round RAG through Self-Practicing
par: Yang, Diji, et autres
Publié: (2025)
par: Yang, Diji, et autres
Publié: (2025)
Generating Diverse Q&A Benchmarks for RAG Evaluation with DataMorgana
par: Filice, Simone, et autres
Publié: (2025)
par: Filice, Simone, et autres
Publié: (2025)
Optimizing Query Generation for Enhanced Document Retrieval in RAG
par: Koo, Hamin, et autres
Publié: (2024)
par: Koo, Hamin, et autres
Publié: (2024)
Controlled Retrieval-augmented Context Evaluation for Long-form RAG
par: Ju, Jia-Huei, et autres
Publié: (2025)
par: Ju, Jia-Huei, et autres
Publié: (2025)
KET-RAG: A Cost-Efficient Multi-Granular Indexing Framework for Graph-RAG
par: Huang, Yiqian, et autres
Publié: (2025)
par: Huang, Yiqian, et autres
Publié: (2025)
LegalRAG: A Hybrid RAG System for Multilingual Legal Information Retrieval
par: Kabir, Muhammad Rafsan, et autres
Publié: (2025)
par: Kabir, Muhammad Rafsan, et autres
Publié: (2025)
Documents similaires
-
Statements: Universal Information Extraction from Tables with Large Language Models for ESG KPIs
par: Mishra, Lokesh, et autres
Publié: (2024) -
ChemQuery: A Natural Language Query‐Driven Service for Comprehensive Exploration of Chemistry Patent Literature
par: Shubham Gupta, et autres
Publié: (2025) -
ESG Accountability Made Easy: DocQA at Your Service
par: Mishra, Lokesh, et autres
Publié: (2023) -
SoK: Agentic Retrieval-Augmented Generation (RAG): Taxonomy, Architectures, Evaluation, and Research Directions
par: Mishra, Saroj, et autres
Publié: (2026) -
NyayaRAG: Realistic Legal Judgment Prediction with RAG under the Indian Common Law System
par: Nigam, Shubham Kumar, et autres
Publié: (2025)