Practical RAG Evaluation: A Rarity-Aware Set-Based Metric and Cost-Latency-Quality Trade-offs
Fuente:
arXiv
Saved in:
| Main Author: | Dallaire, Etienne |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Evaluating Cost-Accuracy Trade-offs in Multimodal Search Relevance Judgements
by: Terragni, Silvia, et al.
Published: (2024)
by: Terragni, Silvia, et al.
Published: (2024)
KET-RAG: A Cost-Efficient Multi-Granular Indexing Framework for Graph-RAG
by: Huang, Yiqian, et al.
Published: (2025)
by: Huang, Yiqian, et al.
Published: (2025)
Ensembles at Any Cost? Accuracy-Energy Trade-offs in Recommender Systems
by: Nitschke, Jannik, et al.
Published: (2026)
by: Nitschke, Jannik, et al.
Published: (2026)
ReMindRAG: Low-Cost LLM-Guided Knowledge Graph Traversal for Efficient RAG
by: Hu, Yikuan, et al.
Published: (2025)
by: Hu, Yikuan, et al.
Published: (2025)
Adaptive Quality-Diversity Trade-offs for Large-Scale Batch Recommendation
by: Réda, Clémence, et al.
Published: (2026)
by: Réda, Clémence, et al.
Published: (2026)
Negation is Not Semantic: Diagnosing Dense Retrieval Failure Modes for Trade-offs in Contradiction-Aware Biomedical QA
by: Sahoo, Soumya Ranjan, et al.
Published: (2026)
by: Sahoo, Soumya Ranjan, et al.
Published: (2026)
RAG vs. GraphRAG: A Systematic Evaluation and Key Insights
by: Han, Haoyu, et al.
Published: (2025)
by: Han, Haoyu, et al.
Published: (2025)
Topological Metric for Unsupervised Embedding Quality Evaluation
by: Shestov, Aleksei, et al.
Published: (2025)
by: Shestov, Aleksei, et al.
Published: (2025)
The Viability of Crowdsourcing for RAG Evaluation
by: Gienapp, Lukas, et al.
Published: (2025)
by: Gienapp, Lukas, et al.
Published: (2025)
On Efficiency-Effectiveness Trade-off of Diffusion-based Recommenders
by: Mao, Wenyu, et al.
Published: (2025)
by: Mao, Wenyu, et al.
Published: (2025)
A2RAG: Adaptive Agentic Graph Retrieval for Cost-Aware and Reliable Reasoning
by: Liu, Jiate, et al.
Published: (2026)
by: Liu, Jiate, et al.
Published: (2026)
More Clustering Quality Metrics for ABCDE
by: van Staden, Stephan
Published: (2024)
by: van Staden, Stephan
Published: (2024)
The Efficiency vs. Accuracy Trade-off: Optimizing RAG-Enhanced LLM Recommender Systems Using Multi-Head Early Exit
by: Zhou, Huixue, et al.
Published: (2025)
by: Zhou, Huixue, et al.
Published: (2025)
Resolving the Robustness-Precision Trade-off in Financial RAG through Hybrid Document-Routed Retrieval
by: Cheng, Zhiyuan, et al.
Published: (2026)
by: Cheng, Zhiyuan, et al.
Published: (2026)
On the Evaluation Metric for Hashing
by: Jiang, Qing-Yuan, et al.
Published: (2019)
by: Jiang, Qing-Yuan, et al.
Published: (2019)
A Systematic Study of Biomedical Retrieval Pipeline Trade-offs in Performance and Efficiency
by: Stepanyan, Hayk, et al.
Published: (2026)
by: Stepanyan, Hayk, et al.
Published: (2026)
Rank4Gen: RAG-Preference-Aligned Document Set Selection and Ranking
by: Fan, Yongqi, et al.
Published: (2026)
by: Fan, Yongqi, et al.
Published: (2026)
METIS: Fast Quality-Aware RAG Systems with Configuration Adaptation
by: Ray, Siddhant, et al.
Published: (2024)
by: Ray, Siddhant, et al.
Published: (2024)
Pointwise Metrics for Clustering Evaluation
by: van Staden, Stephan
Published: (2024)
by: van Staden, Stephan
Published: (2024)
Evaluating Hybrid Retrieval Augmented Generation using Dynamic Test Sets: LiveRAG Challenge
by: Fensore, Chase, et al.
Published: (2025)
by: Fensore, Chase, et al.
Published: (2025)
Doctor-RAG: Failure-Aware Repair for Agentic Retrieval-Augmented Generation
by: Jiao, Shuguang, et al.
Published: (2026)
by: Jiao, Shuguang, et al.
Published: (2026)
Understanding Accuracy-Fairness Trade-offs in Re-ranking through Elasticity in Economics
by: Xu, Chen, et al.
Published: (2025)
by: Xu, Chen, et al.
Published: (2025)
Constructing and Evaluating Declarative RAG Pipelines in PyTerrier
by: Macdonald, Craig, et al.
Published: (2025)
by: Macdonald, Craig, et al.
Published: (2025)
Sustainability Evaluation Metrics for Recommender Systems
by: Felfernig, Alexander, et al.
Published: (2025)
by: Felfernig, Alexander, et al.
Published: (2025)
SSE: A Metric for Evaluating Search System Explainability
by: Chen, Catherine, et al.
Published: (2023)
by: Chen, Catherine, et al.
Published: (2023)
Heterogeneous Multi-treatment Uplift Modeling for Trade-off Optimization in Short-Video Recommendation
by: Zhai, Chenhao, et al.
Published: (2025)
by: Zhai, Chenhao, et al.
Published: (2025)
Controlled Retrieval-augmented Context Evaluation for Long-form RAG
by: Ju, Jia-Huei, et al.
Published: (2025)
by: Ju, Jia-Huei, et al.
Published: (2025)
Trust or Abstain? A Self-Aware RAG Approach
by: Zhu, Xi, et al.
Published: (2026)
by: Zhu, Xi, et al.
Published: (2026)
Evaluating Multi-Hop Reasoning in RAG Systems: A Comparison of LLM-Based Retriever Evaluation Strategies
by: Brehme, Lorenz, et al.
Published: (2026)
by: Brehme, Lorenz, et al.
Published: (2026)
LiteSemRAG: Lightweight LLM-Free Semantic-Aware Graph Retrieval for Robust RAG
by: Yue, Xiao, et al.
Published: (2026)
by: Yue, Xiao, et al.
Published: (2026)
RankArena: A Unified Platform for Evaluating Retrieval, Reranking and RAG with Human and LLM Feedback
by: Abdallah, Abdelrahman, et al.
Published: (2025)
by: Abdallah, Abdelrahman, et al.
Published: (2025)
LURE-RAG: Lightweight Utility-driven Reranking for Efficient RAG
by: Chandra, Manish, et al.
Published: (2026)
by: Chandra, Manish, et al.
Published: (2026)
Know Your RAG: Dataset Taxonomy and Generation Strategies for Evaluating RAG Systems
by: de Lima, Rafael Teixeira, et al.
Published: (2024)
by: de Lima, Rafael Teixeira, et al.
Published: (2024)
The Hidden Cost of Defaults in Recommender System Evaluation
by: Berling, Hannah, et al.
Published: (2025)
by: Berling, Hannah, et al.
Published: (2025)
CARROT: A Learned Cost-Constrained Retrieval Optimization System for RAG
by: Wang, Ziting, et al.
Published: (2024)
by: Wang, Ziting, et al.
Published: (2024)
Clue-RAG: Towards Accurate and Cost-Efficient Graph-based RAG via Multi-Partite Graph and Query-Driven Iterative Retrieval
by: Su, Yaodong, et al.
Published: (2025)
by: Su, Yaodong, et al.
Published: (2025)
TC-RAG:Turing-Complete RAG's Case study on Medical LLM Systems
by: Jiang, Xinke, et al.
Published: (2024)
by: Jiang, Xinke, et al.
Published: (2024)
Towards More Robust Retrieval-Augmented Generation: Evaluating RAG Under Adversarial Poisoning Attacks
by: Su, Jinyan, et al.
Published: (2024)
by: Su, Jinyan, et al.
Published: (2024)
HaS: Accelerating RAG through Homology-Aware Speculative Retrieval
by: Peng, Peng, et al.
Published: (2026)
by: Peng, Peng, et al.
Published: (2026)
Cost-Effective, Low Latency Vector Search with Azure Cosmos DB
by: Upreti, Nitish, et al.
Published: (2025)
by: Upreti, Nitish, et al.
Published: (2025)
Similar Items
-
Evaluating Cost-Accuracy Trade-offs in Multimodal Search Relevance Judgements
by: Terragni, Silvia, et al.
Published: (2024) -
KET-RAG: A Cost-Efficient Multi-Granular Indexing Framework for Graph-RAG
by: Huang, Yiqian, et al.
Published: (2025) -
Ensembles at Any Cost? Accuracy-Energy Trade-offs in Recommender Systems
by: Nitschke, Jannik, et al.
Published: (2026) -
ReMindRAG: Low-Cost LLM-Guided Knowledge Graph Traversal for Efficient RAG
by: Hu, Yikuan, et al.
Published: (2025) -
Adaptive Quality-Diversity Trade-offs for Large-Scale Batch Recommendation
by: Réda, Clémence, et al.
Published: (2026)