Magic Mushroom: A Customizable Benchmark for Fine-grained Analysis of Retrieval Noise Erosion in RAG Systems
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yuxin, Wang, Yan, Chen, Yongrui, Zhang, Shenyu, Dai, Xinbang, Bi, Sheng, Qi, Guilin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
After Retrieval, Before Generation: Enhancing the Trustworthiness of Large Language Models in Retrieval-Augmented Generation
di: Dai, Xinbang, et al.
Pubblicazione: (2025)
di: Dai, Xinbang, et al.
Pubblicazione: (2025)
StressEval: Failure-Driven Dynamic Benchmarking for Knowledge-Intensive Reasoning in Large Language Models
di: Chen, Yongrui, et al.
Pubblicazione: (2026)
di: Chen, Yongrui, et al.
Pubblicazione: (2026)
Pandora: Leveraging Code-driven Knowledge Transfer for Unified Structured Knowledge Reasoning
di: Chen, Yongrui, et al.
Pubblicazione: (2025)
di: Chen, Yongrui, et al.
Pubblicazione: (2025)
Pandora: A Code-Driven Large Language Model Agent for Unified Reasoning Across Diverse Structured Knowledge
di: Chen, Yongrui, et al.
Pubblicazione: (2025)
di: Chen, Yongrui, et al.
Pubblicazione: (2025)
MIKE: A New Benchmark for Fine-grained Multimodal Entity Knowledge Editing
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
Question Answering Over Spatio-Temporal Knowledge Graph
di: Dai, Xinbang, et al.
Pubblicazione: (2024)
di: Dai, Xinbang, et al.
Pubblicazione: (2024)
DEE: Dual-stage Explainable Evaluation Method for Text Generation
di: Zhang, Shenyu, et al.
Pubblicazione: (2024)
di: Zhang, Shenyu, et al.
Pubblicazione: (2024)
K-DeCore: Facilitating Knowledge Transfer in Continual Structured Knowledge Reasoning via Knowledge Decoupling
di: Chen, Yongrui, et al.
Pubblicazione: (2025)
di: Chen, Yongrui, et al.
Pubblicazione: (2025)
Table-r1: Self-supervised and Reinforcement Learning for Program-based Table Reasoning in Small Language Models
di: Jin, Rihui, et al.
Pubblicazione: (2025)
di: Jin, Rihui, et al.
Pubblicazione: (2025)
MATEval: A Multi-Agent Discussion Framework for Advancing Open-Ended Text Evaluation
di: Li, Yu, et al.
Pubblicazione: (2024)
di: Li, Yu, et al.
Pubblicazione: (2024)
OneEval: Benchmarking LLM Knowledge-intensive Reasoning over Diverse Knowledge Bases
di: Chen, Yongrui, et al.
Pubblicazione: (2025)
di: Chen, Yongrui, et al.
Pubblicazione: (2025)
Large Language Models Can Better Understand Knowledge Graphs Than We Thought
di: Dai, Xinbang, et al.
Pubblicazione: (2024)
di: Dai, Xinbang, et al.
Pubblicazione: (2024)
Can LLMs Evaluate Complex Attribution in QA? Automatic Benchmarking using Knowledge Graphs
di: Hu, Nan, et al.
Pubblicazione: (2024)
di: Hu, Nan, et al.
Pubblicazione: (2024)
PRIMO: Progressive Induction for Multi-hop Open Rule Generation
di: Liu, Jianyu, et al.
Pubblicazione: (2024)
di: Liu, Jianyu, et al.
Pubblicazione: (2024)
ELAIPBench: A Benchmark for Expert-Level Artificial Intelligence Paper Understanding
di: Dai, Xinbang, et al.
Pubblicazione: (2025)
di: Dai, Xinbang, et al.
Pubblicazione: (2025)
DoG-Instruct: Towards Premium Instruction-Tuning Data via Text-Grounded Instruction Wrapping
di: Chen, Yongrui, et al.
Pubblicazione: (2023)
di: Chen, Yongrui, et al.
Pubblicazione: (2023)
Fine-grained Claim-level RAG Benchmark for Law
di: Das, Souvick, et al.
Pubblicazione: (2026)
di: Das, Souvick, et al.
Pubblicazione: (2026)
The Power of Noise: Redefining Retrieval for RAG Systems
di: Cuconasu, Florin, et al.
Pubblicazione: (2024)
di: Cuconasu, Florin, et al.
Pubblicazione: (2024)
FunnelRAG: A Coarse-to-Fine Progressive Retrieval Paradigm for RAG
di: Zhao, Xinping, et al.
Pubblicazione: (2024)
di: Zhao, Xinping, et al.
Pubblicazione: (2024)
CFVBench: A Comprehensive Video Benchmark for Fine-grained Multimodal Retrieval-Augmented Generation
di: Wei, Kaiwen, et al.
Pubblicazione: (2025)
di: Wei, Kaiwen, et al.
Pubblicazione: (2025)
HeGTa: Leveraging Heterogeneous Graph-enhanced Large Language Models for Few-shot Complex Table Understanding
di: Jin, Rihui, et al.
Pubblicazione: (2024)
di: Jin, Rihui, et al.
Pubblicazione: (2024)
FT-RAG: A Fine-grained Retrieval-Augmented Generation Framework for Complex Table Reasoning
di: Guo, Zebin, et al.
Pubblicazione: (2026)
di: Guo, Zebin, et al.
Pubblicazione: (2026)
User-centric Subjective Leaderboard by Customizable Reward Modeling
di: Jia, Qi, et al.
Pubblicazione: (2025)
di: Jia, Qi, et al.
Pubblicazione: (2025)
CROLoss: Towards a Customizable Loss for Retrieval Models in Recommender Systems
di: Tang, Yongxiang, et al.
Pubblicazione: (2022)
di: Tang, Yongxiang, et al.
Pubblicazione: (2022)
MentalManip: A Dataset For Fine-grained Analysis of Mental Manipulation in Conversations
di: Wang, Yuxin, et al.
Pubblicazione: (2024)
di: Wang, Yuxin, et al.
Pubblicazione: (2024)
Zero-RAG: Towards Retrieval-Augmented Generation with Zero Redundant Knowledge
di: Luo, Qi, et al.
Pubblicazione: (2025)
di: Luo, Qi, et al.
Pubblicazione: (2025)
FollowTable: A Benchmark for Instruction-Following Table Retrieval
di: Jin, Rihui, et al.
Pubblicazione: (2026)
di: Jin, Rihui, et al.
Pubblicazione: (2026)
FedRAG: A Framework for Fine-Tuning Retrieval-Augmented Generation Systems
di: Fajardo, Val Andrei, et al.
Pubblicazione: (2025)
di: Fajardo, Val Andrei, et al.
Pubblicazione: (2025)
NaviRAG: Towards Active Knowledge Navigation for Retrieval-Augmented Generation
di: Dai, Jihao, et al.
Pubblicazione: (2026)
di: Dai, Jihao, et al.
Pubblicazione: (2026)
RAGChecker: A Fine-grained Framework for Diagnosing Retrieval-Augmented Generation
di: Ru, Dongyu, et al.
Pubblicazione: (2024)
di: Ru, Dongyu, et al.
Pubblicazione: (2024)
Know3-RAG: A Knowledge-aware RAG Framework with Adaptive Retrieval, Generation, and Filtering
di: Liu, Xukai, et al.
Pubblicazione: (2025)
di: Liu, Xukai, et al.
Pubblicazione: (2025)
Unveiling the Magic: Investigating Attention Distillation in Retrieval-augmented Generation
di: Li, Zizhong, et al.
Pubblicazione: (2024)
di: Li, Zizhong, et al.
Pubblicazione: (2024)
XATU: A Fine-grained Instruction-based Benchmark for Explainable Text Updates
di: Zhang, Haopeng, et al.
Pubblicazione: (2023)
di: Zhang, Haopeng, et al.
Pubblicazione: (2023)
CLaw: Benchmarking Chinese Legal Knowledge in Large Language Models - A Fine-grained Corpus and Reasoning Analysis
di: Xu, Xinzhe, et al.
Pubblicazione: (2025)
di: Xu, Xinzhe, et al.
Pubblicazione: (2025)
Reinforcement Retrieval Leveraging Fine-grained Feedback for Fact Checking News Claims with Black-Box LLM
di: Zhang, Xuan, et al.
Pubblicazione: (2024)
di: Zhang, Xuan, et al.
Pubblicazione: (2024)
AgenticRAGTracer: A Hop-Aware Benchmark for Diagnosing Multi-Step Retrieval Reasoning in Agentic RAG
di: You, Qijie, et al.
Pubblicazione: (2026)
di: You, Qijie, et al.
Pubblicazione: (2026)
Capability Salience Vector: Fine-grained Alignment of Loss and Capabilities for Downstream Task Scaling Law
di: Ge, Qiming, et al.
Pubblicazione: (2025)
di: Ge, Qiming, et al.
Pubblicazione: (2025)
RPC-Bench: A Fine-grained Benchmark for Research Paper Comprehension
di: Chen, Yelin, et al.
Pubblicazione: (2026)
di: Chen, Yelin, et al.
Pubblicazione: (2026)
RefChecker: Reference-based Fine-grained Hallucination Checker and Benchmark for Large Language Models
di: Hu, Xiangkun, et al.
Pubblicazione: (2024)
di: Hu, Xiangkun, et al.
Pubblicazione: (2024)
FollowBench: A Multi-level Fine-grained Constraints Following Benchmark for Large Language Models
di: Jiang, Yuxin, et al.
Pubblicazione: (2023)
di: Jiang, Yuxin, et al.
Pubblicazione: (2023)
Documenti analoghi
-
After Retrieval, Before Generation: Enhancing the Trustworthiness of Large Language Models in Retrieval-Augmented Generation
di: Dai, Xinbang, et al.
Pubblicazione: (2025) -
StressEval: Failure-Driven Dynamic Benchmarking for Knowledge-Intensive Reasoning in Large Language Models
di: Chen, Yongrui, et al.
Pubblicazione: (2026) -
Pandora: Leveraging Code-driven Knowledge Transfer for Unified Structured Knowledge Reasoning
di: Chen, Yongrui, et al.
Pubblicazione: (2025) -
Pandora: A Code-Driven Large Language Model Agent for Unified Reasoning Across Diverse Structured Knowledge
di: Chen, Yongrui, et al.
Pubblicazione: (2025) -
MIKE: A New Benchmark for Fine-grained Multimodal Entity Knowledge Editing
di: Li, Jiaqi, et al.
Pubblicazione: (2024)