Synthetic Test Collections for Retrieval Evaluation
Fuente:
arXiv
Salvato in:
| Autori principali: | Rahmani, Hossein A., Craswell, Nick, Yilmaz, Emine, Mitra, Bhaskar, Campos, Daniel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Understanding Bias in Synthetic Data for Evaluation
di: Rahmani, Hossein A., et al.
Pubblicazione: (2025)
di: Rahmani, Hossein A., et al.
Pubblicazione: (2025)
SynDL: A Large-Scale Synthetic Test Collection for Passage Retrieval
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
Overview of the TREC 2021 deep learning track
di: Craswell, Nick, et al.
Pubblicazione: (2025)
di: Craswell, Nick, et al.
Pubblicazione: (2025)
JudgeBlender: Ensembling Judgments for Automatic Relevance Assessment
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
Overview of the TREC 2023 deep learning track
di: Craswell, Nick, et al.
Pubblicazione: (2025)
di: Craswell, Nick, et al.
Pubblicazione: (2025)
Overview of the TREC 2022 deep learning track
di: Craswell, Nick, et al.
Pubblicazione: (2025)
di: Craswell, Nick, et al.
Pubblicazione: (2025)
Report on the 1st Workshop on Large Language Model for Evaluation in Information Retrieval (LLM4Eval 2024) at SIGIR 2024
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
Judging the Judges: A Collection of LLM-Generated Relevance Judgements
di: Rahmani, Hossein A., et al.
Pubblicazione: (2025)
di: Rahmani, Hossein A., et al.
Pubblicazione: (2025)
Large language models can accurately predict searcher preferences
di: Thomas, Paul, et al.
Pubblicazione: (2023)
di: Thomas, Paul, et al.
Pubblicazione: (2023)
LLMJudge: LLMs for Relevance Judgments
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
Towards Group-aware Search Success
di: Wu, Haolun, et al.
Pubblicazione: (2024)
di: Wu, Haolun, et al.
Pubblicazione: (2024)
Understanding the Role of User Profile in the Personalization of Large Language Models
di: Wu, Bin, et al.
Pubblicazione: (2024)
di: Wu, Bin, et al.
Pubblicazione: (2024)
Support Evaluation for the TREC 2024 RAG Track: Comparing Human versus LLM Judges
di: Thakur, Nandan, et al.
Pubblicazione: (2025)
di: Thakur, Nandan, et al.
Pubblicazione: (2025)
Ragnarök: A Reusable RAG Framework and Baselines for TREC 2024 Retrieval-Augmented Generation Track
di: Pradeep, Ronak, et al.
Pubblicazione: (2024)
di: Pradeep, Ronak, et al.
Pubblicazione: (2024)
Sociotechnical Implications of Generative Artificial Intelligence for Information Access
di: Mitra, Bhaskar, et al.
Pubblicazione: (2024)
di: Mitra, Bhaskar, et al.
Pubblicazione: (2024)
SPECTRA: Synthetic IR Test Collections with Relevance Oracles and Controlled Distractor Diagnostics
di: Liang, Eric
Pubblicazione: (2026)
di: Liang, Eric
Pubblicazione: (2026)
Image-Seeking Intent Prediction for Cross-Device Product Search
di: Hendriksen, Mariya, et al.
Pubblicazione: (2025)
di: Hendriksen, Mariya, et al.
Pubblicazione: (2025)
Query-Conditioned Graph Retrieval for Contextualized LLM Reasoning in Personalized Wearable Data
di: Lu, Zhenyu, et al.
Pubblicazione: (2026)
di: Lu, Zhenyu, et al.
Pubblicazione: (2026)
A Personalized Framework for Consumer and Producer Group Fairness Optimization in Recommender Systems
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
AgentSearchBench: A Benchmark for AI Agent Search in the Wild
di: Wu, Bin, et al.
Pubblicazione: (2026)
di: Wu, Bin, et al.
Pubblicazione: (2026)
Clarifying the Path to User Satisfaction: An Investigation into Clarification Usefulness
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024)
Overview of the TREC 2025 Retrieval Augmented Generation (RAG) Track
di: Upadhyay, Shivani, et al.
Pubblicazione: (2026)
di: Upadhyay, Shivani, et al.
Pubblicazione: (2026)
InnoEval: On Research Idea Evaluation as a Knowledge-Grounded, Multi-Perspective Reasoning Problem
di: Qiao, Shuofei, et al.
Pubblicazione: (2026)
di: Qiao, Shuofei, et al.
Pubblicazione: (2026)
Interplay: Training Independent Simulators for Reference-Free Conversational Recommendation
di: Ramos, Jerome, et al.
Pubblicazione: (2026)
di: Ramos, Jerome, et al.
Pubblicazione: (2026)
Improving Vietnamese Legal Document Retrieval using Synthetic Data
di: Tien, Son Pham, et al.
Pubblicazione: (2024)
di: Tien, Son Pham, et al.
Pubblicazione: (2024)
Rethinking Hybrid Retrieval: When Small Embeddings and LLM Re-ranking Beat Bigger Models
di: Rao, Arjun, et al.
Pubblicazione: (2025)
di: Rao, Arjun, et al.
Pubblicazione: (2025)
InPars+: Supercharging Synthetic Data Generation for Information Retrieval Systems
di: Krastev, Matey, et al.
Pubblicazione: (2025)
di: Krastev, Matey, et al.
Pubblicazione: (2025)
Emancipatory Information Retrieval
di: Mitra, Bhaskar
Pubblicazione: (2025)
di: Mitra, Bhaskar
Pubblicazione: (2025)
Explainability of Text Processing and Retrieval Methods: A Survey
di: Saha, Sourav, et al.
Pubblicazione: (2022)
di: Saha, Sourav, et al.
Pubblicazione: (2022)
Generating Diverse Synthetic Datasets for Evaluation of Real-life Recommender Systems
di: Malenšek, Miha, et al.
Pubblicazione: (2024)
di: Malenšek, Miha, et al.
Pubblicazione: (2024)
StratRAG: A Multi-Hop Retrieval Evaluation Dataset for Retrieval-Augmented Generation Systems
di: Patodiya, Aryan
Pubblicazione: (2026)
di: Patodiya, Aryan
Pubblicazione: (2026)
TARSE: Test-Time Adaptation via Retrieval of Skills and Experience for Reasoning Agents
di: Wang, Junda, et al.
Pubblicazione: (2026)
di: Wang, Junda, et al.
Pubblicazione: (2026)
RAGe: A Retrieval-Augmented Generation Evaluation Framework
di: Guder, Larissa, et al.
Pubblicazione: (2026)
di: Guder, Larissa, et al.
Pubblicazione: (2026)
Information Access of the Oppressed: Freirean Design for Emancipatory Information Access
di: Mitra, Bhaskar, et al.
Pubblicazione: (2026)
di: Mitra, Bhaskar, et al.
Pubblicazione: (2026)
IRSC: A Zero-shot Evaluation Benchmark for Information Retrieval through Semantic Comprehension in Retrieval-Augmented Generation Scenarios
di: Lin, Hai, et al.
Pubblicazione: (2024)
di: Lin, Hai, et al.
Pubblicazione: (2024)
Evaluating Multi-Hop Reasoning in RAG Systems: A Comparison of LLM-Based Retriever Evaluation Strategies
di: Brehme, Lorenz, et al.
Pubblicazione: (2026)
di: Brehme, Lorenz, et al.
Pubblicazione: (2026)
TREC iKAT 2023: A Test Collection for Evaluating Conversational and Interactive Knowledge Assistants
di: Aliannejadi, Mohammad, et al.
Pubblicazione: (2024)
di: Aliannejadi, Mohammad, et al.
Pubblicazione: (2024)
PersianRAG: A Retrieval-Augmented Generation System for Persian Language
di: Hosseini, Hossein, et al.
Pubblicazione: (2024)
di: Hosseini, Hossein, et al.
Pubblicazione: (2024)
DICE: Discrete Interpretable Comparative Evaluation with Probabilistic Scoring for Retrieval-Augmented Generation
di: Liu, Shiyan, et al.
Pubblicazione: (2025)
di: Liu, Shiyan, et al.
Pubblicazione: (2025)
Modernizing Facebook Scoped Search: Keyword and Embedding Hybrid Retrieval with LLM Evaluation
di: Su, Yongye, et al.
Pubblicazione: (2025)
di: Su, Yongye, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Towards Understanding Bias in Synthetic Data for Evaluation
di: Rahmani, Hossein A., et al.
Pubblicazione: (2025) -
SynDL: A Large-Scale Synthetic Test Collection for Passage Retrieval
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024) -
Overview of the TREC 2021 deep learning track
di: Craswell, Nick, et al.
Pubblicazione: (2025) -
JudgeBlender: Ensembling Judgments for Automatic Relevance Assessment
di: Rahmani, Hossein A., et al.
Pubblicazione: (2024) -
Overview of the TREC 2023 deep learning track
di: Craswell, Nick, et al.
Pubblicazione: (2025)