GenTREC: The First Test Collection Generated by Large Language Models for Evaluating Information Retrieval Systems
Fuente:
arXiv
Guardado en:
| Autores principales: | Türkmen, Mehmet Deniz, Kutlu, Mucahid, Altun, Bahadir, Cosgun, Gokalp |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Overview of TREC 2024 Biomedical Generative Retrieval (BioGen) Track
por: Gupta, Deepak, et al.
Publicado: (2024)
por: Gupta, Deepak, et al.
Publicado: (2024)
Overview of TREC 2025 Biomedical Generative Retrieval (BioGen) Track
por: Gupta, Deepak, et al.
Publicado: (2026)
por: Gupta, Deepak, et al.
Publicado: (2026)
Overview of the TREC 2025 Retrieval Augmented Generation (RAG) Track
por: Upadhyay, Shivani, et al.
Publicado: (2026)
por: Upadhyay, Shivani, et al.
Publicado: (2026)
Team IELAB at TREC Clinical Trial Track 2023: Enhancing Clinical Trial Retrieval with Neural Rankers and Large Language Models
por: Zhuang, Shengyao, et al.
Publicado: (2024)
por: Zhuang, Shengyao, et al.
Publicado: (2024)
MIRA: An LLM-Assisted Benchmark for Multi-Category Integrated Retrieval
por: Türkmen, Mehmet Deniz, et al.
Publicado: (2026)
por: Türkmen, Mehmet Deniz, et al.
Publicado: (2026)
TREC iKAT 2023: A Test Collection for Evaluating Conversational and Interactive Knowledge Assistants
por: Aliannejadi, Mohammad, et al.
Publicado: (2024)
por: Aliannejadi, Mohammad, et al.
Publicado: (2024)
An Evaluation Framework for Attributed Information Retrieval using Large Language Models
por: Djeddal, Hanane, et al.
Publicado: (2024)
por: Djeddal, Hanane, et al.
Publicado: (2024)
Synthetic Test Collections for Retrieval Evaluation
por: Rahmani, Hossein A., et al.
Publicado: (2024)
por: Rahmani, Hossein A., et al.
Publicado: (2024)
RALI@TREC iKAT 2024: Achieving Personalization via Retrieval Fusion in Conversational Search
por: Hui, Yuchen, et al.
Publicado: (2024)
por: Hui, Yuchen, et al.
Publicado: (2024)
Retrieval-in-the-Chain: Bootstrapping Large Language Models for Generative Retrieval
por: Zhang, Yingchen, et al.
Publicado: (2025)
por: Zhang, Yingchen, et al.
Publicado: (2025)
STCALIR: Semi-Synthetic Test Collection for Algerian Legal Information Retrieval
por: Hatem, M'hamed Amine, et al.
Publicado: (2026)
por: Hatem, M'hamed Amine, et al.
Publicado: (2026)
Hi-Gen: Generative Retrieval For Large-Scale Personalized E-commerce Search
por: Wu, Yanjing, et al.
Publicado: (2024)
por: Wu, Yanjing, et al.
Publicado: (2024)
NeuCLIRBench: A Modern Evaluation Collection for Monolingual, Cross-Language, and Multilingual Information Retrieval
por: Lawrie, Dawn, et al.
Publicado: (2025)
por: Lawrie, Dawn, et al.
Publicado: (2025)
SynDL: A Large-Scale Synthetic Test Collection for Passage Retrieval
por: Rahmani, Hossein A., et al.
Publicado: (2024)
por: Rahmani, Hossein A., et al.
Publicado: (2024)
Generative Information Retrieval Evaluation
por: Alaofi, Marwah, et al.
Publicado: (2024)
por: Alaofi, Marwah, et al.
Publicado: (2024)
Overview of the TREC 2024 NeuCLIR Track
por: Lawrie, Dawn, et al.
Publicado: (2025)
por: Lawrie, Dawn, et al.
Publicado: (2025)
Overview of the TREC 2025 Tip-of-the-Tongue track
por: Arguello, Jaime, et al.
Publicado: (2026)
por: Arguello, Jaime, et al.
Publicado: (2026)
HLTCOE at TREC 2024 NeuCLIR Track
por: Yang, Eugene, et al.
Publicado: (2025)
por: Yang, Eugene, et al.
Publicado: (2025)
Overview of the TREC 2023 NeuCLIR Track
por: Lawrie, Dawn, et al.
Publicado: (2024)
por: Lawrie, Dawn, et al.
Publicado: (2024)
Measuring Hypothesis Testing Errors in the Evaluation of Retrieval Systems
por: McKechnie, Jack, et al.
Publicado: (2025)
por: McKechnie, Jack, et al.
Publicado: (2025)
LLM4Tag: Automatic Tagging System for Information Retrieval via Large Language Models
por: Tang, Ruiming, et al.
Publicado: (2025)
por: Tang, Ruiming, et al.
Publicado: (2025)
Context-augmented Retrieval: A Novel Framework for Fast Information Retrieval based Response Generation using Large Language Model
por: Ganesh, Sai, et al.
Publicado: (2024)
por: Ganesh, Sai, et al.
Publicado: (2024)
Large Language Models vs. Search Engines: Evaluating User Preferences Across Varied Information Retrieval Scenarios
por: Caramancion, Kevin Matthe
Publicado: (2024)
por: Caramancion, Kevin Matthe
Publicado: (2024)
Interactions with Generative Information Retrieval Systems
por: Aliannejadi, Mohammad, et al.
Publicado: (2024)
por: Aliannejadi, Mohammad, et al.
Publicado: (2024)
Towards Reliable Testing for Multiple Information Retrieval System Comparisons
por: Otero, David, et al.
Publicado: (2025)
por: Otero, David, et al.
Publicado: (2025)
Collaborative Retrieval for Large Language Model-based Conversational Recommender Systems
por: Zhu, Yaochen, et al.
Publicado: (2025)
por: Zhu, Yaochen, et al.
Publicado: (2025)
A Survey of Large Language Model Empowered Agents for Recommendation and Search: Towards Next-Generation Information Retrieval
por: Zhang, Yu, et al.
Publicado: (2025)
por: Zhang, Yu, et al.
Publicado: (2025)
REANIMATOR: Reanimate Retrieval Test Collections with Extracted and Synthetic Resources
por: Engelmann, Björn, et al.
Publicado: (2025)
por: Engelmann, Björn, et al.
Publicado: (2025)
Ragnarök: A Reusable RAG Framework and Baselines for TREC 2024 Retrieval-Augmented Generation Track
por: Pradeep, Ronak, et al.
Publicado: (2024)
por: Pradeep, Ronak, et al.
Publicado: (2024)
Unsupervised Large Language Model Alignment for Information Retrieval via Contrastive Feedback
por: Dong, Qian, et al.
Publicado: (2023)
por: Dong, Qian, et al.
Publicado: (2023)
Overview of the TREC 2025 RAGTIME Track
por: Lawrie, Dawn, et al.
Publicado: (2026)
por: Lawrie, Dawn, et al.
Publicado: (2026)
Revisiting Human-vs-LLM judgments using the TREC Podcast Track
por: Mansour, Watheq, et al.
Publicado: (2026)
por: Mansour, Watheq, et al.
Publicado: (2026)
Limitations of Automatic Relevance Assessments with Large Language Models for Fair and Reliable Retrieval Evaluation
por: Otero, David, et al.
Publicado: (2024)
por: Otero, David, et al.
Publicado: (2024)
Report on the 1st Workshop on Large Language Model for Evaluation in Information Retrieval (LLM4Eval 2024) at SIGIR 2024
por: Rahmani, Hossein A., et al.
Publicado: (2024)
por: Rahmani, Hossein A., et al.
Publicado: (2024)
Evaluating Large Language Models for Cross-Lingual Retrieval
por: Zuo, Longfei, et al.
Publicado: (2025)
por: Zuo, Longfei, et al.
Publicado: (2025)
Metadata-based Data Exploration with Retrieval-Augmented Generation for Large Language Models
por: Hayashi, Teruaki, et al.
Publicado: (2024)
por: Hayashi, Teruaki, et al.
Publicado: (2024)
Carbon Footprint Accounting Driven by Large Language Models and Retrieval-augmented Generation
por: Wang, Haijin, et al.
Publicado: (2024)
por: Wang, Haijin, et al.
Publicado: (2024)
Beyond Benchmarks: Evaluating Embedding Model Similarity for Retrieval Augmented Generation Systems
por: Caspari, Laura, et al.
Publicado: (2024)
por: Caspari, Laura, et al.
Publicado: (2024)
PASH at TREC 2021 Deep Learning Track: Generative Enhanced Model for Multi-stage Ranking
por: Qiao, Yixuan, et al.
Publicado: (2022)
por: Qiao, Yixuan, et al.
Publicado: (2022)
On the Robustness of Generative Information Retrieval Models
por: Liu, Yu-An, et al.
Publicado: (2024)
por: Liu, Yu-An, et al.
Publicado: (2024)
Ejemplares similares
-
Overview of TREC 2024 Biomedical Generative Retrieval (BioGen) Track
por: Gupta, Deepak, et al.
Publicado: (2024) -
Overview of TREC 2025 Biomedical Generative Retrieval (BioGen) Track
por: Gupta, Deepak, et al.
Publicado: (2026) -
Overview of the TREC 2025 Retrieval Augmented Generation (RAG) Track
por: Upadhyay, Shivani, et al.
Publicado: (2026) -
Team IELAB at TREC Clinical Trial Track 2023: Enhancing Clinical Trial Retrieval with Neural Rankers and Large Language Models
por: Zhuang, Shengyao, et al.
Publicado: (2024) -
MIRA: An LLM-Assisted Benchmark for Multi-Category Integrated Retrieval
por: Türkmen, Mehmet Deniz, et al.
Publicado: (2026)