DoGMaTiQ: Automated Generation of Question-and-Answer Nuggets for Report Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Bryan, Walden, William, Hou, Yu, Liu, Gabrielle Kaili-May, Lawrie, Dawn, Mayfield, Jame, Yang, Eugene, Callison-Burch, Chris, Dietz, Laura |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Incorporating Q&A Nuggets into Retrieval-Augmented Generation
por: Dietz, Laura, et al.
Publicado: (2026)
por: Dietz, Laura, et al.
Publicado: (2026)
Insider Knowledge: How Much Can RAG Systems Gain from Evaluation Secrets?
por: Dietz, Laura, et al.
Publicado: (2026)
por: Dietz, Laura, et al.
Publicado: (2026)
Auto-ARGUE: LLM-Based Report Generation Evaluation
por: Walden, William, et al.
Publicado: (2025)
por: Walden, William, et al.
Publicado: (2025)
HLTCOE at TREC 2023 NeuCLIR Track
por: Yang, Eugene, et al.
Publicado: (2024)
por: Yang, Eugene, et al.
Publicado: (2024)
Distillation for Multilingual Information Retrieval
por: Yang, Eugene, et al.
Publicado: (2024)
por: Yang, Eugene, et al.
Publicado: (2024)
HLTCOE at TREC 2024 NeuCLIR Track
por: Yang, Eugene, et al.
Publicado: (2025)
por: Yang, Eugene, et al.
Publicado: (2025)
Investigating Retrieval-Augmented Generation Systems on Unanswerable, Uncheatable, Realistic, Multi-hop Queries
por: Liu, Gabrielle Kaili-May, et al.
Publicado: (2025)
por: Liu, Gabrielle Kaili-May, et al.
Publicado: (2025)
Language Fairness in Multilingual Information Retrieval
por: Yang, Eugene, et al.
Publicado: (2024)
por: Yang, Eugene, et al.
Publicado: (2024)
RoutIR: Fast Serving of Retrieval Pipelines for Retrieval-Augmented Generation
por: Yang, Eugene, et al.
Publicado: (2026)
por: Yang, Eugene, et al.
Publicado: (2026)
Extending Translate-Train for ColBERT-X to African Language CLIR
por: Yang, Eugene, et al.
Publicado: (2024)
por: Yang, Eugene, et al.
Publicado: (2024)
Translate-Distill: Learning Cross-Language Dense Retrieval by Translation and Distillation
por: Yang, Eugene, et al.
Publicado: (2024)
por: Yang, Eugene, et al.
Publicado: (2024)
PLAID SHIRTTT for Large-Scale Streaming Dense Retrieval
por: Lawrie, Dawn, et al.
Publicado: (2024)
por: Lawrie, Dawn, et al.
Publicado: (2024)
Efficiency-Effectiveness Tradeoff of Probabilistic Structured Queries for Cross-Language Information Retrieval
por: Yang, Eugene, et al.
Publicado: (2024)
por: Yang, Eugene, et al.
Publicado: (2024)
Overview of the TREC 2025 RAGTIME Track
por: Lawrie, Dawn, et al.
Publicado: (2026)
por: Lawrie, Dawn, et al.
Publicado: (2026)
Overview of the TREC 2024 NeuCLIR Track
por: Lawrie, Dawn, et al.
Publicado: (2025)
por: Lawrie, Dawn, et al.
Publicado: (2025)
Overview of the TREC 2023 NeuCLIR Track
por: Lawrie, Dawn, et al.
Publicado: (2024)
por: Lawrie, Dawn, et al.
Publicado: (2024)
MedNuggetizer: Confidence-Based Information Nugget Extraction from Medical Documents
por: Donabauer, Gregor, et al.
Publicado: (2025)
por: Donabauer, Gregor, et al.
Publicado: (2025)
MURR: Model Updating with Regularized Replay for Searching a Document Stream
por: Yang, Eugene, et al.
Publicado: (2025)
por: Yang, Eugene, et al.
Publicado: (2025)
LANCER: LLM Reranking for Nugget Coverage
por: Ju, Jia-Huei, et al.
Publicado: (2026)
por: Ju, Jia-Huei, et al.
Publicado: (2026)
Beyond Relevance: On the Relationship Between Retrieval and RAG Information Coverage
por: Samuel, Saron, et al.
Publicado: (2026)
por: Samuel, Saron, et al.
Publicado: (2026)
HLTCOE at LiveRAG: GPT-Researcher using ColBERT retrieval
por: Duh, Kevin, et al.
Publicado: (2025)
por: Duh, Kevin, et al.
Publicado: (2025)
NeuCLIRTech: Chinese Monolingual and Cross-Language Information Retrieval Evaluation in a Challenging Domain
por: Lawrie, Dawn, et al.
Publicado: (2026)
por: Lawrie, Dawn, et al.
Publicado: (2026)
NeuCLIRBench: A Modern Evaluation Collection for Monolingual, Cross-Language, and Multilingual Information Retrieval
por: Lawrie, Dawn, et al.
Publicado: (2025)
por: Lawrie, Dawn, et al.
Publicado: (2025)
Defending Against Disinformation Attacks in Open-Domain Question Answering
por: Weller, Orion, et al.
Publicado: (2022)
por: Weller, Orion, et al.
Publicado: (2022)
Principled Context Engineering for RAG: Statistical Guarantees via Conformal Prediction
por: Chakraborty, Debashish, et al.
Publicado: (2025)
por: Chakraborty, Debashish, et al.
Publicado: (2025)
Initial Nugget Evaluation Results for the TREC 2024 RAG Track with the AutoNuggetizer Framework
por: Pradeep, Ronak, et al.
Publicado: (2024)
por: Pradeep, Ronak, et al.
Publicado: (2024)
NevIR: Negation in Neural Information Retrieval
por: Weller, Orion, et al.
Publicado: (2023)
por: Weller, Orion, et al.
Publicado: (2023)
The Great Nugget Recall: Automating Fact Extraction and RAG Evaluation with Large Language Models
por: Pradeep, Ronak, et al.
Publicado: (2025)
por: Pradeep, Ronak, et al.
Publicado: (2025)
NuggetIndex: Governed Atomic Retrieval for Maintainable RAG
por: Zerhoudi, Saber, et al.
Publicado: (2026)
por: Zerhoudi, Saber, et al.
Publicado: (2026)
Answer Retrieval in Legal Community Question Answering
por: Askari, Arian, et al.
Publicado: (2024)
por: Askari, Arian, et al.
Publicado: (2024)
mmBERT: A Modern Multilingual Encoder with Annealed Language Learning
por: Marone, Marc, et al.
Publicado: (2025)
por: Marone, Marc, et al.
Publicado: (2025)
Rank1: Test-Time Compute for Reranking in Information Retrieval
por: Weller, Orion, et al.
Publicado: (2025)
por: Weller, Orion, et al.
Publicado: (2025)
Rank-K: Test-Time Reasoning for Listwise Reranking
por: Yang, Eugene, et al.
Publicado: (2025)
por: Yang, Eugene, et al.
Publicado: (2025)
CoverageBench: Evaluating Information Coverage across Tasks and Domains
por: Samuel, Saron, et al.
Publicado: (2026)
por: Samuel, Saron, et al.
Publicado: (2026)
On the Evaluation of Machine-Generated Reports
por: Mayfield, James, et al.
Publicado: (2024)
por: Mayfield, James, et al.
Publicado: (2024)
GINGER: Grounded Information Nugget-Based Generation of Responses
por: Łajewska, Weronika, et al.
Publicado: (2025)
por: Łajewska, Weronika, et al.
Publicado: (2025)
Conversational Gold: Evaluating Personalized Conversational Search System using Gold Nuggets
por: Abbasiantaeb, Zahra, et al.
Publicado: (2025)
por: Abbasiantaeb, Zahra, et al.
Publicado: (2025)
Chatbot Arena Meets Nuggets: Towards Explanations and Diagnostics in the Evaluation of LLM Responses
por: Sharifymoghaddam, Sahel, et al.
Publicado: (2025)
por: Sharifymoghaddam, Sahel, et al.
Publicado: (2025)
UiS-IAI@LiveRAG: Retrieval-Augmented Information Nugget-Based Generation of Responses
por: Łajewska, Weronika, et al.
Publicado: (2025)
por: Łajewska, Weronika, et al.
Publicado: (2025)
Estimating the Usefulness of Clarifying Questions and Answers for Conversational Search
por: Sekulić, Ivan, et al.
Publicado: (2024)
por: Sekulić, Ivan, et al.
Publicado: (2024)
Ejemplares similares
-
Incorporating Q&A Nuggets into Retrieval-Augmented Generation
por: Dietz, Laura, et al.
Publicado: (2026) -
Insider Knowledge: How Much Can RAG Systems Gain from Evaluation Secrets?
por: Dietz, Laura, et al.
Publicado: (2026) -
Auto-ARGUE: LLM-Based Report Generation Evaluation
por: Walden, William, et al.
Publicado: (2025) -
HLTCOE at TREC 2023 NeuCLIR Track
por: Yang, Eugene, et al.
Publicado: (2024) -
Distillation for Multilingual Information Retrieval
por: Yang, Eugene, et al.
Publicado: (2024)