Towards Robust Evaluation: A Comprehensive Taxonomy of Datasets and Metrics for Open Domain Question Answering in the Era of Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Srivastava, Akchay, Memon, Atif |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Harnessing Multi-Role Capabilities of Large Language Models for Open-Domain Question Answering
por: Sun, Hongda, et al.
Publicado: (2024)
por: Sun, Hongda, et al.
Publicado: (2024)
Evaluation of RAG Metrics for Question Answering in the Telecom Domain
por: Roychowdhury, Sujoy, et al.
Publicado: (2024)
por: Roychowdhury, Sujoy, et al.
Publicado: (2024)
Evaluating Multimodal Large Language Models on Educational Textbook Question Answering
por: Alawwad, Hessa A., et al.
Publicado: (2025)
por: Alawwad, Hessa A., et al.
Publicado: (2025)
Improving the Domain Adaptation of Retrieval Augmented Generation (RAG) Models for Open Domain Question Answering
por: Siriwardhana, Shamane, et al.
Publicado: (2022)
por: Siriwardhana, Shamane, et al.
Publicado: (2022)
Retrieval Augmented Generation for Domain-specific Question Answering
por: Sharma, Sanat, et al.
Publicado: (2024)
por: Sharma, Sanat, et al.
Publicado: (2024)
Reasoning on Efficient Knowledge Paths:Knowledge Graph Guides Large Language Model for Domain Question Answering
por: Wang, Yuqi, et al.
Publicado: (2024)
por: Wang, Yuqi, et al.
Publicado: (2024)
Verif.ai: Towards an Open-Source Scientific Generative Question-Answering System with Referenced and Verifiable Answers
por: Košprdić, Miloš, et al.
Publicado: (2024)
por: Košprdić, Miloš, et al.
Publicado: (2024)
Hierarchical Retrieval with Evidence Curation for Open-Domain Financial Question Answering on Standardized Documents
por: Choe, Jaeyoung, et al.
Publicado: (2025)
por: Choe, Jaeyoung, et al.
Publicado: (2025)
Comprehensive and Practical Evaluation of Retrieval-Augmented Generation Systems for Medical Question Answering
por: Ngo, Nghia Trung, et al.
Publicado: (2024)
por: Ngo, Nghia Trung, et al.
Publicado: (2024)
HealthBranches: Synthesizing Clinically-Grounded Question Answering Datasets via Decision Pathways
por: Cosentino, Cristian, et al.
Publicado: (2025)
por: Cosentino, Cristian, et al.
Publicado: (2025)
MizanQA: Benchmarking Large Language Models on Moroccan Legal Question Answering
por: Bahaj, Adil, et al.
Publicado: (2025)
por: Bahaj, Adil, et al.
Publicado: (2025)
Large Language Models Meet Knowledge Graphs for Question Answering: Synthesis and Opportunities
por: Ma, Chuangtao, et al.
Publicado: (2025)
por: Ma, Chuangtao, et al.
Publicado: (2025)
Enhancing Question Answering for Enterprise Knowledge Bases using Large Language Models
por: Jiang, Feihu, et al.
Publicado: (2024)
por: Jiang, Feihu, et al.
Publicado: (2024)
W-RAG: Weakly Supervised Dense Retrieval in RAG for Open-domain Question Answering
por: Nian, Jinming, et al.
Publicado: (2024)
por: Nian, Jinming, et al.
Publicado: (2024)
MetaGen Blended RAG: Unlocking Zero-Shot Precision for Specialized Domain Question-Answering
por: Sawarkar, Kunal, et al.
Publicado: (2025)
por: Sawarkar, Kunal, et al.
Publicado: (2025)
UQA: Corpus for Urdu Question Answering
por: Arif, Samee, et al.
Publicado: (2024)
por: Arif, Samee, et al.
Publicado: (2024)
Robust Training for Conversational Question Answering Models with Reinforced Reformulation Generation
por: Kaiser, Magdalena, et al.
Publicado: (2023)
por: Kaiser, Magdalena, et al.
Publicado: (2023)
RAG-IGBench: Innovative Evaluation for RAG-based Interleaved Generation in Open-domain Question Answering
por: Zhang, Rongyang, et al.
Publicado: (2025)
por: Zhang, Rongyang, et al.
Publicado: (2025)
On Synthesizing Data for Context Attribution in Question Answering
por: Radevski, Gorjan, et al.
Publicado: (2025)
por: Radevski, Gorjan, et al.
Publicado: (2025)
Enriching Taxonomies Using Large Language Models
por: Ghamlouch, Zeinab, et al.
Publicado: (2025)
por: Ghamlouch, Zeinab, et al.
Publicado: (2025)
LLM-MedQA: Enhancing Medical Question Answering through Case Studies in Large Language Models
por: Yang, Hang, et al.
Publicado: (2024)
por: Yang, Hang, et al.
Publicado: (2024)
Understanding Survey Paper Taxonomy about Large Language Models via Graph Representation Learning
por: Zhuang, Jun, et al.
Publicado: (2024)
por: Zhuang, Jun, et al.
Publicado: (2024)
The Factuality of Large Language Models in the Legal Domain
por: Hamdani, Rajaa El, et al.
Publicado: (2024)
por: Hamdani, Rajaa El, et al.
Publicado: (2024)
Advancing Chart Question Answering with Robust Chart Component Recognition
por: Zheng, Hanwen, et al.
Publicado: (2024)
por: Zheng, Hanwen, et al.
Publicado: (2024)
MapQA: Open-domain Geospatial Question Answering on Map Data
por: Li, Zekun, et al.
Publicado: (2025)
por: Li, Zekun, et al.
Publicado: (2025)
Refining Wikidata Taxonomy using Large Language Models
por: Peng, Yiwen, et al.
Publicado: (2024)
por: Peng, Yiwen, et al.
Publicado: (2024)
LFQA-HP-1M: A Large-Scale Human Preference Dataset for Long-Form Question Answering
por: Jahan, Rafid Ishrak, et al.
Publicado: (2026)
por: Jahan, Rafid Ishrak, et al.
Publicado: (2026)
Rethinking Legal Judgement Prediction in a Realistic Scenario in the Era of Large Language Models
por: Nigam, Shubham Kumar, et al.
Publicado: (2024)
por: Nigam, Shubham Kumar, et al.
Publicado: (2024)
Evaluating Search Engines and Large Language Models for Answering Health Questions
por: Fernández-Pichel, Marcos, et al.
Publicado: (2024)
por: Fernández-Pichel, Marcos, et al.
Publicado: (2024)
Case-Based Reasoning Approach for Solving Financial Question Answering
por: Kim, Yikyung, et al.
Publicado: (2024)
por: Kim, Yikyung, et al.
Publicado: (2024)
Multilingual Non-Factoid Question Answering with Answer Paragraph Selection
por: Mishra, Ritwik, et al.
Publicado: (2024)
por: Mishra, Ritwik, et al.
Publicado: (2024)
PeerQA: A Scientific Question Answering Dataset from Peer Reviews
por: Baumgärtner, Tim, et al.
Publicado: (2025)
por: Baumgärtner, Tim, et al.
Publicado: (2025)
IRPAPERS: A Visual Document Benchmark for Scientific Retrieval and Question Answering
por: Shorten, Connor, et al.
Publicado: (2026)
por: Shorten, Connor, et al.
Publicado: (2026)
MUST-RAG: MUSical Text Question Answering with Retrieval Augmented Generation
por: Kwon, Daeyong, et al.
Publicado: (2025)
por: Kwon, Daeyong, et al.
Publicado: (2025)
Learning from Natural Language Feedback for Personalized Question Answering
por: Salemi, Alireza, et al.
Publicado: (2025)
por: Salemi, Alireza, et al.
Publicado: (2025)
FinAgentBench: A Benchmark Dataset for Agentic Retrieval in Financial Question Answering
por: Choi, Chanyeol, et al.
Publicado: (2025)
por: Choi, Chanyeol, et al.
Publicado: (2025)
RuleRAG: Rule-Guided Retrieval-Augmented Generation with Language Models for Question Answering
por: Chen, Zhongwu, et al.
Publicado: (2024)
por: Chen, Zhongwu, et al.
Publicado: (2024)
VerifAI: A Verifiable Open-Source Search Engine for Biomedical Question Answering
por: Košprdić, Miloš, et al.
Publicado: (2026)
por: Košprdić, Miloš, et al.
Publicado: (2026)
Multi-hop Question Answering
por: Mavi, Vaibhav, et al.
Publicado: (2022)
por: Mavi, Vaibhav, et al.
Publicado: (2022)
Integrating Domain Knowledge into Large Language Models for Enhanced Fashion Recommendations
por: Shi, Zhan, et al.
Publicado: (2025)
por: Shi, Zhan, et al.
Publicado: (2025)
Ejemplares similares
-
Harnessing Multi-Role Capabilities of Large Language Models for Open-Domain Question Answering
por: Sun, Hongda, et al.
Publicado: (2024) -
Evaluation of RAG Metrics for Question Answering in the Telecom Domain
por: Roychowdhury, Sujoy, et al.
Publicado: (2024) -
Evaluating Multimodal Large Language Models on Educational Textbook Question Answering
por: Alawwad, Hessa A., et al.
Publicado: (2025) -
Improving the Domain Adaptation of Retrieval Augmented Generation (RAG) Models for Open Domain Question Answering
por: Siriwardhana, Shamane, et al.
Publicado: (2022) -
Retrieval Augmented Generation for Domain-specific Question Answering
por: Sharma, Sanat, et al.
Publicado: (2024)