Syn-QA2: Evaluating False Assumptions in Long-tail Questions with Synthetic QA Datasets
Fuente:
arXiv
Salvato in:
| Autori principali: | Daswani, Ashwin, Sawant, Rohan, Kim, Najoung |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PolQA: Polish Question Answering Dataset
di: Rybak, Piotr, et al.
Pubblicazione: (2022)
di: Rybak, Piotr, et al.
Pubblicazione: (2022)
FinTextQA: A Dataset for Long-form Financial Question Answering
di: Chen, Jian, et al.
Pubblicazione: (2024)
di: Chen, Jian, et al.
Pubblicazione: (2024)
RJUA-QA: A Comprehensive QA Dataset for Urology
di: Lyu, Shiwei, et al.
Pubblicazione: (2023)
di: Lyu, Shiwei, et al.
Pubblicazione: (2023)
LiteraryQA: Towards Effective Evaluation of Long-document Narrative QA
di: Bonomo, Tommaso, et al.
Pubblicazione: (2025)
di: Bonomo, Tommaso, et al.
Pubblicazione: (2025)
GRS-QA -- Graph Reasoning-Structured Question Answering Dataset
di: Pahilajani, Anish, et al.
Pubblicazione: (2024)
di: Pahilajani, Anish, et al.
Pubblicazione: (2024)
FoQA: A Faroese Question-Answering Dataset
di: Simonsen, Annika, et al.
Pubblicazione: (2025)
di: Simonsen, Annika, et al.
Pubblicazione: (2025)
DebateQA: Evaluating Question Answering on Debatable Knowledge
di: Xu, Rongwu, et al.
Pubblicazione: (2024)
di: Xu, Rongwu, et al.
Pubblicazione: (2024)
Give me Some Hard Questions: Synthetic Data Generation for Clinical QA
di: Bai, Fan, et al.
Pubblicazione: (2024)
di: Bai, Fan, et al.
Pubblicazione: (2024)
AirQA: A Comprehensive QA Dataset for AI Research with Instance-Level Evaluation
di: Huang, Tiancheng, et al.
Pubblicazione: (2025)
di: Huang, Tiancheng, et al.
Pubblicazione: (2025)
KET-QA: A Dataset for Knowledge Enhanced Table Question Answering
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
BioGraphletQA: Knowledge-Anchored Generation of Complex QA Datasets
di: Jonker, Richard A. A., et al.
Pubblicazione: (2026)
di: Jonker, Richard A. A., et al.
Pubblicazione: (2026)
ArabicaQA: A Comprehensive Dataset for Arabic Question Answering
di: Abdallah, Abdelrahman, et al.
Pubblicazione: (2024)
di: Abdallah, Abdelrahman, et al.
Pubblicazione: (2024)
Compound-QA: A Benchmark for Evaluating LLMs on Compound Questions
di: Hou, Yutao, et al.
Pubblicazione: (2024)
di: Hou, Yutao, et al.
Pubblicazione: (2024)
Identifying and Answering Questions with False Assumptions: An Interpretable Approach
di: Wang, Zijie, et al.
Pubblicazione: (2025)
di: Wang, Zijie, et al.
Pubblicazione: (2025)
SEC-QA: A Systematic Evaluation Corpus for Financial QA
di: Lai, Viet Dac, et al.
Pubblicazione: (2024)
di: Lai, Viet Dac, et al.
Pubblicazione: (2024)
SyllabusQA: A Course Logistics Question Answering Dataset
di: Fernandez, Nigel, et al.
Pubblicazione: (2024)
di: Fernandez, Nigel, et al.
Pubblicazione: (2024)
JDocQA: Japanese Document Question Answering Dataset for Generative Language Models
di: Onami, Eri, et al.
Pubblicazione: (2024)
di: Onami, Eri, et al.
Pubblicazione: (2024)
CondAmbigQA: A Benchmark and Dataset for Conditional Ambiguous Question Answering
di: Li, Zongxi, et al.
Pubblicazione: (2025)
di: Li, Zongxi, et al.
Pubblicazione: (2025)
CUS-QA: Local-Knowledge-Oriented Open-Ended Question Answering Dataset
di: Libovický, Jindřich, et al.
Pubblicazione: (2025)
di: Libovický, Jindřich, et al.
Pubblicazione: (2025)
EduVidQA: Generating and Evaluating Long-form Answers to Student Questions based on Lecture Videos
di: Ray, Sourjyadip, et al.
Pubblicazione: (2025)
di: Ray, Sourjyadip, et al.
Pubblicazione: (2025)
DocTabQA: Answering Questions from Long Documents Using Tables
di: Wang, Haochen, et al.
Pubblicazione: (2024)
di: Wang, Haochen, et al.
Pubblicazione: (2024)
Long-Span Question-Answering: Automatic Question Generation and QA-System Ranking via Side-by-Side Evaluation
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
JBE-QA: Japanese Bar Exam QA Dataset for Assessing Legal Domain Knowledge
di: Cao, Zhihan, et al.
Pubblicazione: (2025)
di: Cao, Zhihan, et al.
Pubblicazione: (2025)
RAG-QA Arena: Evaluating Domain Robustness for Long-form Retrieval Augmented Question Answering
di: Han, Rujun, et al.
Pubblicazione: (2024)
di: Han, Rujun, et al.
Pubblicazione: (2024)
M2QA: Multi-domain Multilingual Question Answering
di: Engländer, Leon, et al.
Pubblicazione: (2024)
di: Engländer, Leon, et al.
Pubblicazione: (2024)
ComplexTempQA:A 100m Dataset for Complex Temporal Question Answering
di: Gruber, Raphael, et al.
Pubblicazione: (2024)
di: Gruber, Raphael, et al.
Pubblicazione: (2024)
LFQA-E: Carefully Benchmarking Long-form QA Evaluation
di: Fan, Yuchen, et al.
Pubblicazione: (2024)
di: Fan, Yuchen, et al.
Pubblicazione: (2024)
DetectiveQA: Evaluating Long-Context Reasoning on Detective Novels
di: Xu, Zhe, et al.
Pubblicazione: (2024)
di: Xu, Zhe, et al.
Pubblicazione: (2024)
HumMusQA: A Human-written Music Understanding QA Benchmark Dataset
di: Weck, Benno, et al.
Pubblicazione: (2026)
di: Weck, Benno, et al.
Pubblicazione: (2026)
Generalizing Visual Question Answering from Synthetic to Human-Written Questions via a Chain of QA with a Large Language Model
di: Kim, Taehee, et al.
Pubblicazione: (2024)
di: Kim, Taehee, et al.
Pubblicazione: (2024)
DisastQA: A Comprehensive Benchmark for Evaluating Question Answering in Disaster Management
di: Chen, Zhitong, et al.
Pubblicazione: (2026)
di: Chen, Zhitong, et al.
Pubblicazione: (2026)
SciFaultyQA: Benchmarking LLMs on Faulty Science Question Detection with a GAN-Inspired Approach to Synthetic Dataset Generation
di: Kundu, Debarshi
Pubblicazione: (2024)
di: Kundu, Debarshi
Pubblicazione: (2024)
DocFinQA: A Long-Context Financial Reasoning Dataset
di: Reddy, Varshini, et al.
Pubblicazione: (2024)
di: Reddy, Varshini, et al.
Pubblicazione: (2024)
MedExQA: Medical Question Answering Benchmark with Multiple Explanations
di: Kim, Yunsoo, et al.
Pubblicazione: (2024)
di: Kim, Yunsoo, et al.
Pubblicazione: (2024)
RephQA: Evaluating Readability of Large Language Models in Public Health Question Answering
di: Qiu, Weikang, et al.
Pubblicazione: (2025)
di: Qiu, Weikang, et al.
Pubblicazione: (2025)
MoleculeQA: A Dataset to Evaluate Factual Accuracy in Molecular Comprehension
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
RepoQA: Evaluating Long Context Code Understanding
di: Liu, Jiawei, et al.
Pubblicazione: (2024)
di: Liu, Jiawei, et al.
Pubblicazione: (2024)
PeerQA: A Scientific Question Answering Dataset from Peer Reviews
di: Baumgärtner, Tim, et al.
Pubblicazione: (2025)
di: Baumgärtner, Tim, et al.
Pubblicazione: (2025)
EEE-QA: Exploring Effective and Efficient Question-Answer Representations
di: Hu, Zhanghao, et al.
Pubblicazione: (2024)
di: Hu, Zhanghao, et al.
Pubblicazione: (2024)
Towards Better Question Generation in QA-based Event Extraction
di: Hong, Zijin, et al.
Pubblicazione: (2024)
di: Hong, Zijin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PolQA: Polish Question Answering Dataset
di: Rybak, Piotr, et al.
Pubblicazione: (2022) -
FinTextQA: A Dataset for Long-form Financial Question Answering
di: Chen, Jian, et al.
Pubblicazione: (2024) -
RJUA-QA: A Comprehensive QA Dataset for Urology
di: Lyu, Shiwei, et al.
Pubblicazione: (2023) -
LiteraryQA: Towards Effective Evaluation of Long-document Narrative QA
di: Bonomo, Tommaso, et al.
Pubblicazione: (2025) -
GRS-QA -- Graph Reasoning-Structured Question Answering Dataset
di: Pahilajani, Anish, et al.
Pubblicazione: (2024)