Who is the richest club in the championship? Detecting and Rewriting Underspecified Questions Improve QA Performance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Yunchong, Barlacchi, Gianni, Pezzelle, Sandro |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Do Pre-Trained Language Models Detect and Understand Semantic Underspecification? Ask the DUST!
par: Wildenburg, Frank, et autres
Publié: (2024)
par: Wildenburg, Frank, et autres
Publié: (2024)
Natural Language Generation from Visual Events: State-of-the-Art and Key Open Questions
par: Surikuchi, Aditya K, et autres
Publié: (2025)
par: Surikuchi, Aditya K, et autres
Publié: (2025)
Beyond Divergent Creativity: A Human-Based Evaluation of Creativity in Large Language Models
par: Nakajima, Kumiko, et autres
Publié: (2026)
par: Nakajima, Kumiko, et autres
Publié: (2026)
How Language Models Conflate Logical Validity with Plausibility: A Representational Analysis of Content Effects
par: Bertolazzi, Leonardo, et autres
Publié: (2025)
par: Bertolazzi, Leonardo, et autres
Publié: (2025)
They want to pretend not to understand: The Limits of Current LLMs in Interpreting Implicit Content of Political Discourse
par: Paci, Walter, et autres
Publié: (2025)
par: Paci, Walter, et autres
Publié: (2025)
Naming, Describing, and Quantifying Visual Objects in Humans and LLMs
par: Testoni, Alberto, et autres
Publié: (2024)
par: Testoni, Alberto, et autres
Publié: (2024)
Are formal and functional linguistic mechanisms dissociated in language models?
par: Hanna, Michael, et autres
Publié: (2025)
par: Hanna, Michael, et autres
Publié: (2025)
ODUTQA-MDC: A Task for Open-Domain Underspecified Tabular QA with Multi-turn Dialogue-based Clarification
par: Wang, Zhensheng, et autres
Publié: (2026)
par: Wang, Zhensheng, et autres
Publié: (2026)
Describing Images $\textit{Fast and Slow}$: Quantifying and Predicting the Variation in Human Signals during Visuo-Linguistic Processes
par: Takmaz, Ece, et autres
Publié: (2024)
par: Takmaz, Ece, et autres
Publié: (2024)
The BLA Benchmark: Investigating Basic Language Abilities of Pre-Trained Multimodal Models
par: Chen, Xinyi, et autres
Publié: (2023)
par: Chen, Xinyi, et autres
Publié: (2023)
Contextualized Evaluations: Judging Language Model Responses to Underspecified Queries
par: Malaviya, Chaitanya, et autres
Publié: (2024)
par: Malaviya, Chaitanya, et autres
Publié: (2024)
Have Faith in Faithfulness: Going Beyond Circuit Overlap When Finding Model Mechanisms
par: Hanna, Michael, et autres
Publié: (2024)
par: Hanna, Michael, et autres
Publié: (2024)
Where is the multimodal goal post? On the Ability of Foundation Models to Recognize Contextually Important Moments
par: Surikuchi, Aditya K, et autres
Publié: (2026)
par: Surikuchi, Aditya K, et autres
Publié: (2026)
Not (yet) the whole story: Evaluating Visual Storytelling Requires More than Measuring Coherence, Grounding, and Repetition
par: Surikuchi, Aditya K, et autres
Publié: (2024)
par: Surikuchi, Aditya K, et autres
Publié: (2024)
Is my model perplexed for the right reason? Contrasting LLMs' Benchmark Behavior with Token-Level Perplexity
par: Prins, Zoë, et autres
Publié: (2026)
par: Prins, Zoë, et autres
Publié: (2026)
Vision-Language Models Align with Human Neural Representations in Concept Processing
par: Bavaresco, Anna, et autres
Publié: (2024)
par: Bavaresco, Anna, et autres
Publié: (2024)
Will It Still Be True Tomorrow? Multilingual Evergreen Question Classification to Improve Trustworthy QA
par: Pletenev, Sergey, et autres
Publié: (2025)
par: Pletenev, Sergey, et autres
Publié: (2025)
QA-prompting: Improving Summarization with Large Language Models using Question-Answering
par: Sinha, Neelabh
Publié: (2025)
par: Sinha, Neelabh
Publié: (2025)
Learning When to Retrieve, What to Rewrite, and How to Respond in Conversational QA
par: Roy, Nirmal, et autres
Publié: (2024)
par: Roy, Nirmal, et autres
Publié: (2024)
Align Documents to Questions: Question-Oriented Document Rewriting for Retrieval-Augmented Generation
par: Li, Jiaang, et autres
Publié: (2026)
par: Li, Jiaang, et autres
Publié: (2026)
Context Selection and Rewriting for Video-based Educational Question Generation
par: Yu, Mengxia, et autres
Publié: (2025)
par: Yu, Mengxia, et autres
Publié: (2025)
PolQA: Polish Question Answering Dataset
par: Rybak, Piotr, et autres
Publié: (2022)
par: Rybak, Piotr, et autres
Publié: (2022)
Improving QA Model Performance with Cartographic Inoculation
par: Chen, Allen, et autres
Publié: (2024)
par: Chen, Allen, et autres
Publié: (2024)
Syn-QA2: Evaluating False Assumptions in Long-tail Questions with Synthetic QA Datasets
par: Daswani, Ashwin, et autres
Publié: (2024)
par: Daswani, Ashwin, et autres
Publié: (2024)
DebateQA: Evaluating Question Answering on Debatable Knowledge
par: Xu, Rongwu, et autres
Publié: (2024)
par: Xu, Rongwu, et autres
Publié: (2024)
CoTKR: Chain-of-Thought Enhanced Knowledge Rewriting for Complex Knowledge Graph Question Answering
par: Wu, Yike, et autres
Publié: (2024)
par: Wu, Yike, et autres
Publié: (2024)
Socratic Reasoning Improves Positive Text Rewriting
par: Goel, Anmol, et autres
Publié: (2024)
par: Goel, Anmol, et autres
Publié: (2024)
UTSA-NLP at ArchEHR-QA 2025: Improving EHR Question Answering via Self-Consistency Prompting
par: Shields-Menard, Sara, et autres
Publié: (2025)
par: Shields-Menard, Sara, et autres
Publié: (2025)
EEE-QA: Exploring Effective and Efficient Question-Answer Representations
par: Hu, Zhanghao, et autres
Publié: (2024)
par: Hu, Zhanghao, et autres
Publié: (2024)
M2QA: Multi-domain Multilingual Question Answering
par: Engländer, Leon, et autres
Publié: (2024)
par: Engländer, Leon, et autres
Publié: (2024)
GRS-QA -- Graph Reasoning-Structured Question Answering Dataset
par: Pahilajani, Anish, et autres
Publié: (2024)
par: Pahilajani, Anish, et autres
Publié: (2024)
Compound-QA: A Benchmark for Evaluating LLMs on Compound Questions
par: Hou, Yutao, et autres
Publié: (2024)
par: Hou, Yutao, et autres
Publié: (2024)
Towards Better Question Generation in QA-based Event Extraction
par: Hong, Zijin, et autres
Publié: (2024)
par: Hong, Zijin, et autres
Publié: (2024)
RephQA: Evaluating Readability of Large Language Models in Public Health Question Answering
par: Qiu, Weikang, et autres
Publié: (2025)
par: Qiu, Weikang, et autres
Publié: (2025)
MFORT-QA: Multi-hop Few-shot Open Rich Table Question Answering
par: Guan, Che, et autres
Publié: (2024)
par: Guan, Che, et autres
Publié: (2024)
RetinaQA: A Robust Knowledge Base Question Answering Model for both Answerable and Unanswerable Questions
par: Faldu, Prayushi, et autres
Publié: (2024)
par: Faldu, Prayushi, et autres
Publié: (2024)
RespondeoQA: a Benchmark for Bilingual Latin-English Question Answering
par: Hudspeth, Marisa, et autres
Publié: (2026)
par: Hudspeth, Marisa, et autres
Publié: (2026)
DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards
par: Kartha, Aaryaman, et autres
Publié: (2025)
par: Kartha, Aaryaman, et autres
Publié: (2025)
HistoryBankQA: Multilingual Temporal Question Answering on Historical Events
par: Mandal, Biswadip, et autres
Publié: (2025)
par: Mandal, Biswadip, et autres
Publié: (2025)
BEnQA: A Question Answering and Reasoning Benchmark for Bengali and English
par: Shafayat, Sheikh, et autres
Publié: (2024)
par: Shafayat, Sheikh, et autres
Publié: (2024)
Documents similaires
-
Do Pre-Trained Language Models Detect and Understand Semantic Underspecification? Ask the DUST!
par: Wildenburg, Frank, et autres
Publié: (2024) -
Natural Language Generation from Visual Events: State-of-the-Art and Key Open Questions
par: Surikuchi, Aditya K, et autres
Publié: (2025) -
Beyond Divergent Creativity: A Human-Based Evaluation of Creativity in Large Language Models
par: Nakajima, Kumiko, et autres
Publié: (2026) -
How Language Models Conflate Logical Validity with Plausibility: A Representational Analysis of Content Effects
par: Bertolazzi, Leonardo, et autres
Publié: (2025) -
They want to pretend not to understand: The Limits of Current LLMs in Interpreting Implicit Content of Political Discourse
par: Paci, Walter, et autres
Publié: (2025)