ResearchQA: Evaluating Scholarly Question Answering at Scale Across 75 Fields with Survey-Mined Questions and Rubrics
Fuente:
arXiv
Salvato in:
| Autori principali: | Yifei, Li S., Chang, Allen, Malaviya, Chaitanya, Yatskar, Mark |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ExpertQA: Expert-Curated Questions and Attributed Answers
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023)
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023)
Dynamic Clue Bottlenecks: Towards Interpretable-by-Design Visual Question Answering
di: Fu, Xingyu, et al.
Pubblicazione: (2023)
di: Fu, Xingyu, et al.
Pubblicazione: (2023)
Long-Span Question-Answering: Automatic Question Generation and QA-System Ranking via Side-by-Side Evaluation
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
Hybrid Graphs for Table-and-Text based Question Answering using LLMs
di: Agarwal, Ankush, et al.
Pubblicazione: (2025)
di: Agarwal, Ankush, et al.
Pubblicazione: (2025)
Hybrid-SQuAD: Hybrid Scholarly Question Answering Dataset
di: Taffa, Tilahun Abedissa, et al.
Pubblicazione: (2024)
di: Taffa, Tilahun Abedissa, et al.
Pubblicazione: (2024)
Memory-QA: Answering Recall Questions Based on Multimodal Memories
di: Jiang, Hongda, et al.
Pubblicazione: (2025)
di: Jiang, Hongda, et al.
Pubblicazione: (2025)
pdfQA: Diverse, Challenging, and Realistic Question Answering over PDFs
di: Schimanski, Tobias, et al.
Pubblicazione: (2026)
di: Schimanski, Tobias, et al.
Pubblicazione: (2026)
QA-TOOLBOX: Conversational Question-Answering for process task guidance in manufacturing
di: Manuvinakurike, Ramesh, et al.
Pubblicazione: (2024)
di: Manuvinakurike, Ramesh, et al.
Pubblicazione: (2024)
SensorQA: A Question Answering Benchmark for Daily-Life Monitoring
di: Reichman, Benjamin, et al.
Pubblicazione: (2025)
di: Reichman, Benjamin, et al.
Pubblicazione: (2025)
MedExQA: Medical Question Answering Benchmark with Multiple Explanations
di: Kim, Yunsoo, et al.
Pubblicazione: (2024)
di: Kim, Yunsoo, et al.
Pubblicazione: (2024)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
di: Mastrokostas, Charalampos, et al.
Pubblicazione: (2026)
di: Mastrokostas, Charalampos, et al.
Pubblicazione: (2026)
RAG-QA Arena: Evaluating Domain Robustness for Long-form Retrieval Augmented Question Answering
di: Han, Rujun, et al.
Pubblicazione: (2024)
di: Han, Rujun, et al.
Pubblicazione: (2024)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
di: Wei, Jianhui, et al.
Pubblicazione: (2025)
di: Wei, Jianhui, et al.
Pubblicazione: (2025)
FinTextQA: A Dataset for Long-form Financial Question Answering
di: Chen, Jian, et al.
Pubblicazione: (2024)
di: Chen, Jian, et al.
Pubblicazione: (2024)
MapQA: Open-domain Geospatial Question Answering on Map Data
di: Li, Zekun, et al.
Pubblicazione: (2025)
di: Li, Zekun, et al.
Pubblicazione: (2025)
ExpliCIT-QA: Explainable Code-Based Image Table Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
MM-PhyQA: Multimodal Physics Question-Answering With Multi-Image CoT Prompting
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
MFORT-QA: Multi-hop Few-shot Open Rich Table Question Answering
di: Guan, Che, et al.
Pubblicazione: (2024)
di: Guan, Che, et al.
Pubblicazione: (2024)
What if you said that differently?: How Explanation Formats Affect Human Feedback Efficacy and User Perception
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023)
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023)
Flattery, Fluff, and Fog: Diagnosing and Mitigating Idiosyncratic Biases in Preference Models
di: Bharadwaj, Anirudh, et al.
Pubblicazione: (2025)
di: Bharadwaj, Anirudh, et al.
Pubblicazione: (2025)
PASemiQA: Plan-Assisted Agent for Question Answering on Semi-Structured Data with Text and Relational Information
di: Yang, Hansi, et al.
Pubblicazione: (2025)
di: Yang, Hansi, et al.
Pubblicazione: (2025)
Mined Prompting and Metadata-Guided Generation for Wound Care Visual Question Answering
di: Durgapraveen, Bavana, et al.
Pubblicazione: (2025)
di: Durgapraveen, Bavana, et al.
Pubblicazione: (2025)
RepLiQA: A Question-Answering Dataset for Benchmarking LLMs on Unseen Reference Content
di: Monteiro, Joao, et al.
Pubblicazione: (2024)
di: Monteiro, Joao, et al.
Pubblicazione: (2024)
CT2C-QA: Multimodal Question Answering over Chinese Text, Table and Chart
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
Beyond Factual QA: Mentorship-Oriented Question Answering over Long-Form Multilingual Content
di: Bhalerao, Parth, et al.
Pubblicazione: (2026)
di: Bhalerao, Parth, et al.
Pubblicazione: (2026)
SemViQA: A Semantic Question Answering System for Vietnamese Information Fact-Checking
di: Tran, Dien X., et al.
Pubblicazione: (2025)
di: Tran, Dien X., et al.
Pubblicazione: (2025)
MizanQA: Benchmarking Large Language Models on Moroccan Legal Question Answering
di: Bahaj, Adil, et al.
Pubblicazione: (2025)
di: Bahaj, Adil, et al.
Pubblicazione: (2025)
PeerQA: A Scientific Question Answering Dataset from Peer Reviews
di: Baumgärtner, Tim, et al.
Pubblicazione: (2025)
di: Baumgärtner, Tim, et al.
Pubblicazione: (2025)
Scholarly Question Answering using Large Language Models in the NFDI4DataScience Gateway
di: Giglou, Hamed Babaei, et al.
Pubblicazione: (2024)
di: Giglou, Hamed Babaei, et al.
Pubblicazione: (2024)
Temporal Knowledge Graph Question Answering: A Survey
di: Su, Miao, et al.
Pubblicazione: (2024)
di: Su, Miao, et al.
Pubblicazione: (2024)
A Survey of the State-of-the-Art in Conversational Question Answering Systems
di: Perera, Manoj Madushanka, et al.
Pubblicazione: (2025)
di: Perera, Manoj Madushanka, et al.
Pubblicazione: (2025)
Automatic Evaluation of Healthcare LLMs Beyond Question-Answering
di: Arias-Duart, Anna, et al.
Pubblicazione: (2025)
di: Arias-Duart, Anna, et al.
Pubblicazione: (2025)
LiTransProQA: an LLM-based Literary Translation evaluation metric with Professional Question Answering
di: Zhang, Ran, et al.
Pubblicazione: (2025)
di: Zhang, Ran, et al.
Pubblicazione: (2025)
RAG-BioQA: A Retrieval-Augmented Generation Framework for Long-Form Biomedical Question Answering
di: Panchumarthi, Lovely Yeswanth, et al.
Pubblicazione: (2025)
di: Panchumarthi, Lovely Yeswanth, et al.
Pubblicazione: (2025)
PassiveQA: A Three-Action Framework for Epistemically Calibrated Question Answering via Supervised Finetuning
di: Baidya, Madhav S
Pubblicazione: (2026)
di: Baidya, Madhav S
Pubblicazione: (2026)
WikiMixQA: A Multimodal Benchmark for Question Answering over Tables and Charts
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
MMToM-QA: Multimodal Theory of Mind Question Answering
di: Jin, Chuanyang, et al.
Pubblicazione: (2024)
di: Jin, Chuanyang, et al.
Pubblicazione: (2024)
Efficient Medical Question Answering with Knowledge-Augmented Question Generation
di: Khlaut, Julien, et al.
Pubblicazione: (2024)
di: Khlaut, Julien, et al.
Pubblicazione: (2024)
Question-to-Question Retrieval for Hallucination-Free Knowledge Access: An Approach for Wikipedia and Wikidata Question Answering
di: Thottingal, Santhosh
Pubblicazione: (2025)
di: Thottingal, Santhosh
Pubblicazione: (2025)
DataFrame QA: A Universal LLM Framework on DataFrame Question Answering Without Data Exposure
di: Ye, Junyi, et al.
Pubblicazione: (2024)
di: Ye, Junyi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ExpertQA: Expert-Curated Questions and Attributed Answers
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023) -
Dynamic Clue Bottlenecks: Towards Interpretable-by-Design Visual Question Answering
di: Fu, Xingyu, et al.
Pubblicazione: (2023) -
Long-Span Question-Answering: Automatic Question Generation and QA-System Ranking via Side-by-Side Evaluation
di: Bohnet, Bernd, et al.
Pubblicazione: (2024) -
Hybrid Graphs for Table-and-Text based Question Answering using LLMs
di: Agarwal, Ankush, et al.
Pubblicazione: (2025) -
Hybrid-SQuAD: Hybrid Scholarly Question Answering Dataset
di: Taffa, Tilahun Abedissa, et al.
Pubblicazione: (2024)