Explainablity QA dataset
Fuente:
Zenodo
Enregistré dans:
| Auteur principal: | Anonymous |
|---|---|
| Format: | Recurso digital |
| Publié: |
Zenodo
2026
|
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EPA45 dataset
par: Anonymous
Publié: (2025)
par: Anonymous
Publié: (2025)
manuscript_participant_level_dataset_multimodal_feedback
par: Anonymous
Publié: (2025)
par: Anonymous
Publié: (2025)
On the Performance of an Explainable Language Model on PubMedQA
par: Srinivasan, Venkat, et autres
Publié: (2025)
par: Srinivasan, Venkat, et autres
Publié: (2025)
pass-study-replication-dataset-msr25
par: AnonymousMSR25
Publié: (2024)
par: AnonymousMSR25
Publié: (2024)
ExpliCIT-QA: Explainable Code-Based Image Table Question Answering
par: Lagos, Maximiliano Hormazábal, et autres
Publié: (2025)
par: Lagos, Maximiliano Hormazábal, et autres
Publié: (2025)
OpenStaxQA: A multilingual dataset based on open-source college textbooks
par: Gupta, Pranav
Publié: (2025)
par: Gupta, Pranav
Publié: (2025)
RePPL: Recalibrating Perplexity by Uncertainty in Semantic Propagation and Language Generation for Explainable QA Hallucination Detection
par: Huang, Yiming, et autres
Publié: (2025)
par: Huang, Yiming, et autres
Publié: (2025)
Evaluating LLMs on Document-Based QA: Exact Answer Selection and Numerical Extraction using Cogtale dataset
par: Rasool, Zafaryab, et autres
Publié: (2023)
par: Rasool, Zafaryab, et autres
Publié: (2023)
ConvKGYarn: Spinning Configurable and Scalable Conversational Knowledge Graph QA datasets with Large Language Models
par: Pradeep, Ronak, et autres
Publié: (2024)
par: Pradeep, Ronak, et autres
Publié: (2024)
RealMedQA: A pilot biomedical question answering dataset containing realistic clinical questions
par: Kell, Gregory, et autres
Publié: (2024)
par: Kell, Gregory, et autres
Publié: (2024)
WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation
par: Matos, João, et autres
Publié: (2024)
par: Matos, João, et autres
Publié: (2024)
Incorporating convergent enzyme thermal evolution into species distribution models unveils future global marine fish distribution under climate change
par: Anonymous, Anonymous, et autres
Publié: (2025)
par: Anonymous, Anonymous, et autres
Publié: (2025)
RJUA-QA: A Comprehensive QA Dataset for Urology
par: Lyu, Shiwei, et autres
Publié: (2023)
par: Lyu, Shiwei, et autres
Publié: (2023)
SEC-QA: A Systematic Evaluation Corpus for Financial QA
par: Lai, Viet Dac, et autres
Publié: (2024)
par: Lai, Viet Dac, et autres
Publié: (2024)
QA-LIGN: Aligning LLMs through Constitutionally Decomposed QA
par: Dineen, Jacob, et autres
Publié: (2025)
par: Dineen, Jacob, et autres
Publié: (2025)
ChatQA: Surpassing GPT-4 on Conversational QA and RAG
par: Liu, Zihan, et autres
Publié: (2024)
par: Liu, Zihan, et autres
Publié: (2024)
LiveBench benchmark ordered by reasoning - Snapshot - November 20, 2025
par: Anonymous, et autres
Publié: (2025)
par: Anonymous, et autres
Publié: (2025)
Screen2AX-Tree_old
par: Anonymous, et autres
Publié: (2025)
par: Anonymous, et autres
Publié: (2025)
BLIP for icon captioning
par: Anonymous, et autres
Publié: (2025)
par: Anonymous, et autres
Publié: (2025)
BioGraphletQA: Knowledge-Anchored Generation of Complex QA Datasets
par: Jonker, Richard A. A., et autres
Publié: (2026)
par: Jonker, Richard A. A., et autres
Publié: (2026)
LiteraryQA: Towards Effective Evaluation of Long-document Narrative QA
par: Bonomo, Tommaso, et autres
Publié: (2025)
par: Bonomo, Tommaso, et autres
Publié: (2025)
ExpertGenQA: Open-ended QA generation in Specialized Domains
par: Shahgir, Haz Sameen, et autres
Publié: (2025)
par: Shahgir, Haz Sameen, et autres
Publié: (2025)
MedConceptsQA: Open Source Medical Concepts QA Benchmark
par: Shoham, Ofir Ben, et autres
Publié: (2024)
par: Shoham, Ofir Ben, et autres
Publié: (2024)
AgriQA Dataset
par: Eldem, Ayşe
Publié: (2026)
par: Eldem, Ayşe
Publié: (2026)
BranchSentry
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Il regolamento successioni e la costruzione progressiva del diritto internazionale privato dell'Unione europea - Principi classici, autonomia ed esigenze del mercato interno - Blind peer review 2
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Identify Vulnerable Code in Running Binaries
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Data
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Combining Large Language Models for High-quality, Cost-efficient Conservative Reassessments of Static Security Findings
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Dataset for paper titled "A UAV-Based System for Methane Emission Detection and Spatial Monitoring"
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Replication Package of "A multi-dimensional characterization of the Defects4J benchmark for analyzing APR evaluation bias"
par: Anonymous, et autres
Publié: (2026)
par: Anonymous, et autres
Publié: (2026)
Circle: High-Dimensional Control on Low-Dimensional Controllers Using an Abstract Language of Gestures
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Understanding the Origin and Reachability of Cryptographic API Misuse Reports in Android Apps
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Replication Package for "Green AI: Cost of LLM-based Code Completion"
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Processed Scene Graphs from Argoverse2
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Material Utilizado
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Does Context Size Matter? Context Structure and Integration Effort in Agent Pull Requests
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Longitudinal Analyses of Static Analysis Tools: A CodeQL Case Study
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
All_Models_Accuracy_Report
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Source code for flapping of wing
par: Anonymous, Anonymous
Publié: (2026)
par: Anonymous, Anonymous
Publié: (2026)
Documents similaires
-
EPA45 dataset
par: Anonymous
Publié: (2025) -
manuscript_participant_level_dataset_multimodal_feedback
par: Anonymous
Publié: (2025) -
On the Performance of an Explainable Language Model on PubMedQA
par: Srinivasan, Venkat, et autres
Publié: (2025) -
pass-study-replication-dataset-msr25
par: AnonymousMSR25
Publié: (2024) -
ExpliCIT-QA: Explainable Code-Based Image Table Question Answering
par: Lagos, Maximiliano Hormazábal, et autres
Publié: (2025)