Explainablity QA dataset
Fuente:
Zenodo
Salvato in:
| Autore principale: | Anonymous |
|---|---|
| Natura: | Recurso digital |
| Pubblicazione: |
Zenodo
2026
|
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EPA45 dataset
di: Anonymous
Pubblicazione: (2025)
di: Anonymous
Pubblicazione: (2025)
manuscript_participant_level_dataset_multimodal_feedback
di: Anonymous
Pubblicazione: (2025)
di: Anonymous
Pubblicazione: (2025)
On the Performance of an Explainable Language Model on PubMedQA
di: Srinivasan, Venkat, et al.
Pubblicazione: (2025)
di: Srinivasan, Venkat, et al.
Pubblicazione: (2025)
pass-study-replication-dataset-msr25
di: AnonymousMSR25
Pubblicazione: (2024)
di: AnonymousMSR25
Pubblicazione: (2024)
ExpliCIT-QA: Explainable Code-Based Image Table Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
OpenStaxQA: A multilingual dataset based on open-source college textbooks
di: Gupta, Pranav
Pubblicazione: (2025)
di: Gupta, Pranav
Pubblicazione: (2025)
RePPL: Recalibrating Perplexity by Uncertainty in Semantic Propagation and Language Generation for Explainable QA Hallucination Detection
di: Huang, Yiming, et al.
Pubblicazione: (2025)
di: Huang, Yiming, et al.
Pubblicazione: (2025)
Evaluating LLMs on Document-Based QA: Exact Answer Selection and Numerical Extraction using Cogtale dataset
di: Rasool, Zafaryab, et al.
Pubblicazione: (2023)
di: Rasool, Zafaryab, et al.
Pubblicazione: (2023)
ConvKGYarn: Spinning Configurable and Scalable Conversational Knowledge Graph QA datasets with Large Language Models
di: Pradeep, Ronak, et al.
Pubblicazione: (2024)
di: Pradeep, Ronak, et al.
Pubblicazione: (2024)
RealMedQA: A pilot biomedical question answering dataset containing realistic clinical questions
di: Kell, Gregory, et al.
Pubblicazione: (2024)
di: Kell, Gregory, et al.
Pubblicazione: (2024)
WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation
di: Matos, João, et al.
Pubblicazione: (2024)
di: Matos, João, et al.
Pubblicazione: (2024)
Incorporating convergent enzyme thermal evolution into species distribution models unveils future global marine fish distribution under climate change
di: Anonymous, Anonymous, et al.
Pubblicazione: (2025)
di: Anonymous, Anonymous, et al.
Pubblicazione: (2025)
RJUA-QA: A Comprehensive QA Dataset for Urology
di: Lyu, Shiwei, et al.
Pubblicazione: (2023)
di: Lyu, Shiwei, et al.
Pubblicazione: (2023)
SEC-QA: A Systematic Evaluation Corpus for Financial QA
di: Lai, Viet Dac, et al.
Pubblicazione: (2024)
di: Lai, Viet Dac, et al.
Pubblicazione: (2024)
QA-LIGN: Aligning LLMs through Constitutionally Decomposed QA
di: Dineen, Jacob, et al.
Pubblicazione: (2025)
di: Dineen, Jacob, et al.
Pubblicazione: (2025)
ChatQA: Surpassing GPT-4 on Conversational QA and RAG
di: Liu, Zihan, et al.
Pubblicazione: (2024)
di: Liu, Zihan, et al.
Pubblicazione: (2024)
LiveBench benchmark ordered by reasoning - Snapshot - November 20, 2025
di: Anonymous, et al.
Pubblicazione: (2025)
di: Anonymous, et al.
Pubblicazione: (2025)
Screen2AX-Tree_old
di: Anonymous, et al.
Pubblicazione: (2025)
di: Anonymous, et al.
Pubblicazione: (2025)
BLIP for icon captioning
di: Anonymous, et al.
Pubblicazione: (2025)
di: Anonymous, et al.
Pubblicazione: (2025)
BioGraphletQA: Knowledge-Anchored Generation of Complex QA Datasets
di: Jonker, Richard A. A., et al.
Pubblicazione: (2026)
di: Jonker, Richard A. A., et al.
Pubblicazione: (2026)
LiteraryQA: Towards Effective Evaluation of Long-document Narrative QA
di: Bonomo, Tommaso, et al.
Pubblicazione: (2025)
di: Bonomo, Tommaso, et al.
Pubblicazione: (2025)
ExpertGenQA: Open-ended QA generation in Specialized Domains
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2025)
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2025)
MedConceptsQA: Open Source Medical Concepts QA Benchmark
di: Shoham, Ofir Ben, et al.
Pubblicazione: (2024)
di: Shoham, Ofir Ben, et al.
Pubblicazione: (2024)
AgriQA Dataset
di: Eldem, Ayşe
Pubblicazione: (2026)
di: Eldem, Ayşe
Pubblicazione: (2026)
BranchSentry
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Il regolamento successioni e la costruzione progressiva del diritto internazionale privato dell'Unione europea - Principi classici, autonomia ed esigenze del mercato interno - Blind peer review 2
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Identify Vulnerable Code in Running Binaries
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Data
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Combining Large Language Models for High-quality, Cost-efficient Conservative Reassessments of Static Security Findings
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Dataset for paper titled "A UAV-Based System for Methane Emission Detection and Spatial Monitoring"
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Replication Package of "A multi-dimensional characterization of the Defects4J benchmark for analyzing APR evaluation bias"
di: Anonymous, et al.
Pubblicazione: (2026)
di: Anonymous, et al.
Pubblicazione: (2026)
Circle: High-Dimensional Control on Low-Dimensional Controllers Using an Abstract Language of Gestures
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Understanding the Origin and Reachability of Cryptographic API Misuse Reports in Android Apps
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Replication Package for "Green AI: Cost of LLM-based Code Completion"
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Processed Scene Graphs from Argoverse2
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Material Utilizado
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Does Context Size Matter? Context Structure and Integration Effort in Agent Pull Requests
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Longitudinal Analyses of Static Analysis Tools: A CodeQL Case Study
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
All_Models_Accuracy_Report
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Source code for flapping of wing
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Documenti analoghi
-
EPA45 dataset
di: Anonymous
Pubblicazione: (2025) -
manuscript_participant_level_dataset_multimodal_feedback
di: Anonymous
Pubblicazione: (2025) -
On the Performance of an Explainable Language Model on PubMedQA
di: Srinivasan, Venkat, et al.
Pubblicazione: (2025) -
pass-study-replication-dataset-msr25
di: AnonymousMSR25
Pubblicazione: (2024) -
ExpliCIT-QA: Explainable Code-Based Image Table Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)