Salvato in:
| Autore principale: | Anonymous |
|---|---|
| Natura: | Recurso digital |
| Lingua: | |
| Pubblicazione: |
Zenodo
2026
|
| Accesso online: | https://doi.org/10.5281/zenodo.18540782 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EPA45 dataset
di: Anonymous
Pubblicazione: (2025)
di: Anonymous
Pubblicazione: (2025)
manuscript_participant_level_dataset_multimodal_feedback
di: Anonymous
Pubblicazione: (2025)
di: Anonymous
Pubblicazione: (2025)
On the Performance of an Explainable Language Model on PubMedQA
di: Srinivasan, Venkat, et al.
Pubblicazione: (2025)
di: Srinivasan, Venkat, et al.
Pubblicazione: (2025)
pass-study-replication-dataset-msr25
di: AnonymousMSR25
Pubblicazione: (2024)
di: AnonymousMSR25
Pubblicazione: (2024)
ExpliCIT-QA: Explainable Code-Based Image Table Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
OpenStaxQA: A multilingual dataset based on open-source college textbooks
di: Gupta, Pranav
Pubblicazione: (2025)
di: Gupta, Pranav
Pubblicazione: (2025)
RePPL: Recalibrating Perplexity by Uncertainty in Semantic Propagation and Language Generation for Explainable QA Hallucination Detection
di: Huang, Yiming, et al.
Pubblicazione: (2025)
di: Huang, Yiming, et al.
Pubblicazione: (2025)
Evaluating LLMs on Document-Based QA: Exact Answer Selection and Numerical Extraction using Cogtale dataset
di: Rasool, Zafaryab, et al.
Pubblicazione: (2023)
di: Rasool, Zafaryab, et al.
Pubblicazione: (2023)
ConvKGYarn: Spinning Configurable and Scalable Conversational Knowledge Graph QA datasets with Large Language Models
di: Pradeep, Ronak, et al.
Pubblicazione: (2024)
di: Pradeep, Ronak, et al.
Pubblicazione: (2024)
RealMedQA: A pilot biomedical question answering dataset containing realistic clinical questions
di: Kell, Gregory, et al.
Pubblicazione: (2024)
di: Kell, Gregory, et al.
Pubblicazione: (2024)
RJUA-QA: A Comprehensive QA Dataset for Urology
di: Lyu, Shiwei, et al.
Pubblicazione: (2023)
di: Lyu, Shiwei, et al.
Pubblicazione: (2023)
WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation
di: Matos, João, et al.
Pubblicazione: (2024)
di: Matos, João, et al.
Pubblicazione: (2024)
Incorporating convergent enzyme thermal evolution into species distribution models unveils future global marine fish distribution under climate change
di: Anonymous, Anonymous, et al.
Pubblicazione: (2025)
di: Anonymous, Anonymous, et al.
Pubblicazione: (2025)
SEC-QA: A Systematic Evaluation Corpus for Financial QA
di: Lai, Viet Dac, et al.
Pubblicazione: (2024)
di: Lai, Viet Dac, et al.
Pubblicazione: (2024)
QA-LIGN: Aligning LLMs through Constitutionally Decomposed QA
di: Dineen, Jacob, et al.
Pubblicazione: (2025)
di: Dineen, Jacob, et al.
Pubblicazione: (2025)
ChatQA: Surpassing GPT-4 on Conversational QA and RAG
di: Liu, Zihan, et al.
Pubblicazione: (2024)
di: Liu, Zihan, et al.
Pubblicazione: (2024)
BioGraphletQA: Knowledge-Anchored Generation of Complex QA Datasets
di: Jonker, Richard A. A., et al.
Pubblicazione: (2026)
di: Jonker, Richard A. A., et al.
Pubblicazione: (2026)
LiteraryQA: Towards Effective Evaluation of Long-document Narrative QA
di: Bonomo, Tommaso, et al.
Pubblicazione: (2025)
di: Bonomo, Tommaso, et al.
Pubblicazione: (2025)
ExpertGenQA: Open-ended QA generation in Specialized Domains
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2025)
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2025)
MedConceptsQA: Open Source Medical Concepts QA Benchmark
di: Shoham, Ofir Ben, et al.
Pubblicazione: (2024)
di: Shoham, Ofir Ben, et al.
Pubblicazione: (2024)
AgriQA Dataset
di: Eldem, Ayşe
Pubblicazione: (2026)
di: Eldem, Ayşe
Pubblicazione: (2026)
LiveBench benchmark ordered by reasoning - Snapshot - November 20, 2025
di: Anonymous, et al.
Pubblicazione: (2025)
di: Anonymous, et al.
Pubblicazione: (2025)
Screen2AX-Tree_old
di: Anonymous, et al.
Pubblicazione: (2025)
di: Anonymous, et al.
Pubblicazione: (2025)
BLIP for icon captioning
di: Anonymous, et al.
Pubblicazione: (2025)
di: Anonymous, et al.
Pubblicazione: (2025)
HiQA: A Hierarchical Contextual Augmentation RAG for Multi-Documents QA
di: Chen, Xinyue, et al.
Pubblicazione: (2024)
di: Chen, Xinyue, et al.
Pubblicazione: (2024)
SimpleDevQA: Benchmarking Large Language Models on Development Knowledge QA
di: Zhang, Jing, et al.
Pubblicazione: (2025)
di: Zhang, Jing, et al.
Pubblicazione: (2025)
CON-QA: Privacy-Preserving QA using cloud LLMs in Contract Domain
di: Singh, Ajeet Kumar, et al.
Pubblicazione: (2025)
di: Singh, Ajeet Kumar, et al.
Pubblicazione: (2025)
HumMusQA: A Human-written Music Understanding QA Benchmark Dataset
di: Weck, Benno, et al.
Pubblicazione: (2026)
di: Weck, Benno, et al.
Pubblicazione: (2026)
AirQA: A Comprehensive QA Dataset for AI Research with Instance-Level Evaluation
di: Huang, Tiancheng, et al.
Pubblicazione: (2025)
di: Huang, Tiancheng, et al.
Pubblicazione: (2025)
DeQA-Doc: Adapting DeQA-Score to Document Image Quality Assessment
di: Gao, Junjie, et al.
Pubblicazione: (2025)
di: Gao, Junjie, et al.
Pubblicazione: (2025)
JBE-QA: Japanese Bar Exam QA Dataset for Assessing Legal Domain Knowledge
di: Cao, Zhihan, et al.
Pubblicazione: (2025)
di: Cao, Zhihan, et al.
Pubblicazione: (2025)
BranchSentry
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Il regolamento successioni e la costruzione progressiva del diritto internazionale privato dell'Unione europea - Principi classici, autonomia ed esigenze del mercato interno - Blind peer review 2
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Identify Vulnerable Code in Running Binaries
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Data
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Combining Large Language Models for High-quality, Cost-efficient Conservative Reassessments of Static Security Findings
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Dataset for paper titled "A UAV-Based System for Methane Emission Detection and Spatial Monitoring"
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Replication Package of "A multi-dimensional characterization of the Defects4J benchmark for analyzing APR evaluation bias"
di: Anonymous, et al.
Pubblicazione: (2026)
di: Anonymous, et al.
Pubblicazione: (2026)
Circle: High-Dimensional Control on Low-Dimensional Controllers Using an Abstract Language of Gestures
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Understanding the Origin and Reachability of Cryptographic API Misuse Reports in Android Apps
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Documenti analoghi
-
EPA45 dataset
di: Anonymous
Pubblicazione: (2025) -
manuscript_participant_level_dataset_multimodal_feedback
di: Anonymous
Pubblicazione: (2025) -
On the Performance of an Explainable Language Model on PubMedQA
di: Srinivasan, Venkat, et al.
Pubblicazione: (2025) -
pass-study-replication-dataset-msr25
di: AnonymousMSR25
Pubblicazione: (2024) -
ExpliCIT-QA: Explainable Code-Based Image Table Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)