ClaimDB: A Fact Verification Benchmark over Large Structured Data
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Theologitis, Michael, Dammu, Preetam Prabhu Srikar, Shah, Chirag, Suciu, Dan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dynamic-KGQA: A Scalable Framework for Generating Adaptive Question Answering Datasets
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2025)
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2025)
ClaimVer: Explainable Claim-Level Verification and Evidence Attribution of Text Through Knowledge Graphs
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2024)
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2024)
iAgentBench: Benchmarking Sensemaking Capabilities of Information-Seeking Agents on High-Traffic Topics
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2026)
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2026)
Thucy: An LLM-based Multi-Agent System for Claim Verification across Relational Databases
par: Theologitis, Michael, et autres
Publié: (2025)
par: Theologitis, Michael, et autres
Publié: (2025)
Dynamic Evaluation Framework for Personalized and Trustworthy Agents: A Multi-Session Approach to Preference Adaptability
par: Shah, Chirag, et autres
Publié: (2025)
par: Shah, Chirag, et autres
Publié: (2025)
Beyond Static Evaluation: Rethinking the Assessment of Personalized Agent Adaptability in Information Retrieval
par: Kaur, Kirandeep, et autres
Publié: (2025)
par: Kaur, Kirandeep, et autres
Publié: (2025)
"They are uncultured": Unveiling Covert Harms and Social Threats in LLM Generated Conversations
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2024)
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2024)
Deep Reasoning in General Purpose Agents via Structured Meta-Cognition
par: Light, Dean, et autres
Publié: (2026)
par: Light, Dean, et autres
Publié: (2026)
A Benchmark for Open-Domain Numerical Fact-Checking Enhanced by Claim Decomposition
par: Venktesh, V, et autres
Publié: (2025)
par: Venktesh, V, et autres
Publié: (2025)
Robust Claim Verification Through Fact Detection
par: Jafari, Nazanin, et autres
Publié: (2024)
par: Jafari, Nazanin, et autres
Publié: (2024)
FactLens: Benchmarking Fine-Grained Fact Verification
par: Mitra, Kushan, et autres
Publié: (2024)
par: Mitra, Kushan, et autres
Publié: (2024)
INSURE-Dial: A Phase-Aware Conversational Dataset & Benchmark for Compliance Verification and Phase Detection
par: Kulkarni, Shubham, et autres
Publié: (2026)
par: Kulkarni, Shubham, et autres
Publié: (2026)
Co-FactChecker: A Framework for Human-AI Collaborative Claim Verification Using Large Reasoning Models
par: Sahnan, Dhruv, et autres
Publié: (2026)
par: Sahnan, Dhruv, et autres
Publié: (2026)
Step-by-Step Fact Verification System for Medical Claims with Explainable Reasoning
par: Vladika, Juraj, et autres
Publié: (2025)
par: Vladika, Juraj, et autres
Publié: (2025)
BiDeV: Bilateral Defusing Verification for Complex Claim Fact-Checking
par: Liu, Yuxuan, et autres
Publié: (2025)
par: Liu, Yuxuan, et autres
Publié: (2025)
CoverBench: A Challenging Benchmark for Complex Claim Verification
par: Jacovi, Alon, et autres
Publié: (2024)
par: Jacovi, Alon, et autres
Publié: (2024)
What Makes Medical Claims (Un)Verifiable? Analyzing Entity and Relation Properties for Fact Verification
par: Wührl, Amelie, et autres
Publié: (2024)
par: Wührl, Amelie, et autres
Publié: (2024)
SciClaimHunt: A Large Dataset for Evidence-based Scientific Claim Verification
par: Kumar, Sujit, et autres
Publié: (2025)
par: Kumar, Sujit, et autres
Publié: (2025)
Claim Extraction for Fact-Checking: Data, Models, and Automated Metrics
par: Ullrich, Herbert, et autres
Publié: (2025)
par: Ullrich, Herbert, et autres
Publié: (2025)
Document-level Claim Extraction and Decontextualisation for Fact-Checking
par: Deng, Zhenyun, et autres
Publié: (2024)
par: Deng, Zhenyun, et autres
Publié: (2024)
Poly-FEVER: A Multilingual Fact Verification Benchmark for Hallucination Detection in Large Language Models
par: Zhang, Hanzhi, et autres
Publié: (2025)
par: Zhang, Hanzhi, et autres
Publié: (2025)
Automated Fact-Checking of Climate Change Claims with Large Language Models
par: Leippold, Markus, et autres
Publié: (2024)
par: Leippold, Markus, et autres
Publié: (2024)
Large Language Models for Multilingual Previously Fact-Checked Claim Detection
par: Vykopal, Ivan, et autres
Publié: (2025)
par: Vykopal, Ivan, et autres
Publié: (2025)
A Claim Decomposition Benchmark for Long-form Answer Verification
par: Zhang, Zhihao, et autres
Publié: (2024)
par: Zhang, Zhihao, et autres
Publié: (2024)
TSVer: A Benchmark for Fact Verification Against Time-Series Evidence
par: Strong, Marek, et autres
Publié: (2025)
par: Strong, Marek, et autres
Publié: (2025)
MultiClaimNet: A Massively Multilingual Dataset of Fact-Checked Claim Clusters
par: Panchendrarajan, Rrubaa, et autres
Publié: (2025)
par: Panchendrarajan, Rrubaa, et autres
Publié: (2025)
Multilingual, Multimodal Pipeline for Creating Authentic and Structured Fact-Checked Claim Dataset
par: Hüsünbeyi, Z. Melce, et autres
Publié: (2026)
par: Hüsünbeyi, Z. Melce, et autres
Publié: (2026)
Claim2Vec: Embedding Fact-Check Claims for Multilingual Similarity and Clustering
par: Panchendrarajan, Rrubaa, et autres
Publié: (2026)
par: Panchendrarajan, Rrubaa, et autres
Publié: (2026)
MuSciClaims: Multimodal Scientific Claim Verification
par: Lal, Yash Kumar, et autres
Publié: (2025)
par: Lal, Yash Kumar, et autres
Publié: (2025)
OpenFactCheck: Building, Benchmarking Customized Fact-Checking Systems and Evaluating the Factuality of Claims and LLMs
par: Wang, Yuxia, et autres
Publié: (2024)
par: Wang, Yuxia, et autres
Publié: (2024)
SynClaimEval: A Framework for Evaluating the Utility of Synthetic Data in Long-Context Claim Verification
par: Elaraby, Mohamed, et autres
Publié: (2025)
par: Elaraby, Mohamed, et autres
Publié: (2025)
Multilingual Previously Fact-Checked Claim Retrieval
par: Pikuliak, Matúš, et autres
Publié: (2023)
par: Pikuliak, Matúš, et autres
Publié: (2023)
CHECKWHY: Causal Fact Verification via Argument Structure
par: Si, Jiasheng, et autres
Publié: (2024)
par: Si, Jiasheng, et autres
Publié: (2024)
Enhancing Multi-Hop Fact Verification with Structured Knowledge-Augmented Large Language Models
par: Cao, Han, et autres
Publié: (2025)
par: Cao, Han, et autres
Publié: (2025)
Multimodal Claim Extraction for Fact-Checking
par: Teo, Joycelyn, et autres
Publié: (2026)
par: Teo, Joycelyn, et autres
Publié: (2026)
Claim Verification in the Age of Large Language Models: A Survey
par: Dmonte, Alphaeus, et autres
Publié: (2024)
par: Dmonte, Alphaeus, et autres
Publié: (2024)
ChronoFact: Timeline-based Temporal Fact Verification
par: Barik, Anab Maulana, et autres
Publié: (2024)
par: Barik, Anab Maulana, et autres
Publié: (2024)
SciClaimEval: Cross-modal Claim Verification in Scientific Papers
par: Ho, Xanh, et autres
Publié: (2026)
par: Ho, Xanh, et autres
Publié: (2026)
HalluciNot: Hallucination Detection Through Context and Common Knowledge Verification
par: Paudel, Bibek, et autres
Publié: (2025)
par: Paudel, Bibek, et autres
Publié: (2025)
A Multi-Agent Approach for Claim Verification from Tabular Data Documents
par: Saha, Rudra Ranajee, et autres
Publié: (2026)
par: Saha, Rudra Ranajee, et autres
Publié: (2026)
Documents similaires
-
Dynamic-KGQA: A Scalable Framework for Generating Adaptive Question Answering Datasets
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2025) -
ClaimVer: Explainable Claim-Level Verification and Evidence Attribution of Text Through Knowledge Graphs
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2024) -
iAgentBench: Benchmarking Sensemaking Capabilities of Information-Seeking Agents on High-Traffic Topics
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2026) -
Thucy: An LLM-based Multi-Agent System for Claim Verification across Relational Databases
par: Theologitis, Michael, et autres
Publié: (2025) -
Dynamic Evaluation Framework for Personalized and Trustworthy Agents: A Multi-Session Approach to Preference Adaptability
par: Shah, Chirag, et autres
Publié: (2025)