FactCHD: Benchmarking Fact-Conflicting Hallucination Detection
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Xiang, Song, Duanzheng, Gui, Honghao, Wang, Chenxi, Zhang, Ningyu, Jiang, Yong, Huang, Fei, Lv, Chengfei, Zhang, Dan, Chen, Huajun |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Making Language Models Better Tool Learners with Execution Feedback
by: Qiao, Shuofei, et al.
Published: (2023)
by: Qiao, Shuofei, et al.
Published: (2023)
CKnowEdit: A New Chinese Knowledge Editing Dataset for Linguistics, Facts, and Logic Error Correction in LLMs
by: Fang, Jizhan, et al.
Published: (2024)
by: Fang, Jizhan, et al.
Published: (2024)
Unified Hallucination Detection for Multimodal Large Language Models
by: Chen, Xiang, et al.
Published: (2024)
by: Chen, Xiang, et al.
Published: (2024)
Towards Unification of Hallucination Detection and Fact Verification for Large Language Models
by: Su, Weihang, et al.
Published: (2025)
by: Su, Weihang, et al.
Published: (2025)
IEPile: Unearthing Large-Scale Schema-Based Information Extraction Corpus
by: Gui, Honghao, et al.
Published: (2024)
by: Gui, Honghao, et al.
Published: (2024)
ViFactCheck: A New Benchmark Dataset and Methods for Multi-domain News Fact-Checking in Vietnamese
by: Hoa, Tran Thai, et al.
Published: (2024)
by: Hoa, Tran Thai, et al.
Published: (2024)
Temporal Fact Conflicts in LLMs: Reproducibility Insights from Unifying DYNAMICQA and MULAN
by: Dey, Ritajit, et al.
Published: (2026)
by: Dey, Ritajit, et al.
Published: (2026)
InstructIE: A Bilingual Instruction-based Information Extraction Dataset
by: Gui, Honghao, et al.
Published: (2023)
by: Gui, Honghao, et al.
Published: (2023)
Resolving Conflicting Evidence in Automated Fact-Checking: A Study on Retrieval-Augmented LLMs
by: Ge, Ziyu, et al.
Published: (2025)
by: Ge, Ziyu, et al.
Published: (2025)
A Benchmark for Open-Domain Numerical Fact-Checking Enhanced by Claim Decomposition
by: Venktesh, V, et al.
Published: (2025)
by: Venktesh, V, et al.
Published: (2025)
RaFe: Ranking Feedback Improves Query Rewriting for RAG
by: Mao, Shengyu, et al.
Published: (2024)
by: Mao, Shengyu, et al.
Published: (2024)
VeriFact: Verifying Facts in LLM-Generated Clinical Text with Electronic Health Records
by: Chung, Philip, et al.
Published: (2025)
by: Chung, Philip, et al.
Published: (2025)
WISE: Rethinking the Knowledge Memory for Lifelong Model Editing of Large Language Models
by: Wang, Peng, et al.
Published: (2024)
by: Wang, Peng, et al.
Published: (2024)
EasyInstruct: An Easy-to-use Instruction Processing Framework for Large Language Models
by: Ou, Yixin, et al.
Published: (2024)
by: Ou, Yixin, et al.
Published: (2024)
OmniThink: Expanding Knowledge Boundaries in Machine Writing through Thinking
by: Xi, Zekun, et al.
Published: (2025)
by: Xi, Zekun, et al.
Published: (2025)
DataScout: Automatic Data Fact Retrieval for Statement Augmentation with an LLM-Based Agent
by: Chen, Chuer, et al.
Published: (2025)
by: Chen, Chuer, et al.
Published: (2025)
Combining Evidence and Reasoning for Biomedical Fact-Checking
by: Barone, Mariano, et al.
Published: (2025)
by: Barone, Mariano, et al.
Published: (2025)
Scaling Generalist Data-Analytic Agents
by: Qiao, Shuofei, et al.
Published: (2025)
by: Qiao, Shuofei, et al.
Published: (2025)
CodeKGC: Code Language Model for Generative Knowledge Graph Construction
by: Bi, Zhen, et al.
Published: (2023)
by: Bi, Zhen, et al.
Published: (2023)
Efficiency and Effectiveness of LLM-Based Summarization of Evidence in Crowdsourced Fact-Checking
by: Roitero, Kevin, et al.
Published: (2025)
by: Roitero, Kevin, et al.
Published: (2025)
OneGen: Efficient One-Pass Unified Generation and Retrieval for LLMs
by: Zhang, Jintian, et al.
Published: (2024)
by: Zhang, Jintian, et al.
Published: (2024)
+VeriRel: Verification Feedback to Enhance Document Retrieval for Scientific Fact Checking
by: Deng, Xingyu, et al.
Published: (2025)
by: Deng, Xingyu, et al.
Published: (2025)
VeriTaS: The First Dynamic Benchmark for Multimodal Automated Fact-Checking
by: Rothermel, Mark, et al.
Published: (2026)
by: Rothermel, Mark, et al.
Published: (2026)
From Data to Behavior: Predicting Unintended Model Behaviors Before Training
by: Wang, Mengru, et al.
Published: (2026)
by: Wang, Mengru, et al.
Published: (2026)
MLLM can see? Dynamic Correction Decoding for Hallucination Mitigation
by: Wang, Chenxi, et al.
Published: (2024)
by: Wang, Chenxi, et al.
Published: (2024)
SemEval-2025 Task 7: Multilingual and Crosslingual Fact-Checked Claim Retrieval
by: Peng, Qiwei, et al.
Published: (2025)
by: Peng, Qiwei, et al.
Published: (2025)
Fact Finder -- Enhancing Domain Expertise of Large Language Models by Incorporating Knowledge Graphs
by: Steinigen, Daniel, et al.
Published: (2024)
by: Steinigen, Daniel, et al.
Published: (2024)
The Great Nugget Recall: Automating Fact Extraction and RAG Evaluation with Large Language Models
by: Pradeep, Ronak, et al.
Published: (2025)
by: Pradeep, Ronak, et al.
Published: (2025)
From Facts to Conclusions : Integrating Deductive Reasoning in Retrieval-Augmented LLMs
by: Mishra, Shubham, et al.
Published: (2025)
by: Mishra, Shubham, et al.
Published: (2025)
Exploring Multidimensional Checkworthiness: Designing AI-assisted Claim Prioritization for Human Fact-checkers
by: Liu, Houjiang, et al.
Published: (2024)
by: Liu, Houjiang, et al.
Published: (2024)
CaKE: Circuit-aware Editing Enables Generalizable Knowledge Learners
by: Yao, Yunzhi, et al.
Published: (2025)
by: Yao, Yunzhi, et al.
Published: (2025)
FinVet: A Collaborative Framework of RAG and External Fact-Checking Agents for Financial Misinformation Detection
by: Araya, Daniel Berhane, et al.
Published: (2025)
by: Araya, Daniel Berhane, et al.
Published: (2025)
From Verification to Amplification: Auditing Reverse Image Search as Algorithmic Gatekeeping in Visual Misinformation Fact-checking
by: Lin, Cong, et al.
Published: (2026)
by: Lin, Cong, et al.
Published: (2026)
FIRE: Fact-checking with Iterative Retrieval and Verification
by: Xie, Zhuohan, et al.
Published: (2024)
by: Xie, Zhuohan, et al.
Published: (2024)
LightThinker++: From Reasoning Compression to Memory Management
by: Zhu, Yuqi, et al.
Published: (2026)
by: Zhu, Yuqi, et al.
Published: (2026)
Hallucination Detection and Evaluation of Large Language Model
by: Zhang, Chenggong, et al.
Published: (2025)
by: Zhang, Chenggong, et al.
Published: (2025)
Beyond Prompt Engineering: Robust Behavior Control in LLMs via Steering Target Atoms
by: Wang, Mengru, et al.
Published: (2025)
by: Wang, Mengru, et al.
Published: (2025)
Knowledge Circuits in Pretrained Transformers
by: Yao, Yunzhi, et al.
Published: (2024)
by: Yao, Yunzhi, et al.
Published: (2024)
Credible, Unreliable or Leaked?: Evidence Verification for Enhanced Automated Fact-checking
by: Chrysidis, Zacharias, et al.
Published: (2024)
by: Chrysidis, Zacharias, et al.
Published: (2024)
Use of Retrieval-Augmented Large Language Model Agent for Long-Form COVID-19 Fact-Checking
by: Huang, Jingyi, et al.
Published: (2025)
by: Huang, Jingyi, et al.
Published: (2025)
Similar Items
-
Making Language Models Better Tool Learners with Execution Feedback
by: Qiao, Shuofei, et al.
Published: (2023) -
CKnowEdit: A New Chinese Knowledge Editing Dataset for Linguistics, Facts, and Logic Error Correction in LLMs
by: Fang, Jizhan, et al.
Published: (2024) -
Unified Hallucination Detection for Multimodal Large Language Models
by: Chen, Xiang, et al.
Published: (2024) -
Towards Unification of Hallucination Detection and Fact Verification for Large Language Models
by: Su, Weihang, et al.
Published: (2025) -
IEPile: Unearthing Large-Scale Schema-Based Information Extraction Corpus
by: Gui, Honghao, et al.
Published: (2024)