FactCheckmate: Preemptively Detecting and Mitigating Hallucinations in LMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Alnuhait, Deema, Kirtane, Neeraja, Khalifa, Muhammad, Peng, Hao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Language Steering for Multilingual In-Context Learning
par: Kirtane, Neeraja, et autres
Publié: (2026)
par: Kirtane, Neeraja, et autres
Publié: (2026)
LLMs are Vulnerable to Malicious Prompts Disguised as Scientific Language
par: Ge, Yubin, et autres
Publié: (2025)
par: Ge, Yubin, et autres
Publié: (2025)
MathRobust-LV: Evaluation of Large Language Models' Robustness to Linguistic Variations in Mathematical Reasoning
par: Kirtane, Neeraja, et autres
Publié: (2025)
par: Kirtane, Neeraja, et autres
Publié: (2025)
AraTrust: An Evaluation of Trustworthiness for LLMs in Arabic
par: Alghamdi, Emad A., et autres
Publié: (2024)
par: Alghamdi, Emad A., et autres
Publié: (2024)
Language Models Hallucinate, but May Excel at Fact Verification
par: Guan, Jian, et autres
Publié: (2023)
par: Guan, Jian, et autres
Publié: (2023)
Mitigating Hallucinations in Healthcare LLMs with Granular Fact-Checking and Domain-Specific Adaptation
par: Zeba, Musarrat, et autres
Publié: (2025)
par: Zeba, Musarrat, et autres
Publié: (2025)
Hallucination Detection and Hallucination Mitigation: An Investigation
par: Luo, Junliang, et autres
Publié: (2024)
par: Luo, Junliang, et autres
Publié: (2024)
FactCHD: Benchmarking Fact-Conflicting Hallucination Detection
par: Chen, Xiang, et autres
Publié: (2023)
par: Chen, Xiang, et autres
Publié: (2023)
Mitigating the Influence of Distractor Tasks in LMs with Prior-Aware Decoding
par: Douglas, Raymond, et autres
Publié: (2024)
par: Douglas, Raymond, et autres
Publié: (2024)
When Thoughts Meet Facts: Reusable Reasoning for Long-Context LMs
par: Jeong, Soyeong, et autres
Publié: (2025)
par: Jeong, Soyeong, et autres
Publié: (2025)
Mitigating Hallucinations in Large Vision-Language Models with Internal Fact-based Contrastive Decoding
par: Wang, Chao, et autres
Publié: (2025)
par: Wang, Chao, et autres
Publié: (2025)
FactSelfCheck: Fact-Level Black-Box Hallucination Detection for LLMs
par: Sawczyn, Albert, et autres
Publié: (2025)
par: Sawczyn, Albert, et autres
Publié: (2025)
Beyond Facts: Evaluating Intent Hallucination in Large Language Models
par: Hao, Yijie, et autres
Publié: (2025)
par: Hao, Yijie, et autres
Publié: (2025)
Mind the Gap: A Review of Arabic Post-Training Datasets and Their Limitations
par: Alkhowaiter, Mohammed, et autres
Publié: (2025)
par: Alkhowaiter, Mohammed, et autres
Publié: (2025)
Detecting LLM Fact-conflicting Hallucinations Enhanced by Temporal-logic-based Reasoning
par: Li, Ningke, et autres
Publié: (2025)
par: Li, Ningke, et autres
Publié: (2025)
Delta -- Contrastive Decoding Mitigates Text Hallucinations in Large Language Models
par: Huang, Cheng Peng, et autres
Publié: (2025)
par: Huang, Cheng Peng, et autres
Publié: (2025)
Towards Unification of Hallucination Detection and Fact Verification for Large Language Models
par: Su, Weihang, et autres
Publié: (2025)
par: Su, Weihang, et autres
Publié: (2025)
Preemptive Detection and Correction of Misaligned Actions in LLM Agents
par: Fang, Haishuo, et autres
Publié: (2024)
par: Fang, Haishuo, et autres
Publié: (2024)
Fact-Controlled Diagnosis of Hallucinations in Medical Text Summarization
par: BN, Suhas, et autres
Publié: (2025)
par: BN, Suhas, et autres
Publié: (2025)
Can Machines Resonate with Humans? Evaluating the Emotional and Empathic Comprehension of LMs
par: Manzoor, Muhammad Arslan, et autres
Publié: (2024)
par: Manzoor, Muhammad Arslan, et autres
Publié: (2024)
Poly-FEVER: A Multilingual Fact Verification Benchmark for Hallucination Detection in Large Language Models
par: Zhang, Hanzhi, et autres
Publié: (2025)
par: Zhang, Hanzhi, et autres
Publié: (2025)
HalluDetect: Detecting, Mitigating, and Benchmarking Hallucinations in Conversational Systems in the Legal Domain
par: Anaokar, Spandan, et autres
Publié: (2025)
par: Anaokar, Spandan, et autres
Publié: (2025)
Reducing Hallucinations in Entity Abstract Summarization with Facts-Template Decomposition
par: Zhu, Fangwei, et autres
Publié: (2024)
par: Zhu, Fangwei, et autres
Publié: (2024)
Mitigating Hallucination on Hallucination in RAG via Ensemble Voting
par: Xie, Zequn, et autres
Publié: (2026)
par: Xie, Zequn, et autres
Publié: (2026)
MAVEN-Fact: A Large-scale Event Factuality Detection Dataset
par: Li, Chunyang, et autres
Publié: (2024)
par: Li, Chunyang, et autres
Publié: (2024)
Mitigating Temporal Misalignment by Discarding Outdated Facts
par: Zhang, Michael J. Q., et autres
Publié: (2023)
par: Zhang, Michael J. Q., et autres
Publié: (2023)
On Large Language Models' Hallucination with Regard to Known Facts
par: Jiang, Che, et autres
Publié: (2024)
par: Jiang, Che, et autres
Publié: (2024)
Are BabyLMs Second Language Learners?
par: Edman, Lukas, et autres
Publié: (2024)
par: Edman, Lukas, et autres
Publié: (2024)
Developing a Reliable, Fast, General-Purpose Hallucination Detection and Mitigation Service
par: Wang, Song, et autres
Publié: (2024)
par: Wang, Song, et autres
Publié: (2024)
Counterfactual Probing for Hallucination Detection and Mitigation in Large Language Models
par: Feng, Yijun
Publié: (2025)
par: Feng, Yijun
Publié: (2025)
Hallucination Mitigating for Medical Report Generation
par: Zhao, Ruoqing, et autres
Publié: (2026)
par: Zhao, Ruoqing, et autres
Publié: (2026)
On Many-Shot In-Context Learning for Long-Context Evaluation
par: Zou, Kaijian, et autres
Publié: (2024)
par: Zou, Kaijian, et autres
Publié: (2024)
LitCab: Lightweight Language Model Calibration over Short- and Long-form Responses
par: Liu, Xin, et autres
Publié: (2023)
par: Liu, Xin, et autres
Publié: (2023)
Learning to Trust Your Feelings: Leveraging Self-awareness in LLMs for Hallucination Mitigation
par: Liang, Yuxin, et autres
Publié: (2024)
par: Liang, Yuxin, et autres
Publié: (2024)
$\textbf{PLUM}$: Improving Code LMs with Execution-Guided On-Policy Preference Learning Driven By Synthetic Test Cases
par: Zhang, Dylan, et autres
Publié: (2024)
par: Zhang, Dylan, et autres
Publié: (2024)
A Typologically Grounded Evaluation Framework for Word Order and Morphology Sensitivity in Multilingual Masked LMs
par: Feldman, Anna, et autres
Publié: (2026)
par: Feldman, Anna, et autres
Publié: (2026)
How to Make LMs Strong Node Classifiers?
par: Xu, Zhe, et autres
Publié: (2024)
par: Xu, Zhe, et autres
Publié: (2024)
Linguistic Generalizations are not Rules: Impacts on Evaluation of LMs
par: Weissweiler, Leonie, et autres
Publié: (2025)
par: Weissweiler, Leonie, et autres
Publié: (2025)
Countdown-Code: A Testbed for Studying The Emergence and Generalization of Reward Hacking in RLVR
par: Khalifa, Muhammad, et autres
Publié: (2026)
par: Khalifa, Muhammad, et autres
Publié: (2026)
Detection and Mitigation of Hallucination in Large Reasoning Models: A Mechanistic Perspective
par: Sun, Zhongxiang, et autres
Publié: (2025)
par: Sun, Zhongxiang, et autres
Publié: (2025)
Documents similaires
-
Language Steering for Multilingual In-Context Learning
par: Kirtane, Neeraja, et autres
Publié: (2026) -
LLMs are Vulnerable to Malicious Prompts Disguised as Scientific Language
par: Ge, Yubin, et autres
Publié: (2025) -
MathRobust-LV: Evaluation of Large Language Models' Robustness to Linguistic Variations in Mathematical Reasoning
par: Kirtane, Neeraja, et autres
Publié: (2025) -
AraTrust: An Evaluation of Trustworthiness for LLMs in Arabic
par: Alghamdi, Emad A., et autres
Publié: (2024) -
Language Models Hallucinate, but May Excel at Fact Verification
par: Guan, Jian, et autres
Publié: (2023)