Logical Consistency of Large Language Models in Fact-checking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ghosh, Bishwamittra, Hasan, Sarah, Arafat, Naheed Anjum, Khan, Arijit |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Perils & Promises of Fact-checking with Large Language Models
par: Quelle, Dorian, et autres
Publié: (2023)
par: Quelle, Dorian, et autres
Publié: (2023)
Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective
par: Ghosh, Bishwamittra, et autres
Publié: (2026)
par: Ghosh, Bishwamittra, et autres
Publié: (2026)
Scalable Fact-checking with Human-in-the-Loop
par: Yang, Jing, et autres
Publié: (2021)
par: Yang, Jing, et autres
Publié: (2021)
Automatic Fact-checking in English and Telugu
par: Chikkala, Ravi Kiran, et autres
Publié: (2025)
par: Chikkala, Ravi Kiran, et autres
Publié: (2025)
Poly-FEVER: A Multilingual Fact Verification Benchmark for Hallucination Detection in Large Language Models
par: Zhang, Hanzhi, et autres
Publié: (2025)
par: Zhang, Hanzhi, et autres
Publié: (2025)
LLM Enhancer: Merged Approach using Vector Embedding for Reducing Large Language Model Hallucinations with External Knowledge
par: Rayhan, Naheed, et autres
Publié: (2025)
par: Rayhan, Naheed, et autres
Publié: (2025)
FIRE: Fact-checking with Iterative Retrieval and Verification
par: Xie, Zhuohan, et autres
Publié: (2024)
par: Xie, Zhuohan, et autres
Publié: (2024)
Zero-Shot Fact Verification via Natural Logic and Large Language Models
par: Strong, Marek, et autres
Publié: (2024)
par: Strong, Marek, et autres
Publié: (2024)
MedFact: A Large-scale Chinese Dataset for Evidence-based Medical Fact-checking of LLM Responses
par: Chen, Tong, et autres
Publié: (2025)
par: Chen, Tong, et autres
Publié: (2025)
Fact-Checking with Large Language Models via Probabilistic Certainty and Consistency
par: Wang, Haoran, et autres
Publié: (2026)
par: Wang, Haoran, et autres
Publié: (2026)
Explainable Fact-checking through Question Answering
par: Yang, Jing, et autres
Publié: (2021)
par: Yang, Jing, et autres
Publié: (2021)
Fact2Fiction: Targeted Poisoning Attack to Agentic Fact-checking System
par: He, Haorui, et autres
Publié: (2025)
par: He, Haorui, et autres
Publié: (2025)
Large Language Model Prompt Datasets: An In-depth Analysis and Insights
par: Zhang, Yuanming, et autres
Publié: (2025)
par: Zhang, Yuanming, et autres
Publié: (2025)
Universal Adversarial Suffixes for Language Models Using Reinforcement Learning with Calibrated Reward
par: Soor, Sampriti, et autres
Publié: (2025)
par: Soor, Sampriti, et autres
Publié: (2025)
CLR-Fact: Evaluating the Complex Logical Reasoning Capability of Large Language Models over Factual Knowledge
par: Zheng, Tianshi, et autres
Publié: (2024)
par: Zheng, Tianshi, et autres
Publié: (2024)
Learning to Generate and Evaluate Fact-checking Explanations with Transformers
par: Feher, Darius, et autres
Publié: (2024)
par: Feher, Darius, et autres
Publié: (2024)
Entity-aware Cross-lingual Claim Detection for Automated Fact-checking
par: Panchendrarajan, Rrubaa, et autres
Publié: (2025)
par: Panchendrarajan, Rrubaa, et autres
Publié: (2025)
Human-centered NLP Fact-checking: Co-Designing with Fact-checkers using Matchmaking for AI
par: Liu, Houjiang, et autres
Publié: (2023)
par: Liu, Houjiang, et autres
Publié: (2023)
Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language Models
par: Liu, Yinhong, et autres
Publié: (2024)
par: Liu, Yinhong, et autres
Publié: (2024)
Attacks by Content: Automated Fact-checking is an AI Security Issue
par: Schlichtkrull, Michael
Publié: (2025)
par: Schlichtkrull, Michael
Publié: (2025)
Pipeline and Dataset Generation for Automated Fact-checking in Almost Any Language
par: Drchal, Jan, et autres
Publié: (2023)
par: Drchal, Jan, et autres
Publié: (2023)
FactCheck Editor: Multilingual Text Editor with End-to-End fact-checking
par: Setty, Vinay
Publié: (2024)
par: Setty, Vinay
Publié: (2024)
Evaluating open-source Large Language Models for automated fact-checking
par: Fontana, Nicolo', et autres
Publié: (2025)
par: Fontana, Nicolo', et autres
Publié: (2025)
Can LLMs Produce Faithful Explanations For Fact-checking? Towards Faithful Explainable Fact-Checking via Multi-Agent Debate
par: Kim, Kyungha, et autres
Publié: (2024)
par: Kim, Kyungha, et autres
Publié: (2024)
Fact-checking AI-generated news reports: Can LLMs catch their own lies?
par: Yao, Jiayi, et autres
Publié: (2025)
par: Yao, Jiayi, et autres
Publié: (2025)
Scaling Laws for Fact Memorization of Large Language Models
par: Lu, Xingyu, et autres
Publié: (2024)
par: Lu, Xingyu, et autres
Publié: (2024)
Towards Large Language Model driven Reference-less Translation Evaluation for English and Indian Languages
par: Mujadia, Vandan, et autres
Publié: (2024)
par: Mujadia, Vandan, et autres
Publié: (2024)
From Prejudice to Parity: A New Approach to Debiasing Large Language Model Word Embeddings
par: Rakshit, Aishik, et autres
Publié: (2024)
par: Rakshit, Aishik, et autres
Publié: (2024)
Rote Learning Considered Useful: Generalizing over Memorized Data in LLMs
par: Wu, Qinyuan, et autres
Publié: (2025)
par: Wu, Qinyuan, et autres
Publié: (2025)
SANSKRITI: A Comprehensive Benchmark for Evaluating Language Models' Knowledge of Indian Culture
par: Maji, Arijit, et autres
Publié: (2025)
par: Maji, Arijit, et autres
Publié: (2025)
Exploring Multimodal Large Language Models for Radiology Report Error-checking
par: Wu, Jinge, et autres
Publié: (2023)
par: Wu, Jinge, et autres
Publié: (2023)
Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling
par: Yang, Linyao, et autres
Publié: (2023)
par: Yang, Linyao, et autres
Publié: (2023)
fact check AI at SemEval-2025 Task 7: Multilingual and Crosslingual Fact-checked Claim Retrieval
par: Rastogi, Pranshu
Publié: (2025)
par: Rastogi, Pranshu
Publié: (2025)
Confidence-Weighted Token Set Cover for Early Hypothesis Pruning in Self-Consistency
par: Sultan, Md Arafat, et autres
Publié: (2025)
par: Sultan, Md Arafat, et autres
Publié: (2025)
Claim Detection for Automated Fact-checking: A Survey on Monolingual, Multilingual and Cross-Lingual Research
par: Panchendrarajan, Rrubaa, et autres
Publié: (2024)
par: Panchendrarajan, Rrubaa, et autres
Publié: (2024)
SAC3: Reliable Hallucination Detection in Black-Box Language Models via Semantic-aware Cross-check Consistency
par: Zhang, Jiaxin, et autres
Publié: (2023)
par: Zhang, Jiaxin, et autres
Publié: (2023)
Scalable Influence and Fact Tracing for Large Language Model Pretraining
par: Chang, Tyler A., et autres
Publié: (2024)
par: Chang, Tyler A., et autres
Publié: (2024)
Kongzi: A Historical Large Language Model with Fact Enhancement
par: Yang, Jiashu, et autres
Publié: (2025)
par: Yang, Jiashu, et autres
Publié: (2025)
In Agents We Trust, but Who Do Agents Trust? Latent Source Preferences Steer LLM Generations
par: Khan, Mohammad Aflah, et autres
Publié: (2026)
par: Khan, Mohammad Aflah, et autres
Publié: (2026)
Not All That Is Fluent Is Factual: Investigating Hallucinations of Large Language Models in Academic Writing
par: Khan, Humam, et autres
Publié: (2026)
par: Khan, Humam, et autres
Publié: (2026)
Documents similaires
-
The Perils & Promises of Fact-checking with Large Language Models
par: Quelle, Dorian, et autres
Publié: (2023) -
Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective
par: Ghosh, Bishwamittra, et autres
Publié: (2026) -
Scalable Fact-checking with Human-in-the-Loop
par: Yang, Jing, et autres
Publié: (2021) -
Automatic Fact-checking in English and Telugu
par: Chikkala, Ravi Kiran, et autres
Publié: (2025) -
Poly-FEVER: A Multilingual Fact Verification Benchmark for Hallucination Detection in Large Language Models
par: Zhang, Hanzhi, et autres
Publié: (2025)