LEAF: Learning and Evaluation Augmented by Fact-Checking to Improve Factualness in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tran, Hieu, Wang, Junda, Ting, Yujan, Huang, Weijing, Chen, Terrence |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SemiHVision: Enhancing Medical Multimodal Models with a Semi-Human Annotated Dataset and Fine-Tuned Instruction Generation
par: Wang, Junda, et autres
Publié: (2024)
par: Wang, Junda, et autres
Publié: (2024)
Hallucination to Truth: A Review of Fact-Checking and Factuality Evaluation in Large Language Models
par: Rahman, Subhey Sadi, et autres
Publié: (2025)
par: Rahman, Subhey Sadi, et autres
Publié: (2025)
FactAlign: Long-form Factuality Alignment of Large Language Models
par: Huang, Chao-Wei, et autres
Publié: (2024)
par: Huang, Chao-Wei, et autres
Publié: (2024)
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
par: Yang, Shuo, et autres
Publié: (2025)
par: Yang, Shuo, et autres
Publié: (2025)
OpenFactCheck: A Unified Framework for Factuality Evaluation of LLMs
par: Iqbal, Hasan, et autres
Publié: (2024)
par: Iqbal, Hasan, et autres
Publié: (2024)
TrumorGPT: Graph-Based Retrieval-Augmented Large Language Model for Fact-Checking
par: Hang, Ching Nam, et autres
Publié: (2025)
par: Hang, Ching Nam, et autres
Publié: (2025)
MedFact: Benchmarking the Fact-Checking Capabilities of Large Language Models on Chinese Medical Texts
par: He, Jiayi, et autres
Publié: (2025)
par: He, Jiayi, et autres
Publié: (2025)
Fact-Checking with Large Language Models via Probabilistic Certainty and Consistency
par: Wang, Haoran, et autres
Publié: (2026)
par: Wang, Haoran, et autres
Publié: (2026)
Use of Retrieval-Augmented Large Language Model Agent for Long-Form COVID-19 Fact-Checking
par: Huang, Jingyi, et autres
Publié: (2025)
par: Huang, Jingyi, et autres
Publié: (2025)
Multimodal Large Language Models to Support Real-World Fact-Checking
par: Geng, Jiahui, et autres
Publié: (2024)
par: Geng, Jiahui, et autres
Publié: (2024)
InFact: Informativeness Alignment for Improved LLM Factuality
par: Cohen, Roi, et autres
Publié: (2025)
par: Cohen, Roi, et autres
Publié: (2025)
ClaimCheck: Real-Time Fact-Checking with Small Language Models
par: Putta, Akshith Reddy, et autres
Publié: (2025)
par: Putta, Akshith Reddy, et autres
Publié: (2025)
FactReasoner: A Probabilistic Approach to Long-Form Factuality Assessment for Large Language Models
par: Marinescu, Radu, et autres
Publié: (2025)
par: Marinescu, Radu, et autres
Publié: (2025)
FactCorrector: A Graph-Inspired Approach to Long-Form Factuality Correction of Large Language Models
par: Carnerero-Cano, Javier, et autres
Publié: (2026)
par: Carnerero-Cano, Javier, et autres
Publié: (2026)
CORRECT: Context- and Reference-Augmented Reasoning and Prompting for Fact-Checking
par: Zhang, Delvin Ce, et autres
Publié: (2025)
par: Zhang, Delvin Ce, et autres
Publié: (2025)
Improving Reliability and Explainability of Medical Question Answering through Atomic Fact Checking in Retrieval-Augmented LLMs
par: Vladika, Juraj, et autres
Publié: (2025)
par: Vladika, Juraj, et autres
Publié: (2025)
Evaluating Evidence Attribution in Generated Fact Checking Explanations
par: Xing, Rui, et autres
Publié: (2024)
par: Xing, Rui, et autres
Publié: (2024)
MetaSumPerceiver: Multimodal Multi-Document Evidence Summarization for Fact-Checking
par: Chen, Ting-Chih, et autres
Publié: (2024)
par: Chen, Ting-Chih, et autres
Publié: (2024)
Contrastive Learning to Improve Retrieval for Real-world Fact Checking
par: Sriram, Aniruddh, et autres
Publié: (2024)
par: Sriram, Aniruddh, et autres
Publié: (2024)
Profiling News Media for Factuality and Bias Using LLMs and the Fact-Checking Methodology of Human Experts
par: Mujahid, Zain Muhammad, et autres
Publié: (2025)
par: Mujahid, Zain Muhammad, et autres
Publié: (2025)
InFi-Check: Interpretable and Fine-Grained Fact-Checking of LLMs
par: Bai, Yuzhuo, et autres
Publié: (2026)
par: Bai, Yuzhuo, et autres
Publié: (2026)
Factuality of Large Language Models: A Survey
par: Wang, Yuxia, et autres
Publié: (2024)
par: Wang, Yuxia, et autres
Publié: (2024)
BioInstruct: Instruction Tuning of Large Language Models for Biomedical Natural Language Processing
par: Tran, Hieu, et autres
Publié: (2023)
par: Tran, Hieu, et autres
Publié: (2023)
Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies
par: Ye, Yuxuan, et autres
Publié: (2026)
par: Ye, Yuxuan, et autres
Publié: (2026)
FactTest: Factuality Testing in Large Language Models with Finite-Sample and Distribution-Free Guarantees
par: Nie, Fan, et autres
Publié: (2024)
par: Nie, Fan, et autres
Publié: (2024)
Improve Decoding Factuality by Token-wise Cross Layer Entropy of Large Language Models
par: Wu, Jialiang, et autres
Publié: (2025)
par: Wu, Jialiang, et autres
Publié: (2025)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
par: Liu, Xiaoze, et autres
Publié: (2024)
par: Liu, Xiaoze, et autres
Publié: (2024)
A Survey of Theory of Mind in Large Language Models: Evaluations, Representations, and Safety Risks
par: Nguyen, Hieu Minh "Jord"
Publié: (2025)
par: Nguyen, Hieu Minh "Jord"
Publié: (2025)
Fact-Checking the Output of Large Language Models via Token-Level Uncertainty Quantification
par: Fadeeva, Ekaterina, et autres
Publié: (2024)
par: Fadeeva, Ekaterina, et autres
Publié: (2024)
Beyond Facts: Evaluating Intent Hallucination in Large Language Models
par: Hao, Yijie, et autres
Publié: (2025)
par: Hao, Yijie, et autres
Publié: (2025)
FLAME: Factuality-Aware Alignment for Large Language Models
par: Lin, Sheng-Chieh, et autres
Publié: (2024)
par: Lin, Sheng-Chieh, et autres
Publié: (2024)
Reasoning Factual Knowledge in Structured Data with Large Language Models
par: Huang, Sirui, et autres
Publié: (2024)
par: Huang, Sirui, et autres
Publié: (2024)
MiniCheck: Efficient Fact-Checking of LLMs on Grounding Documents
par: Tang, Liyan, et autres
Publié: (2024)
par: Tang, Liyan, et autres
Publié: (2024)
Application and Optimization of Large Models Based on Prompt Tuning for Fact-Check-Worthiness Estimation
par: Yu, Yinglong, et autres
Publié: (2025)
par: Yu, Yinglong, et autres
Publié: (2025)
SemViQA: A Semantic Question Answering System for Vietnamese Information Fact-Checking
par: Tran, Dien X., et autres
Publié: (2025)
par: Tran, Dien X., et autres
Publié: (2025)
Generating Benchmarks for Factuality Evaluation of Language Models
par: Muhlgay, Dor, et autres
Publié: (2023)
par: Muhlgay, Dor, et autres
Publié: (2023)
Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling
par: Yang, Linyao, et autres
Publié: (2023)
par: Yang, Linyao, et autres
Publié: (2023)
Surprising Efficacy of Fine-Tuned Transformers for Fact-Checking over Larger Language Models
par: Setty, Vinay
Publié: (2024)
par: Setty, Vinay
Publié: (2024)
SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models
par: Zhang, Jianyi, et autres
Publié: (2024)
par: Zhang, Jianyi, et autres
Publié: (2024)
XMainframe: A Large Language Model for Mainframe Modernization
par: Dau, Anh T. V., et autres
Publié: (2024)
par: Dau, Anh T. V., et autres
Publié: (2024)
Documents similaires
-
SemiHVision: Enhancing Medical Multimodal Models with a Semi-Human Annotated Dataset and Fine-Tuned Instruction Generation
par: Wang, Junda, et autres
Publié: (2024) -
Hallucination to Truth: A Review of Fact-Checking and Factuality Evaluation in Large Language Models
par: Rahman, Subhey Sadi, et autres
Publié: (2025) -
FactAlign: Long-form Factuality Alignment of Large Language Models
par: Huang, Chao-Wei, et autres
Publié: (2024) -
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
par: Yang, Shuo, et autres
Publié: (2025) -
OpenFactCheck: A Unified Framework for Factuality Evaluation of LLMs
par: Iqbal, Hasan, et autres
Publié: (2024)