Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies
Fuente:
arXiv
Guardado en:
| Autores principales: | Ye, Yuxuan, Santos-Rodriguez, Raul, Simpson, Edwin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Using Similarity to Evaluate Factual Consistency in Summaries
por: Ye, Yuxuan, et al.
Publicado: (2024)
por: Ye, Yuxuan, et al.
Publicado: (2024)
Ta'keed: The First Generative Fact-Checking System for Arabic Claims
por: Althabiti, Saud, et al.
Publicado: (2024)
por: Althabiti, Saud, et al.
Publicado: (2024)
ClaimCheck: Real-Time Fact-Checking with Small Language Models
por: Putta, Akshith Reddy, et al.
Publicado: (2025)
por: Putta, Akshith Reddy, et al.
Publicado: (2025)
ThinknCheck: Grounded Claim Verification with Compact, Reasoning-Driven, and Interpretable Models
por: Rao, Delip, et al.
Publicado: (2026)
por: Rao, Delip, et al.
Publicado: (2026)
ClaimIQ at CheckThat! 2025: Comparing Prompted and Fine-Tuned Language Models for Verifying Numerical Claims
por: Anik, Anirban Saha, et al.
Publicado: (2025)
por: Anik, Anirban Saha, et al.
Publicado: (2025)
LEAF: Learning and Evaluation Augmented by Fact-Checking to Improve Factualness in Large Language Models
por: Tran, Hieu, et al.
Publicado: (2024)
por: Tran, Hieu, et al.
Publicado: (2024)
BiDeV: Bilateral Defusing Verification for Complex Claim Fact-Checking
por: Liu, Yuxuan, et al.
Publicado: (2025)
por: Liu, Yuxuan, et al.
Publicado: (2025)
Hallucination to Truth: A Review of Fact-Checking and Factuality Evaluation in Large Language Models
por: Rahman, Subhey Sadi, et al.
Publicado: (2025)
por: Rahman, Subhey Sadi, et al.
Publicado: (2025)
DecMetrics: Structured Claim Decomposition Scoring for Factually Consistent LLM Outputs
por: Huang, Minghui
Publicado: (2025)
por: Huang, Minghui
Publicado: (2025)
AFaCTA: Assisting the Annotation of Factual Claim Detection with Reliable LLM Annotators
por: Ni, Jingwei, et al.
Publicado: (2024)
por: Ni, Jingwei, et al.
Publicado: (2024)
From Chaos to Clarity: Claim Normalization to Empower Fact-Checking
por: Sundriyal, Megha, et al.
Publicado: (2023)
por: Sundriyal, Megha, et al.
Publicado: (2023)
LLMTaxo: Leveraging Large Language Models for Constructing Taxonomy of Factual Claims from Social Media
por: Zhang, Haiqi, et al.
Publicado: (2025)
por: Zhang, Haiqi, et al.
Publicado: (2025)
AlignCheck: a Semantic Open-Domain Metric for Factual Consistency Assessment
por: Aghaebrahimian, Ahmad
Publicado: (2025)
por: Aghaebrahimian, Ahmad
Publicado: (2025)
Language Models' Factuality Depends on the Language of Inquiry
por: Aggarwal, Tushar, et al.
Publicado: (2025)
por: Aggarwal, Tushar, et al.
Publicado: (2025)
Profiling News Media for Factuality and Bias Using LLMs and the Fact-Checking Methodology of Human Experts
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)
Multimodal Claim Extraction for Fact-Checking
por: Teo, Joycelyn, et al.
Publicado: (2026)
por: Teo, Joycelyn, et al.
Publicado: (2026)
MiniCheck: Efficient Fact-Checking of LLMs on Grounding Documents
por: Tang, Liyan, et al.
Publicado: (2024)
por: Tang, Liyan, et al.
Publicado: (2024)
HealthFC: Verifying Health Claims with Evidence-Based Medical Fact-Checking
por: Vladika, Juraj, et al.
Publicado: (2023)
por: Vladika, Juraj, et al.
Publicado: (2023)
How well can LLMs Grade Essays in Arabic?
por: Ghazawi, Rayed, et al.
Publicado: (2025)
por: Ghazawi, Rayed, et al.
Publicado: (2025)
Automated essay scoring in Arabic: a dataset and analysis of a BERT-based system
por: Ghazawi, Rayed, et al.
Publicado: (2024)
por: Ghazawi, Rayed, et al.
Publicado: (2024)
Generating Benchmarks for Factuality Evaluation of Language Models
por: Muhlgay, Dor, et al.
Publicado: (2023)
por: Muhlgay, Dor, et al.
Publicado: (2023)
Factuality of Large Language Models: A Survey
por: Wang, Yuxia, et al.
Publicado: (2024)
por: Wang, Yuxia, et al.
Publicado: (2024)
Editing Factual Knowledge and Explanatory Ability of Medical Large Language Models
por: Xu, Derong, et al.
Publicado: (2024)
por: Xu, Derong, et al.
Publicado: (2024)
FactTest: Factuality Testing in Large Language Models with Finite-Sample and Distribution-Free Guarantees
por: Nie, Fan, et al.
Publicado: (2024)
por: Nie, Fan, et al.
Publicado: (2024)
Aligning Knowledge Graphs and Language Models for Factual Accuracy
por: Nishat, Nur A Zarin, et al.
Publicado: (2025)
por: Nishat, Nur A Zarin, et al.
Publicado: (2025)
FLAME: Factuality-Aware Alignment for Large Language Models
por: Lin, Sheng-Chieh, et al.
Publicado: (2024)
por: Lin, Sheng-Chieh, et al.
Publicado: (2024)
Towards Automated Fact-Checking of Real-World Claims: Exploring Task Formulation and Assessment with LLMs
por: Sahitaj, Premtim, et al.
Publicado: (2025)
por: Sahitaj, Premtim, et al.
Publicado: (2025)
FECT: Factuality Evaluation of Interpretive AI-Generated Claims in Contact Center Conversation Transcripts
por: Shin, Hagyeong, et al.
Publicado: (2025)
por: Shin, Hagyeong, et al.
Publicado: (2025)
Mechanistic Understanding and Mitigation of Language Model Non-Factual Hallucinations
por: Yu, Lei, et al.
Publicado: (2024)
por: Yu, Lei, et al.
Publicado: (2024)
Reasoning Factual Knowledge in Structured Data with Large Language Models
por: Huang, Sirui, et al.
Publicado: (2024)
por: Huang, Sirui, et al.
Publicado: (2024)
ClaimBrush: A Novel Framework for Automated Patent Claim Refinement Based on Large Language Models
por: Kawano, Seiya, et al.
Publicado: (2024)
por: Kawano, Seiya, et al.
Publicado: (2024)
UNH at CheckThat! 2025: Fine-tuning Vs Prompting in Claim Extraction
por: Wilder, Joe, et al.
Publicado: (2025)
por: Wilder, Joe, et al.
Publicado: (2025)
Language Models with Conformal Factuality Guarantees
por: Mohri, Christopher, et al.
Publicado: (2024)
por: Mohri, Christopher, et al.
Publicado: (2024)
SciClaims: An End-to-End Generative System for Biomedical Claim Analysis
por: Ortega, Raúl, et al.
Publicado: (2025)
por: Ortega, Raúl, et al.
Publicado: (2025)
OpenFactCheck: A Unified Framework for Factuality Evaluation of LLMs
por: Iqbal, Hasan, et al.
Publicado: (2024)
por: Iqbal, Hasan, et al.
Publicado: (2024)
PATS: Personality-Aware Teaching Strategies with Large Language Model Tutors
por: Rooein, Donya, et al.
Publicado: (2026)
por: Rooein, Donya, et al.
Publicado: (2026)
Mixture of Reasonings: Teach Large Language Models to Reason with Adaptive Strategies
por: Xiong, Tao, et al.
Publicado: (2025)
por: Xiong, Tao, et al.
Publicado: (2025)
The FACTS Leaderboard: A Comprehensive Benchmark for Large Language Model Factuality
por: Cheng, Aileen, et al.
Publicado: (2025)
por: Cheng, Aileen, et al.
Publicado: (2025)
FactAlign: Long-form Factuality Alignment of Large Language Models
por: Huang, Chao-Wei, et al.
Publicado: (2024)
por: Huang, Chao-Wei, et al.
Publicado: (2024)
Visuospatial Perspective Taking in Multimodal Language Models
por: Prunty, Jonathan, et al.
Publicado: (2026)
por: Prunty, Jonathan, et al.
Publicado: (2026)
Ejemplares similares
-
Using Similarity to Evaluate Factual Consistency in Summaries
por: Ye, Yuxuan, et al.
Publicado: (2024) -
Ta'keed: The First Generative Fact-Checking System for Arabic Claims
por: Althabiti, Saud, et al.
Publicado: (2024) -
ClaimCheck: Real-Time Fact-Checking with Small Language Models
por: Putta, Akshith Reddy, et al.
Publicado: (2025) -
ThinknCheck: Grounded Claim Verification with Compact, Reasoning-Driven, and Interpretable Models
por: Rao, Delip, et al.
Publicado: (2026) -
ClaimIQ at CheckThat! 2025: Comparing Prompted and Fine-Tuned Language Models for Verifying Numerical Claims
por: Anik, Anirban Saha, et al.
Publicado: (2025)