Guardado en:
| Autor principal: | Aghaebrahimian, Ahmad |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2512.03634 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DecMetrics: Structured Claim Decomposition Scoring for Factually Consistent LLM Outputs
por: Huang, Minghui
Publicado: (2025)
por: Huang, Minghui
Publicado: (2025)
Stress Testing Factual Consistency Metrics for Long-Document Summarization
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)
Semantic Consistency-Based Uncertainty Quantification for Factuality in Radiology Report Generation
por: Wang, Chenyu, et al.
Publicado: (2024)
por: Wang, Chenyu, et al.
Publicado: (2024)
OpenFactCheck: A Unified Framework for Factuality Evaluation of LLMs
por: Iqbal, Hasan, et al.
Publicado: (2024)
por: Iqbal, Hasan, et al.
Publicado: (2024)
Do Automatic Factuality Metrics Measure Factuality? A Critical Evaluation
por: Ramprasad, Sanjana, et al.
Publicado: (2024)
por: Ramprasad, Sanjana, et al.
Publicado: (2024)
Aligning Knowledge Graphs and Language Models for Factual Accuracy
por: Nishat, Nur A Zarin, et al.
Publicado: (2025)
por: Nishat, Nur A Zarin, et al.
Publicado: (2025)
Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies
por: Ye, Yuxuan, et al.
Publicado: (2026)
por: Ye, Yuxuan, et al.
Publicado: (2026)
LEAF: Learning and Evaluation Augmented by Fact-Checking to Improve Factualness in Large Language Models
por: Tran, Hieu, et al.
Publicado: (2024)
por: Tran, Hieu, et al.
Publicado: (2024)
Improving Factual Consistency of News Summarization by Contrastive Preference Optimization
por: Feng, Huawen, et al.
Publicado: (2023)
por: Feng, Huawen, et al.
Publicado: (2023)
FactAlign: Long-form Factuality Alignment of Large Language Models
por: Huang, Chao-Wei, et al.
Publicado: (2024)
por: Huang, Chao-Wei, et al.
Publicado: (2024)
Real-time Factuality Assessment from Adversarial Feedback
por: Chen, Sanxing, et al.
Publicado: (2024)
por: Chen, Sanxing, et al.
Publicado: (2024)
OpenFActScore: Open-Source Atomic Evaluation of Factuality in Text Generation
por: Lage, Lucas Fonseca, et al.
Publicado: (2025)
por: Lage, Lucas Fonseca, et al.
Publicado: (2025)
Less is More for Improving Automatic Evaluation of Factual Consistency
por: Wang, Tong, et al.
Publicado: (2024)
por: Wang, Tong, et al.
Publicado: (2024)
Face4RAG: Factual Consistency Evaluation for Retrieval Augmented Generation in Chinese
por: Xu, Yunqi, et al.
Publicado: (2024)
por: Xu, Yunqi, et al.
Publicado: (2024)
Hallucination to Truth: A Review of Fact-Checking and Factuality Evaluation in Large Language Models
por: Rahman, Subhey Sadi, et al.
Publicado: (2025)
por: Rahman, Subhey Sadi, et al.
Publicado: (2025)
KnowHalu: Hallucination Detection via Multi-Form Knowledge Based Factual Checking
por: Zhang, Jiawei, et al.
Publicado: (2024)
por: Zhang, Jiawei, et al.
Publicado: (2024)
Consistency Checks for Language Model Forecasters
por: Paleka, Daniel, et al.
Publicado: (2024)
por: Paleka, Daniel, et al.
Publicado: (2024)
Profiling News Media for Factuality and Bias Using LLMs and the Fact-Checking Methodology of Human Experts
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)
ConsistencyAI: A Benchmark to Assess LLMs' Factual Consistency When Responding to Different Demographic Groups
por: Banyas, Peter, et al.
Publicado: (2025)
por: Banyas, Peter, et al.
Publicado: (2025)
Fact-Checking with Large Language Models via Probabilistic Certainty and Consistency
por: Wang, Haoran, et al.
Publicado: (2026)
por: Wang, Haoran, et al.
Publicado: (2026)
Reasoning before Comparison: LLM-Enhanced Semantic Similarity Metrics for Domain Specialized Text Analysis
por: Xu, Shaochen, et al.
Publicado: (2024)
por: Xu, Shaochen, et al.
Publicado: (2024)
Consistency Analysis of Sentiment Predictions using Syntactic & Semantic Context Assessment Summarization (SSAS)
por: Daruwalla, Sharookh, et al.
Publicado: (2026)
por: Daruwalla, Sharookh, et al.
Publicado: (2026)
Is Conformal Factuality for RAG-based LLMs Robust? Novel Metrics and Systematic Insights
por: Chen, Yi, et al.
Publicado: (2026)
por: Chen, Yi, et al.
Publicado: (2026)
BiCon-Gate: Consistency-Gated De-colloquialisation for Dialogue Fact-Checking
por: Park, Hyunkyung, et al.
Publicado: (2026)
por: Park, Hyunkyung, et al.
Publicado: (2026)
ReFEree: Reference-Free and Fine-Grained Method for Evaluating Factual Consistency in Real-World Code Summarization
por: Bae, Suyoung, et al.
Publicado: (2026)
por: Bae, Suyoung, et al.
Publicado: (2026)
Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models
por: Qi, Jirui, et al.
Publicado: (2023)
por: Qi, Jirui, et al.
Publicado: (2023)
Evaluating the Factuality of Zero-shot Summarizers Across Varied Domains
por: Ramprasad, Sanjana, et al.
Publicado: (2024)
por: Ramprasad, Sanjana, et al.
Publicado: (2024)
Mitigating Geospatial Knowledge Hallucination in Large Language Models: Benchmarking and Dynamic Factuality Aligning
por: Wang, Shengyuan, et al.
Publicado: (2025)
por: Wang, Shengyuan, et al.
Publicado: (2025)
Factuality on Demand: Controlling the Factuality-Informativeness Trade-off in Text Generation
por: Gong, Ziwei, et al.
Publicado: (2026)
por: Gong, Ziwei, et al.
Publicado: (2026)
The Factuality of Large Language Models in the Legal Domain
por: Hamdani, Rajaa El, et al.
Publicado: (2024)
por: Hamdani, Rajaa El, et al.
Publicado: (2024)
VeriCoT: Neuro-symbolic Chain-of-Thought Validation via Logical Consistency Checks
por: Feng, Yu, et al.
Publicado: (2025)
por: Feng, Yu, et al.
Publicado: (2025)
An Empirical Investigation of Domain Adaptation Ability for Chinese Spelling Check Models
por: Wang, Xi, et al.
Publicado: (2024)
por: Wang, Xi, et al.
Publicado: (2024)
Is Factuality Enhancement a Free Lunch For LLMs? Better Factuality Can Lead to Worse Context-Faithfulness
por: Bi, Baolong, et al.
Publicado: (2024)
por: Bi, Baolong, et al.
Publicado: (2024)
FactReasoner: A Probabilistic Approach to Long-Form Factuality Assessment for Large Language Models
por: Marinescu, Radu, et al.
Publicado: (2025)
por: Marinescu, Radu, et al.
Publicado: (2025)
Knowledge-Level Consistency Reinforcement Learning: Dual-Fact Alignment for Long-Form Factuality
por: Li, Junliang, et al.
Publicado: (2025)
por: Li, Junliang, et al.
Publicado: (2025)
HarmMetric Eval: Benchmarking Metrics and Judges for LLM Harmfulness Assessment
por: Yang, Langqi, et al.
Publicado: (2025)
por: Yang, Langqi, et al.
Publicado: (2025)
Veracity: An Open-Source AI Fact-Checking System
por: Curtis, Taylor Lynn, et al.
Publicado: (2025)
por: Curtis, Taylor Lynn, et al.
Publicado: (2025)
TriAlign: Towards Universal Truth Consistency in Personalized LLM Alignment
por: Nguyen, Thi-Nhung, et al.
Publicado: (2026)
por: Nguyen, Thi-Nhung, et al.
Publicado: (2026)
Evaluating Causal Explanation in Medical Reports with LLM-Based and Human-Aligned Metrics
por: Cho, Yousang, et al.
Publicado: (2025)
por: Cho, Yousang, et al.
Publicado: (2025)
Semantic Representation Attack against Aligned Large Language Models
por: Lian, Jiawei, et al.
Publicado: (2025)
por: Lian, Jiawei, et al.
Publicado: (2025)
Ejemplares similares
-
DecMetrics: Structured Claim Decomposition Scoring for Factually Consistent LLM Outputs
por: Huang, Minghui
Publicado: (2025) -
Stress Testing Factual Consistency Metrics for Long-Document Summarization
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025) -
Semantic Consistency-Based Uncertainty Quantification for Factuality in Radiology Report Generation
por: Wang, Chenyu, et al.
Publicado: (2024) -
OpenFactCheck: A Unified Framework for Factuality Evaluation of LLMs
por: Iqbal, Hasan, et al.
Publicado: (2024) -
Do Automatic Factuality Metrics Measure Factuality? A Critical Evaluation
por: Ramprasad, Sanjana, et al.
Publicado: (2024)