Using Similarity to Evaluate Factual Consistency in Summaries
Fuente:
arXiv
Salvato in:
| Autori principali: | Ye, Yuxuan, Simpson, Edwin, Rodriguez, Raul Santos |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies
di: Ye, Yuxuan, et al.
Pubblicazione: (2026)
di: Ye, Yuxuan, et al.
Pubblicazione: (2026)
mFACE: Multilingual Summarization with Factual Consistency Evaluation
di: Aharoni, Roee, et al.
Pubblicazione: (2022)
di: Aharoni, Roee, et al.
Pubblicazione: (2022)
Zero-shot Factual Consistency Evaluation Across Domains
di: Agarwal, Raunak
Pubblicazione: (2024)
di: Agarwal, Raunak
Pubblicazione: (2024)
Grounded Visual Factualization: Factual Anchor-Based Finetuning for Enhancing MLLM Factual Consistency
di: Morbiato, Filippo, et al.
Pubblicazione: (2025)
di: Morbiato, Filippo, et al.
Pubblicazione: (2025)
An Extensive Evaluation of Factual Consistency in Large Language Models for Data-to-Text Generation
di: Mahapatra, Joy, et al.
Pubblicazione: (2024)
di: Mahapatra, Joy, et al.
Pubblicazione: (2024)
BanglaSummEval: Reference-Free Factual Consistency Evaluation for Bangla Summarization
di: Rafid, Ahmed, et al.
Pubblicazione: (2026)
di: Rafid, Ahmed, et al.
Pubblicazione: (2026)
Less is More for Improving Automatic Evaluation of Factual Consistency
di: Wang, Tong, et al.
Pubblicazione: (2024)
di: Wang, Tong, et al.
Pubblicazione: (2024)
FIZZ: Factual Inconsistency Detection by Zoom-in Summary and Zoom-out Document
di: Yang, Joonho, et al.
Pubblicazione: (2024)
di: Yang, Joonho, et al.
Pubblicazione: (2024)
MedFactEval and MedAgentBrief: A Framework and Workflow for Generating and Evaluating Factual Clinical Summaries
di: Grolleau, François, et al.
Pubblicazione: (2025)
di: Grolleau, François, et al.
Pubblicazione: (2025)
Enhancing Factuality through Consensus and Consistency in Summarization Using Minimum Bayes Risk Decoding
di: Soetedjo, Riza Setiawan, et al.
Pubblicazione: (2026)
di: Soetedjo, Riza Setiawan, et al.
Pubblicazione: (2026)
SIFiD: Reassess Summary Factual Inconsistency Detection with LLM
di: Yang, Jiuding, et al.
Pubblicazione: (2024)
di: Yang, Jiuding, et al.
Pubblicazione: (2024)
Self-Consistent Decoding for More Factual Open Responses
di: Malon, Christopher, et al.
Pubblicazione: (2024)
di: Malon, Christopher, et al.
Pubblicazione: (2024)
Adapting AlignScore Mertic for Factual Consistency Evaluation of Text in Russian: A Student Abstract
di: Zimin, Mikhail, et al.
Pubblicazione: (2025)
di: Zimin, Mikhail, et al.
Pubblicazione: (2025)
PlainQAFact: Retrieval-augmented Factual Consistency Evaluation Metric for Biomedical Plain Language Summarization
di: You, Zhiwen, et al.
Pubblicazione: (2025)
di: You, Zhiwen, et al.
Pubblicazione: (2025)
Face4RAG: Factual Consistency Evaluation for Retrieval Augmented Generation in Chinese
di: Xu, Yunqi, et al.
Pubblicazione: (2024)
di: Xu, Yunqi, et al.
Pubblicazione: (2024)
Factual Consistency of Multilingual Pretrained Language Models
di: Fierro, Constanza, et al.
Pubblicazione: (2022)
di: Fierro, Constanza, et al.
Pubblicazione: (2022)
Learning to Generate Answers with Citations via Factual Consistency Models
di: Aly, Rami, et al.
Pubblicazione: (2024)
di: Aly, Rami, et al.
Pubblicazione: (2024)
Exploring the Factual Consistency in Dialogue Comprehension of Large Language Models
di: She, Shuaijie, et al.
Pubblicazione: (2023)
di: She, Shuaijie, et al.
Pubblicazione: (2023)
Identifying Factual Inconsistencies in Summaries: Grounding LLM Inference via Task Taxonomy
di: Xu, Liyan, et al.
Pubblicazione: (2024)
di: Xu, Liyan, et al.
Pubblicazione: (2024)
ReFEree: Reference-Free and Fine-Grained Method for Evaluating Factual Consistency in Real-World Code Summarization
di: Bae, Suyoung, et al.
Pubblicazione: (2026)
di: Bae, Suyoung, et al.
Pubblicazione: (2026)
Temporally Consistent Factuality Probing for Large Language Models
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2024)
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2024)
FactEHR: A Dataset for Evaluating Factuality in Clinical Notes Using LLMs
di: Munnangi, Monica, et al.
Pubblicazione: (2024)
di: Munnangi, Monica, et al.
Pubblicazione: (2024)
SummExecEdit: A Factual Consistency Benchmark in Summarization with Executable Edits
di: Thorat, Onkar, et al.
Pubblicazione: (2024)
di: Thorat, Onkar, et al.
Pubblicazione: (2024)
UniArk: Improving Generalisation and Consistency for Factual Knowledge Extraction through Debiasing
di: Yang, Yijun, et al.
Pubblicazione: (2024)
di: Yang, Yijun, et al.
Pubblicazione: (2024)
Automated essay scoring in Arabic: a dataset and analysis of a BERT-based system
di: Ghazawi, Rayed, et al.
Pubblicazione: (2024)
di: Ghazawi, Rayed, et al.
Pubblicazione: (2024)
How well can LLMs Grade Essays in Arabic?
di: Ghazawi, Rayed, et al.
Pubblicazione: (2025)
di: Ghazawi, Rayed, et al.
Pubblicazione: (2025)
Beyond Factual Accuracy: Evaluating Coverage of Diverse Factual Information in Long-form Text Generation
di: Samarinas, Chris, et al.
Pubblicazione: (2025)
di: Samarinas, Chris, et al.
Pubblicazione: (2025)
Improving Factual Consistency of News Summarization by Contrastive Preference Optimization
di: Feng, Huawen, et al.
Pubblicazione: (2023)
di: Feng, Huawen, et al.
Pubblicazione: (2023)
Do Automatic Factuality Metrics Measure Factuality? A Critical Evaluation
di: Ramprasad, Sanjana, et al.
Pubblicazione: (2024)
di: Ramprasad, Sanjana, et al.
Pubblicazione: (2024)
Towards Effective Extraction and Evaluation of Factual Claims
di: Metropolitansky, Dasha, et al.
Pubblicazione: (2025)
di: Metropolitansky, Dasha, et al.
Pubblicazione: (2025)
Semantic Consistency-Based Uncertainty Quantification for Factuality in Radiology Report Generation
di: Wang, Chenyu, et al.
Pubblicazione: (2024)
di: Wang, Chenyu, et al.
Pubblicazione: (2024)
Fine-grained and Explainable Factuality Evaluation for Multimodal Summarization
di: Zhang, Yue, et al.
Pubblicazione: (2024)
di: Zhang, Yue, et al.
Pubblicazione: (2024)
Transferable and Efficient Non-Factual Content Detection via Probe Training with Offline Consistency Checking
di: Zhang, Xiaokang, et al.
Pubblicazione: (2024)
di: Zhang, Xiaokang, et al.
Pubblicazione: (2024)
Self-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation
di: Zhang, Xiaoying, et al.
Pubblicazione: (2024)
di: Zhang, Xiaoying, et al.
Pubblicazione: (2024)
ConsistencyAI: A Benchmark to Assess LLMs' Factual Consistency When Responding to Different Demographic Groups
di: Banyas, Peter, et al.
Pubblicazione: (2025)
di: Banyas, Peter, et al.
Pubblicazione: (2025)
Stress Testing Factual Consistency Metrics for Long-Document Summarization
di: Mujahid, Zain Muhammad, et al.
Pubblicazione: (2025)
di: Mujahid, Zain Muhammad, et al.
Pubblicazione: (2025)
Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models
di: Qi, Jirui, et al.
Pubblicazione: (2023)
di: Qi, Jirui, et al.
Pubblicazione: (2023)
ACE: Attribution-Controlled Knowledge Editing for Multi-hop Factual Recall
di: Yang, Jiayu, et al.
Pubblicazione: (2025)
di: Yang, Jiayu, et al.
Pubblicazione: (2025)
DecMetrics: Structured Claim Decomposition Scoring for Factually Consistent LLM Outputs
di: Huang, Minghui
Pubblicazione: (2025)
di: Huang, Minghui
Pubblicazione: (2025)
AlignCheck: a Semantic Open-Domain Metric for Factual Consistency Assessment
di: Aghaebrahimian, Ahmad
Pubblicazione: (2025)
di: Aghaebrahimian, Ahmad
Pubblicazione: (2025)
Documenti analoghi
-
Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies
di: Ye, Yuxuan, et al.
Pubblicazione: (2026) -
mFACE: Multilingual Summarization with Factual Consistency Evaluation
di: Aharoni, Roee, et al.
Pubblicazione: (2022) -
Zero-shot Factual Consistency Evaluation Across Domains
di: Agarwal, Raunak
Pubblicazione: (2024) -
Grounded Visual Factualization: Factual Anchor-Based Finetuning for Enhancing MLLM Factual Consistency
di: Morbiato, Filippo, et al.
Pubblicazione: (2025) -
An Extensive Evaluation of Factual Consistency in Large Language Models for Data-to-Text Generation
di: Mahapatra, Joy, et al.
Pubblicazione: (2024)