Discourse-Driven Evaluation: Unveiling Factual Inconsistency in Long Document Summarization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhong, Yang, Litman, Diane |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fast and Accurate Factual Inconsistency Detection Over Long Documents
par: Lattimer, Barrett Martin, et autres
Publié: (2023)
par: Lattimer, Barrett Martin, et autres
Publié: (2023)
ReflectSumm: A Benchmark for Course Reflection Summarization
par: Zhong, Yang, et autres
Publié: (2024)
par: Zhong, Yang, et autres
Publié: (2024)
Stress Testing Factual Consistency Metrics for Long-Document Summarization
par: Mujahid, Zain Muhammad, et autres
Publié: (2025)
par: Mujahid, Zain Muhammad, et autres
Publié: (2025)
Efficient Layer-wise LLM Fine-tuning for Revision Intention Prediction
par: Liu, Zhexiong, et autres
Publié: (2025)
par: Liu, Zhexiong, et autres
Publié: (2025)
Incorporating Distributions of Discourse Structure for Long Document Abstractive Summarization
par: Liu, Dongqi, et autres
Publié: (2023)
par: Liu, Dongqi, et autres
Publié: (2023)
ARC: Argument Representation and Coverage Analysis for Zero-Shot Long Document Summarization with Instruction Following LLMs
par: Elaraby, Mohamed, et autres
Publié: (2025)
par: Elaraby, Mohamed, et autres
Publié: (2025)
Explanatory Summarization with Discourse-Driven Planning
par: Liu, Dongqi, et autres
Publié: (2025)
par: Liu, Dongqi, et autres
Publié: (2025)
PrefixNLI: Detecting Factual Inconsistencies as Soon as They Arise
par: Harary, Sapir, et autres
Publié: (2025)
par: Harary, Sapir, et autres
Publié: (2025)
Automatic Summarization of Long Documents
par: Chhibbar, Naman, et autres
Publié: (2024)
par: Chhibbar, Naman, et autres
Publié: (2024)
Evaluating the Factuality of Zero-shot Summarizers Across Varied Domains
par: Ramprasad, Sanjana, et autres
Publié: (2024)
par: Ramprasad, Sanjana, et autres
Publié: (2024)
RST-LoRA: A Discourse-Aware Low-Rank Adaptation for Long Document Abstractive Summarization
par: Liu, Dongqi, et autres
Publié: (2024)
par: Liu, Dongqi, et autres
Publié: (2024)
Improving Factual Consistency of News Summarization by Contrastive Preference Optimization
par: Feng, Huawen, et autres
Publié: (2023)
par: Feng, Huawen, et autres
Publié: (2023)
DiscoSum: Discourse-aware News Summarization
par: Spangher, Alexander, et autres
Publié: (2025)
par: Spangher, Alexander, et autres
Publié: (2025)
Leveraging Discourse Structure for Extractive Meeting Summarization
par: Rennard, Virgile, et autres
Publié: (2024)
par: Rennard, Virgile, et autres
Publié: (2024)
EROS: Entity-Driven Controlled Policy Document Summarization
par: Singh, Joykirat, et autres
Publié: (2024)
par: Singh, Joykirat, et autres
Publié: (2024)
ReFEree: Reference-Free and Fine-Grained Method for Evaluating Factual Consistency in Real-World Code Summarization
par: Bae, Suyoung, et autres
Publié: (2026)
par: Bae, Suyoung, et autres
Publié: (2026)
LongDocFACTScore: Evaluating the Factuality of Long Document Abstractive Summarisation
par: Bishop, Jennifer A, et autres
Publié: (2023)
par: Bishop, Jennifer A, et autres
Publié: (2023)
On the Benefits of Fine-Grained Loss Truncation: A Case Study on Factuality in Summarization
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2024)
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2024)
SYNFAC-EDIT: Synthetic Imitation Edit Feedback for Factual Alignment in Clinical Summarization
par: Mishra, Prakamya, et autres
Publié: (2024)
par: Mishra, Prakamya, et autres
Publié: (2024)
End-to-End Long Document Summarization using Gradient Caching
par: Saxena, Rohit, et autres
Publié: (2025)
par: Saxena, Rohit, et autres
Publié: (2025)
eRevise+RF: A Writing Evaluation System for Assessing Student Essay Revisions and Providing Formative Feedback
par: Liu, Zhexiong, et autres
Publié: (2025)
par: Liu, Zhexiong, et autres
Publié: (2025)
Do Automatic Factuality Metrics Measure Factuality? A Critical Evaluation
par: Ramprasad, Sanjana, et autres
Publié: (2024)
par: Ramprasad, Sanjana, et autres
Publié: (2024)
Improved Evidence Extraction and Metrics for Document Inconsistency Detection with LLMs
par: Tan, Nelvin, et autres
Publié: (2026)
par: Tan, Nelvin, et autres
Publié: (2026)
WildHallucinations: Evaluating Long-form Factuality in LLMs with Real-World Entity Queries
par: Zhao, Wenting, et autres
Publié: (2024)
par: Zhao, Wenting, et autres
Publié: (2024)
MAD-Fact: A Multi-Agent Debate Framework for Long-Form Factuality Evaluation in LLMs
par: Ning, Yucheng, et autres
Publié: (2025)
par: Ning, Yucheng, et autres
Publié: (2025)
Unveiling Factual Recall Behaviors of Large Language Models through Knowledge Neurons
par: Wang, Yifei, et autres
Publié: (2024)
par: Wang, Yifei, et autres
Publié: (2024)
GraphLSS: Integrating Lexical, Structural, and Semantic Features for Long Document Extractive Summarization
par: Bugueño, Margarita, et autres
Publié: (2024)
par: Bugueño, Margarita, et autres
Publié: (2024)
Factual Inconsistency in Data-to-Text Generation Scales Exponentially with LLM Size: A Statistical Validation
par: Mahapatra, Joy, et autres
Publié: (2025)
par: Mahapatra, Joy, et autres
Publié: (2025)
Entity-level Factual Adaptiveness of Fine-tuning based Abstractive Summarization Models
par: Song, Jongyoon, et autres
Publié: (2024)
par: Song, Jongyoon, et autres
Publié: (2024)
FACTORY: A Challenging Human-Verified Prompt Set for Long-Form Factuality
par: Chen, Mingda, et autres
Publié: (2025)
par: Chen, Mingda, et autres
Publié: (2025)
The Chronicles of RiDiC: Generating Datasets with Controlled Popularity Distribution for Long-form Factuality Evaluation
par: Braslavski, Pavel, et autres
Publié: (2026)
par: Braslavski, Pavel, et autres
Publié: (2026)
Leveraging Long-Context Large Language Models for Multi-Document Understanding and Summarization in Enterprise Applications
par: Godbole, Aditi, et autres
Publié: (2024)
par: Godbole, Aditi, et autres
Publié: (2024)
Beyond Chunking: Discourse-Aware Hierarchical Retrieval for Long Document Question Answering
par: Chen, Huiyao, et autres
Publié: (2025)
par: Chen, Huiyao, et autres
Publié: (2025)
Generating Benchmarks for Factuality Evaluation of Language Models
par: Muhlgay, Dor, et autres
Publié: (2023)
par: Muhlgay, Dor, et autres
Publié: (2023)
Action-Item-Driven Summarization of Long Meeting Transcripts
par: Golia, Logan, et autres
Publié: (2023)
par: Golia, Logan, et autres
Publié: (2023)
OLAPH: Improving Factuality in Biomedical Long-form Question Answering
par: Jeong, Minbyul, et autres
Publié: (2024)
par: Jeong, Minbyul, et autres
Publié: (2024)
Analyzing LLM Behavior in Dialogue Summarization: Unveiling Circumstantial Hallucination Trends
par: Ramprasad, Sanjana, et autres
Publié: (2024)
par: Ramprasad, Sanjana, et autres
Publié: (2024)
Improving Long Text Understanding with Knowledge Distilled from Summarization Model
par: Liu, Yan, et autres
Publié: (2024)
par: Liu, Yan, et autres
Publié: (2024)
Inconsistencies in Masked Language Models
par: Young, Tom, et autres
Publié: (2022)
par: Young, Tom, et autres
Publié: (2022)
Contextual ASR Error Handling with LLMs Augmentation for Goal-Oriented Conversational AI
par: Asano, Yuya, et autres
Publié: (2025)
par: Asano, Yuya, et autres
Publié: (2025)
Documents similaires
-
Fast and Accurate Factual Inconsistency Detection Over Long Documents
par: Lattimer, Barrett Martin, et autres
Publié: (2023) -
ReflectSumm: A Benchmark for Course Reflection Summarization
par: Zhong, Yang, et autres
Publié: (2024) -
Stress Testing Factual Consistency Metrics for Long-Document Summarization
par: Mujahid, Zain Muhammad, et autres
Publié: (2025) -
Efficient Layer-wise LLM Fine-tuning for Revision Intention Prediction
par: Liu, Zhexiong, et autres
Publié: (2025) -
Incorporating Distributions of Discourse Structure for Long Document Abstractive Summarization
par: Liu, Dongqi, et autres
Publié: (2023)