Identifying Factual Inconsistencies in Summaries: Grounding LLM Inference via Task Taxonomy
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Liyan, Su, Zhenlin, Yu, Mo, Xu, Jin, Choi, Jinho D., Zhou, Jie, Liu, Fei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SIFiD: Reassess Summary Factual Inconsistency Detection with LLM
di: Yang, Jiuding, et al.
Pubblicazione: (2024)
di: Yang, Jiuding, et al.
Pubblicazione: (2024)
Improving Factuality in LLMs via Inference-Time Knowledge Graph Construction
di: Wu, Shanglin, et al.
Pubblicazione: (2025)
di: Wu, Shanglin, et al.
Pubblicazione: (2025)
Dense Retrievers Can Fail on Simple Queries: Revealing The Granularity Dilemma of Embeddings
di: Xu, Liyan, et al.
Pubblicazione: (2025)
di: Xu, Liyan, et al.
Pubblicazione: (2025)
SIG: Speaker Identification in Literature via Prompt-Based Generation
di: Su, Zhenlin, et al.
Pubblicazione: (2023)
di: Su, Zhenlin, et al.
Pubblicazione: (2023)
FIZZ: Factual Inconsistency Detection by Zoom-in Summary and Zoom-out Document
di: Yang, Joonho, et al.
Pubblicazione: (2024)
di: Yang, Joonho, et al.
Pubblicazione: (2024)
Fine-Grained Modeling of Narrative Context: A Coherence Perspective via Retrospective Questions
di: Xu, Liyan, et al.
Pubblicazione: (2024)
di: Xu, Liyan, et al.
Pubblicazione: (2024)
Factual Inconsistencies in Multilingual Wikipedia Tables
di: Cappa, Silvia, et al.
Pubblicazione: (2025)
di: Cappa, Silvia, et al.
Pubblicazione: (2025)
DRIFT: Detecting Representational Inconsistencies for Factual Truthfulness
di: Bhatnagar, Rohan, et al.
Pubblicazione: (2026)
di: Bhatnagar, Rohan, et al.
Pubblicazione: (2026)
Localizing Factual Inconsistencies in Attributable Text Generation
di: Cattan, Arie, et al.
Pubblicazione: (2024)
di: Cattan, Arie, et al.
Pubblicazione: (2024)
ConvoSense: Overcoming Monotonous Commonsense Inferences for Conversational AI
di: Finch, Sarah E., et al.
Pubblicazione: (2024)
di: Finch, Sarah E., et al.
Pubblicazione: (2024)
Leveraging Explicit Reasoning for Inference Integration in Commonsense-Augmented Dialogue Models
di: Finch, Sarah E., et al.
Pubblicazione: (2024)
di: Finch, Sarah E., et al.
Pubblicazione: (2024)
Transforming Slot Schema Induction with Generative Dialogue State Inference
di: Finch, James D., et al.
Pubblicazione: (2024)
di: Finch, James D., et al.
Pubblicazione: (2024)
PrefixNLI: Detecting Factual Inconsistencies as Soon as They Arise
di: Harary, Sapir, et al.
Pubblicazione: (2025)
di: Harary, Sapir, et al.
Pubblicazione: (2025)
Generative Induction of Dialogue Task Schemas with Streaming Refinement and Simulated Interactions
di: Finch, James D., et al.
Pubblicazione: (2025)
di: Finch, James D., et al.
Pubblicazione: (2025)
Lost in Multilinguality: Dissecting Cross-lingual Factual Inconsistency in Transformer Language Models
di: Wang, Mingyang, et al.
Pubblicazione: (2025)
di: Wang, Mingyang, et al.
Pubblicazione: (2025)
Locomo-Plus: Beyond-Factual Cognitive Memory Evaluation Framework for LLM Agents
di: Li, Yifei, et al.
Pubblicazione: (2026)
di: Li, Yifei, et al.
Pubblicazione: (2026)
Using Similarity to Evaluate Factual Consistency in Summaries
di: Ye, Yuxuan, et al.
Pubblicazione: (2024)
di: Ye, Yuxuan, et al.
Pubblicazione: (2024)
ComoRAG: A Cognitive-Inspired Memory-Organized RAG for Stateful Long Narrative Reasoning
di: Wang, Juyuan, et al.
Pubblicazione: (2025)
di: Wang, Juyuan, et al.
Pubblicazione: (2025)
Fast and Accurate Factual Inconsistency Detection Over Long Documents
di: Lattimer, Barrett Martin, et al.
Pubblicazione: (2023)
di: Lattimer, Barrett Martin, et al.
Pubblicazione: (2023)
Factual Inconsistency in Data-to-Text Generation Scales Exponentially with LLM Size: A Statistical Validation
di: Mahapatra, Joy, et al.
Pubblicazione: (2025)
di: Mahapatra, Joy, et al.
Pubblicazione: (2025)
LLM-as-a-Grader: Practical Insights from Large Language Model for Short-Answer and Report Evaluation
di: Byun, Grace, et al.
Pubblicazione: (2025)
di: Byun, Grace, et al.
Pubblicazione: (2025)
Discourse-Driven Evaluation: Unveiling Factual Inconsistency in Long Document Summarization
di: Zhong, Yang, et al.
Pubblicazione: (2025)
di: Zhong, Yang, et al.
Pubblicazione: (2025)
Identifying and Transferring Reasoning-Critical Neurons: Improving LLM Inference Reliability via Activation Steering
di: Dong, Fangan, et al.
Pubblicazione: (2026)
di: Dong, Fangan, et al.
Pubblicazione: (2026)
Can LLMs Refuse Questions They Do Not Know? Measuring Knowledge-Aware Refusal in Factual Tasks
di: Pan, Wenbo, et al.
Pubblicazione: (2025)
di: Pan, Wenbo, et al.
Pubblicazione: (2025)
Previously on the Stories: Recap Snippet Identification for Story Reading
di: Li, Jiangnan, et al.
Pubblicazione: (2024)
di: Li, Jiangnan, et al.
Pubblicazione: (2024)
BoostTaxo: Zero-Shot Taxonomy Induction via Boosting-Style Agentic Reasoning and Constraint-Aware Calibration
di: Ling, Yancheng, et al.
Pubblicazione: (2026)
di: Ling, Yancheng, et al.
Pubblicazione: (2026)
FactNet: A Billion-Scale Knowledge Graph for Multilingual Factual Grounding
di: Shen, Yingli, et al.
Pubblicazione: (2026)
di: Shen, Yingli, et al.
Pubblicazione: (2026)
D-GEN: Automatic Distractor Generation and Evaluation for Reliable Assessment of Generative Model
di: Byun, Grace, et al.
Pubblicazione: (2025)
di: Byun, Grace, et al.
Pubblicazione: (2025)
Do We Still Need Audio? Rethinking Speaker Diarization with a Text-Based Approach Using Multiple Prediction Models
di: Wu, Peilin, et al.
Pubblicazione: (2025)
di: Wu, Peilin, et al.
Pubblicazione: (2025)
Multilingual Knowledge Editing with Language-Agnostic Factual Neurons
di: Zhang, Xue, et al.
Pubblicazione: (2024)
di: Zhang, Xue, et al.
Pubblicazione: (2024)
Grounded Visual Factualization: Factual Anchor-Based Finetuning for Enhancing MLLM Factual Consistency
di: Morbiato, Filippo, et al.
Pubblicazione: (2025)
di: Morbiato, Filippo, et al.
Pubblicazione: (2025)
Diverse and Effective Synthetic Data Generation for Adaptable Zero-Shot Dialogue State Tracking
di: Finch, James D., et al.
Pubblicazione: (2024)
di: Finch, James D., et al.
Pubblicazione: (2024)
TRUST: An LLM-Based Dialogue System for Trauma Understanding and Structured Assessments
di: Tu, Sichang, et al.
Pubblicazione: (2025)
di: Tu, Sichang, et al.
Pubblicazione: (2025)
SitEmb-v1.5: Improved Context-Aware Dense Retrieval for Semantic Association and Long Story Comprehension
di: Wu, Junjie, et al.
Pubblicazione: (2025)
di: Wu, Junjie, et al.
Pubblicazione: (2025)
Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers
di: Lin, Liang, et al.
Pubblicazione: (2025)
di: Lin, Liang, et al.
Pubblicazione: (2025)
Towards Threshold-Free KV Cache Pruning
di: Ni, Xuanfan, et al.
Pubblicazione: (2025)
di: Ni, Xuanfan, et al.
Pubblicazione: (2025)
Fictitious Synthetic Data Can Improve LLM Factuality via Prerequisite Learning
di: Liu, Yujian, et al.
Pubblicazione: (2024)
di: Liu, Yujian, et al.
Pubblicazione: (2024)
What is Your Favorite Gender, MLM? Gender Bias Evaluation in Multilingual Masked Language Models
di: Yu, Jeongrok, et al.
Pubblicazione: (2024)
di: Yu, Jeongrok, et al.
Pubblicazione: (2024)
LIDS: LLM Summary Inference Under the Layered Lens
di: Park, Dylan, et al.
Pubblicazione: (2026)
di: Park, Dylan, et al.
Pubblicazione: (2026)
DYCP: Dynamic Context Pruning for Long-Form Dialogue with LLMs
di: Choi, Nayoung, et al.
Pubblicazione: (2026)
di: Choi, Nayoung, et al.
Pubblicazione: (2026)
Documenti analoghi
-
SIFiD: Reassess Summary Factual Inconsistency Detection with LLM
di: Yang, Jiuding, et al.
Pubblicazione: (2024) -
Improving Factuality in LLMs via Inference-Time Knowledge Graph Construction
di: Wu, Shanglin, et al.
Pubblicazione: (2025) -
Dense Retrievers Can Fail on Simple Queries: Revealing The Granularity Dilemma of Embeddings
di: Xu, Liyan, et al.
Pubblicazione: (2025) -
SIG: Speaker Identification in Literature via Prompt-Based Generation
di: Su, Zhenlin, et al.
Pubblicazione: (2023) -
FIZZ: Factual Inconsistency Detection by Zoom-in Summary and Zoom-out Document
di: Yang, Joonho, et al.
Pubblicazione: (2024)