The Gray Zone of Faithfulness: Taming Ambiguity in Unfaithfulness Detection
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ding, Qiang, Luo, Lvzhou, Cao, Yixuan, Luo, Ping |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Attention with Dependency Parsing Augmentation for Fine-Grained Attribution
von: Ding, Qiang, et al.
Veröffentlicht: (2024)
von: Ding, Qiang, et al.
Veröffentlicht: (2024)
Navigating Large-Scale Document Collections: MuDABench for Multi-Document Analytical QA
von: Li, Zhanli, et al.
Veröffentlicht: (2026)
von: Li, Zhanli, et al.
Veröffentlicht: (2026)
Dissociation of Faithful and Unfaithful Reasoning in LLMs
von: Yee, Evelyn, et al.
Veröffentlicht: (2024)
von: Yee, Evelyn, et al.
Veröffentlicht: (2024)
DeepRead: Document Structure-Aware Reasoning to Enhance Agentic Search
von: Li, Zhanli, et al.
Veröffentlicht: (2026)
von: Li, Zhanli, et al.
Veröffentlicht: (2026)
AttnComp: Attention-Guided Adaptive Context Compression for Retrieval-Augmented Generation
von: Luo, Lvzhou, et al.
Veröffentlicht: (2025)
von: Luo, Lvzhou, et al.
Veröffentlicht: (2025)
Reasoning Pattern Matters: Learning to Reason without Human Rationales
von: Pang, Chaoxu, et al.
Veröffentlicht: (2025)
von: Pang, Chaoxu, et al.
Veröffentlicht: (2025)
FaithLens: Detecting and Explaining Faithfulness Hallucination
von: Si, Shuzheng, et al.
Veröffentlicht: (2025)
von: Si, Shuzheng, et al.
Veröffentlicht: (2025)
Chain-of-Thought Unfaithfulness as Disguised Accuracy
von: Bentham, Oliver, et al.
Veröffentlicht: (2024)
von: Bentham, Oliver, et al.
Veröffentlicht: (2024)
Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation
von: Khalifa, Muhammad, et al.
Veröffentlicht: (2026)
von: Khalifa, Muhammad, et al.
Veröffentlicht: (2026)
VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation
von: Pan, Jingheng, et al.
Veröffentlicht: (2026)
von: Pan, Jingheng, et al.
Veröffentlicht: (2026)
Analysing Chain of Thought Dynamics: Active Guidance or Unfaithful Post-hoc Rationalisation?
von: Lewis-Lim, Samuel, et al.
Veröffentlicht: (2025)
von: Lewis-Lim, Samuel, et al.
Veröffentlicht: (2025)
Paying More Attention to Source Context: Mitigating Unfaithful Translations from Large Language Model
von: Zhang, Hongbin, et al.
Veröffentlicht: (2024)
von: Zhang, Hongbin, et al.
Veröffentlicht: (2024)
nvBench 2.0: Resolving Ambiguity in Text-to-Visualization through Stepwise Reasoning
von: Luo, Tianqi, et al.
Veröffentlicht: (2025)
von: Luo, Tianqi, et al.
Veröffentlicht: (2025)
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
von: Luo, Linhao, et al.
Veröffentlicht: (2023)
von: Luo, Linhao, et al.
Veröffentlicht: (2023)
Benchmarking LLM Faithfulness in RAG with Evolving Leaderboards
von: Tamber, Manveer Singh, et al.
Veröffentlicht: (2025)
von: Tamber, Manveer Singh, et al.
Veröffentlicht: (2025)
Semantic Faithfulness and Entropy Production Measures to Tame Your LLM Demons and Manage Hallucinations
von: Halperin, Igor
Veröffentlicht: (2025)
von: Halperin, Igor
Veröffentlicht: (2025)
Correct-Detect: Balancing Performance and Ambiguity Through the Lens of Coreference Resolution in LLMs
von: Shore, Amber, et al.
Veröffentlicht: (2025)
von: Shore, Amber, et al.
Veröffentlicht: (2025)
FaithUn: Toward Faithful Forgetting in Language Models by Investigating the Interconnectedness of Knowledge
von: Yang, Nakyeong, et al.
Veröffentlicht: (2025)
von: Yang, Nakyeong, et al.
Veröffentlicht: (2025)
GeoFaith: A Spatio-Temporal Dual View of Faithful Chain-of-Thought
von: Lv, Weijiang, et al.
Veröffentlicht: (2026)
von: Lv, Weijiang, et al.
Veröffentlicht: (2026)
Towards Better Chain-of-Thought: A Reflection on Effectiveness and Faithfulness
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
FaithBench: A Diverse Hallucination Benchmark for Summarization by Modern LLMs
von: Bao, Forrest Sheng, et al.
Veröffentlicht: (2024)
von: Bao, Forrest Sheng, et al.
Veröffentlicht: (2024)
Scope Ambiguities in Large Language Models
von: Kamath, Gaurav, et al.
Veröffentlicht: (2024)
von: Kamath, Gaurav, et al.
Veröffentlicht: (2024)
Self-Knowledge Distillation for Learning Ambiguity
von: Park, Hancheol, et al.
Veröffentlicht: (2024)
von: Park, Hancheol, et al.
Veröffentlicht: (2024)
Towards Faithful and Controllable Personalization via Critique-Post-Edit Reinforcement Learning
von: Zhu, Chenghao, et al.
Veröffentlicht: (2025)
von: Zhu, Chenghao, et al.
Veröffentlicht: (2025)
MedCritical: Enhancing Medical Reasoning in Small Language Models via Self-Collaborative Correction
von: Su, Xinchun, et al.
Veröffentlicht: (2025)
von: Su, Xinchun, et al.
Veröffentlicht: (2025)
From Critique to Clarity: A Pathway to Faithful and Personalized Code Explanations with Large Language Models
von: Xu, Zexing, et al.
Veröffentlicht: (2024)
von: Xu, Zexing, et al.
Veröffentlicht: (2024)
An Analysis of Decoding Methods for LLM-based Agents for Faithful Multi-Hop Question Answering
von: Murphy, Alexander, et al.
Veröffentlicht: (2025)
von: Murphy, Alexander, et al.
Veröffentlicht: (2025)
Faithfulness Serum: Mitigating the Faithfulness Gap in Textual Explanations of LLM Decisions via Attribution Guidance
von: Alon, Bar, et al.
Veröffentlicht: (2026)
von: Alon, Bar, et al.
Veröffentlicht: (2026)
C2-Faith: Benchmarking LLM Judges for Causal and Coverage Faithfulness in Chain-of-Thought Reasoning
von: Mittal, Avni, et al.
Veröffentlicht: (2026)
von: Mittal, Avni, et al.
Veröffentlicht: (2026)
Faithfulness-QA: A Counterfactual Entity Substitution Dataset for Training Context-Faithful RAG Models
von: Ju, Li, et al.
Veröffentlicht: (2026)
von: Ju, Li, et al.
Veröffentlicht: (2026)
Teaching Large Language Models to Maintain Contextual Faithfulness via Synthetic Tasks and Reinforcement Learning
von: Si, Shuzheng, et al.
Veröffentlicht: (2025)
von: Si, Shuzheng, et al.
Veröffentlicht: (2025)
Towards Generalizable and Faithful Logic Reasoning over Natural Language via Resolution Refutation
von: Sun, Zhouhao, et al.
Veröffentlicht: (2024)
von: Sun, Zhouhao, et al.
Veröffentlicht: (2024)
Language Models Identify Ambiguities and Exploit Loopholes
von: Choi, Jio, et al.
Veröffentlicht: (2025)
von: Choi, Jio, et al.
Veröffentlicht: (2025)
STORYSUMM: Evaluating Faithfulness in Story Summarization
von: Subbiah, Melanie, et al.
Veröffentlicht: (2024)
von: Subbiah, Melanie, et al.
Veröffentlicht: (2024)
Evaluating Reward Model Generalization via Pairwise Maximum Discrepancy Competitions
von: Luo, Shunyang, et al.
Veröffentlicht: (2026)
von: Luo, Shunyang, et al.
Veröffentlicht: (2026)
The Probabilities Also Matter: A More Faithful Metric for Faithfulness of Free-Text Explanations in Large Language Models
von: Siegel, Noah Y., et al.
Veröffentlicht: (2024)
von: Siegel, Noah Y., et al.
Veröffentlicht: (2024)
Large Language Models Understanding: an Inherent Ambiguity Barrier
von: Nissani, Daniel N.
Veröffentlicht: (2025)
von: Nissani, Daniel N.
Veröffentlicht: (2025)
Impact of Fine-Tuning Methods on Memorization in Large Language Models
von: Hou, Jie, et al.
Veröffentlicht: (2025)
von: Hou, Jie, et al.
Veröffentlicht: (2025)
Guideline Learning for In-context Information Extraction
von: Pang, Chaoxu, et al.
Veröffentlicht: (2023)
von: Pang, Chaoxu, et al.
Veröffentlicht: (2023)
ACT-MNMT Auto-Constriction Turning for Multilingual Neural Machine Translation
von: Dai, Shaojie, et al.
Veröffentlicht: (2024)
von: Dai, Shaojie, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Attention with Dependency Parsing Augmentation for Fine-Grained Attribution
von: Ding, Qiang, et al.
Veröffentlicht: (2024) -
Navigating Large-Scale Document Collections: MuDABench for Multi-Document Analytical QA
von: Li, Zhanli, et al.
Veröffentlicht: (2026) -
Dissociation of Faithful and Unfaithful Reasoning in LLMs
von: Yee, Evelyn, et al.
Veröffentlicht: (2024) -
DeepRead: Document Structure-Aware Reasoning to Enhance Agentic Search
von: Li, Zhanli, et al.
Veröffentlicht: (2026) -
AttnComp: Attention-Guided Adaptive Context Compression for Retrieval-Augmented Generation
von: Luo, Lvzhou, et al.
Veröffentlicht: (2025)