Mechanistic Evidence for Faithfulness Decay in Chain-of-Thought Reasoning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ye, Donald, Loffgren, Max, Kotadia, Om, Wong, Linus |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Faithful Logical Reasoning via Symbolic Chain-of-Thought
von: Xu, Jundong, et al.
Veröffentlicht: (2024)
von: Xu, Jundong, et al.
Veröffentlicht: (2024)
Measuring Chain of Thought Faithfulness by Unlearning Reasoning Steps
von: Tutek, Martin, et al.
Veröffentlicht: (2025)
von: Tutek, Martin, et al.
Veröffentlicht: (2025)
Faithfulness as Information Flow: Evaluating and Training Faithful Chain-of-Thought Reasoning
von: Jia, Jinghan, et al.
Veröffentlicht: (2026)
von: Jia, Jinghan, et al.
Veröffentlicht: (2026)
Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning
von: Paul, Debjit, et al.
Veröffentlicht: (2024)
von: Paul, Debjit, et al.
Veröffentlicht: (2024)
Evaluating GRPO and DPO for Faithful Chain-of-Thought Reasoning in LLMs
von: Mohammadi, Hadi, et al.
Veröffentlicht: (2025)
von: Mohammadi, Hadi, et al.
Veröffentlicht: (2025)
On the Hardness of Faithful Chain-of-Thought Reasoning in Large Language Models
von: Tanneru, Sree Harsha, et al.
Veröffentlicht: (2024)
von: Tanneru, Sree Harsha, et al.
Veröffentlicht: (2024)
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
von: Arcuschin, Iván, et al.
Veröffentlicht: (2025)
von: Arcuschin, Iván, et al.
Veröffentlicht: (2025)
Lie to Me: How Faithful Is Chain-of-Thought Reasoning in Reasoning Models?
von: Young, Richard J.
Veröffentlicht: (2026)
von: Young, Richard J.
Veröffentlicht: (2026)
How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
von: Chen, Xi, et al.
Veröffentlicht: (2025)
von: Chen, Xi, et al.
Veröffentlicht: (2025)
C2-Faith: Benchmarking LLM Judges for Causal and Coverage Faithfulness in Chain-of-Thought Reasoning
von: Mittal, Avni, et al.
Veröffentlicht: (2026)
von: Mittal, Avni, et al.
Veröffentlicht: (2026)
Counterfactual Simulation Training for Chain-of-Thought Faithfulness
von: Hase, Peter, et al.
Veröffentlicht: (2026)
von: Hase, Peter, et al.
Veröffentlicht: (2026)
A Comprehensive Evaluation of Multilingual Chain-of-Thought Reasoning: Performance, Consistency, and Faithfulness Across Languages
von: Zhao, Raoyuan, et al.
Veröffentlicht: (2025)
von: Zhao, Raoyuan, et al.
Veröffentlicht: (2025)
GeoFaith: A Spatio-Temporal Dual View of Faithful Chain-of-Thought
von: Lv, Weijiang, et al.
Veröffentlicht: (2026)
von: Lv, Weijiang, et al.
Veröffentlicht: (2026)
Is Chain-of-Thought Really Not Explainability? Chain-of-Thought Can Be Faithful without Hint Verbalization
von: Zaman, Kerem, et al.
Veröffentlicht: (2025)
von: Zaman, Kerem, et al.
Veröffentlicht: (2025)
Chain of Thought with Explicit Evidence Reasoning for Few-shot Relation Extraction
von: Ma, Xilai, et al.
Veröffentlicht: (2023)
von: Ma, Xilai, et al.
Veröffentlicht: (2023)
Towards Better Chain-of-Thought: A Reflection on Effectiveness and Faithfulness
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
Measuring Chain-of-Thought Monitorability Through Faithfulness and Verbosity
von: Meek, Austin, et al.
Veröffentlicht: (2025)
von: Meek, Austin, et al.
Veröffentlicht: (2025)
GeoSteer: Faithful Chain-of-Thought Steering via Latent Manifold Gradients
von: Kazama, Kentaro, et al.
Veröffentlicht: (2026)
von: Kazama, Kentaro, et al.
Veröffentlicht: (2026)
Facilitating Long Context Understanding via Supervised Chain-of-Thought Reasoning
von: Lin, Jingyang, et al.
Veröffentlicht: (2025)
von: Lin, Jingyang, et al.
Veröffentlicht: (2025)
SPD-Faith Bench: Diagnosing and Improving Faithfulness in Chain-of-Thought for Multimodal Large Language Models
von: Lv, Weijiang, et al.
Veröffentlicht: (2026)
von: Lv, Weijiang, et al.
Veröffentlicht: (2026)
Chain-of-Thought Reasoning Without Prompting
von: Wang, Xuezhi, et al.
Veröffentlicht: (2024)
von: Wang, Xuezhi, et al.
Veröffentlicht: (2024)
Iteration Head: A Mechanistic Study of Chain-of-Thought
von: Cabannes, Vivien, et al.
Veröffentlicht: (2024)
von: Cabannes, Vivien, et al.
Veröffentlicht: (2024)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
von: Ye, Jiacheng, et al.
Veröffentlicht: (2024)
von: Ye, Jiacheng, et al.
Veröffentlicht: (2024)
Beyond Chain-of-Thought, Effective Graph-of-Thought Reasoning in Language Models
von: Yao, Yao, et al.
Veröffentlicht: (2023)
von: Yao, Yao, et al.
Veröffentlicht: (2023)
Efficient Reasoning via Chain of Unconscious Thought
von: Gong, Ruihan, et al.
Veröffentlicht: (2025)
von: Gong, Ruihan, et al.
Veröffentlicht: (2025)
On the Impact of Fine-Tuning on Chain-of-Thought Reasoning
von: Lobo, Elita, et al.
Veröffentlicht: (2024)
von: Lobo, Elita, et al.
Veröffentlicht: (2024)
Scheherazade: Evaluating Chain-of-Thought Math Reasoning in LLMs with Chain-of-Problems
von: Miner, Stephen, et al.
Veröffentlicht: (2024)
von: Miner, Stephen, et al.
Veröffentlicht: (2024)
Latent Chain-of-Thought for Visual Reasoning
von: Sun, Guohao, et al.
Veröffentlicht: (2025)
von: Sun, Guohao, et al.
Veröffentlicht: (2025)
Reasoning Theater: Disentangling Model Beliefs from Chain-of-Thought
von: Boppana, Siddharth, et al.
Veröffentlicht: (2026)
von: Boppana, Siddharth, et al.
Veröffentlicht: (2026)
Fractured Chain-of-Thought Reasoning
von: Liao, Baohao, et al.
Veröffentlicht: (2025)
von: Liao, Baohao, et al.
Veröffentlicht: (2025)
Scaling Code-Assisted Chain-of-Thoughts and Instructions for Model Reasoning
von: Lin, Honglin, et al.
Veröffentlicht: (2025)
von: Lin, Honglin, et al.
Veröffentlicht: (2025)
Enhancing Chain-of-Thought Reasoning with Critical Representation Fine-tuning
von: Huang, Chenxi, et al.
Veröffentlicht: (2025)
von: Huang, Chenxi, et al.
Veröffentlicht: (2025)
Investigating the Interplay between Contextual and Parametric Chain-of-Thought Faithfulness under Optimization
von: Sun, Jingyi, et al.
Veröffentlicht: (2026)
von: Sun, Jingyi, et al.
Veröffentlicht: (2026)
Unveiling the Key Factors for Distilling Chain-of-Thought Reasoning
von: Chen, Xinghao, et al.
Veröffentlicht: (2025)
von: Chen, Xinghao, et al.
Veröffentlicht: (2025)
Efficient Reasoning for LLMs through Speculative Chain-of-Thought
von: Wang, Jikai, et al.
Veröffentlicht: (2025)
von: Wang, Jikai, et al.
Veröffentlicht: (2025)
Unlocking the Capabilities of Thought: A Reasoning Boundary Framework to Quantify and Optimize Chain-of-Thought
von: Chen, Qiguang, et al.
Veröffentlicht: (2024)
von: Chen, Qiguang, et al.
Veröffentlicht: (2024)
Chain of Preference Optimization: Improving Chain-of-Thought Reasoning in LLMs
von: Zhang, Xuan, et al.
Veröffentlicht: (2024)
von: Zhang, Xuan, et al.
Veröffentlicht: (2024)
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
von: Chen, Qiguang, et al.
Veröffentlicht: (2026)
von: Chen, Qiguang, et al.
Veröffentlicht: (2026)
Demystifying Long Chain-of-Thought Reasoning in LLMs
von: Yeo, Edward, et al.
Veröffentlicht: (2025)
von: Yeo, Edward, et al.
Veröffentlicht: (2025)
Markov Chain of Thought for Efficient Mathematical Reasoning
von: Yang, Wen, et al.
Veröffentlicht: (2024)
von: Yang, Wen, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Faithful Logical Reasoning via Symbolic Chain-of-Thought
von: Xu, Jundong, et al.
Veröffentlicht: (2024) -
Measuring Chain of Thought Faithfulness by Unlearning Reasoning Steps
von: Tutek, Martin, et al.
Veröffentlicht: (2025) -
Faithfulness as Information Flow: Evaluating and Training Faithful Chain-of-Thought Reasoning
von: Jia, Jinghan, et al.
Veröffentlicht: (2026) -
Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning
von: Paul, Debjit, et al.
Veröffentlicht: (2024) -
Evaluating GRPO and DPO for Faithful Chain-of-Thought Reasoning in LLMs
von: Mohammadi, Hadi, et al.
Veröffentlicht: (2025)