How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Xi, Plaat, Aske, van Stein, Niki |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
State Design Matters: How Representations Shape Dynamic Reasoning in Large Language Models
por: Wong, Annie, et al.
Publicado: (2026)
por: Wong, Annie, et al.
Publicado: (2026)
Reasoning Capabilities of Large Language Models on Dynamic Tasks
por: Wong, Annie, et al.
Publicado: (2025)
por: Wong, Annie, et al.
Publicado: (2025)
Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought
por: Xiang, Violet, et al.
Publicado: (2025)
por: Xiang, Violet, et al.
Publicado: (2025)
Multi-Step Reasoning with Large Language Models, a Survey
por: Plaat, Aske, et al.
Publicado: (2024)
por: Plaat, Aske, et al.
Publicado: (2024)
Draft-Thinking: Learning Efficient Reasoning in Long Chain-of-Thought LLMs
por: Cao, Jie, et al.
Publicado: (2026)
por: Cao, Jie, et al.
Publicado: (2026)
Lie to Me: How Faithful Is Chain-of-Thought Reasoning in Reasoning Models?
por: Young, Richard J.
Publicado: (2026)
por: Young, Richard J.
Publicado: (2026)
Learning Composable Chains-of-Thought
por: Yin, Fangcong, et al.
Publicado: (2025)
por: Yin, Fangcong, et al.
Publicado: (2025)
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
por: Chen, Qiguang, et al.
Publicado: (2026)
por: Chen, Qiguang, et al.
Publicado: (2026)
Latent Chain-of-Thought for Visual Reasoning
por: Sun, Guohao, et al.
Publicado: (2025)
por: Sun, Guohao, et al.
Publicado: (2025)
Fractured Chain-of-Thought Reasoning
por: Liao, Baohao, et al.
Publicado: (2025)
por: Liao, Baohao, et al.
Publicado: (2025)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
por: Ye, Jiacheng, et al.
Publicado: (2024)
por: Ye, Jiacheng, et al.
Publicado: (2024)
Think Consistently, Reason Efficiently: Energy-Based Calibration for Implicit Chain-of-Thought
por: Chen, Zhikang, et al.
Publicado: (2025)
por: Chen, Zhikang, et al.
Publicado: (2025)
Upfront Chain-of-Thought: A Cooperative Framework for Chain-of-Thought Compression
por: Li, Chengzhengxu, et al.
Publicado: (2025)
por: Li, Chengzhengxu, et al.
Publicado: (2025)
Iteration Head: A Mechanistic Study of Chain-of-Thought
por: Cabannes, Vivien, et al.
Publicado: (2024)
por: Cabannes, Vivien, et al.
Publicado: (2024)
Markov Chain of Thought for Efficient Mathematical Reasoning
por: Yang, Wen, et al.
Publicado: (2024)
por: Yang, Wen, et al.
Publicado: (2024)
GRACE: Discriminator-Guided Chain-of-Thought Reasoning
por: Khalifa, Muhammad, et al.
Publicado: (2023)
por: Khalifa, Muhammad, et al.
Publicado: (2023)
A Hopfieldian View-based Interpretation for Chain-of-Thought Reasoning
por: Hu, Lijie, et al.
Publicado: (2024)
por: Hu, Lijie, et al.
Publicado: (2024)
To Reason or Not to: Selective Chain-of-Thought in Medical Question Answering
por: Zhan, Zaifu, et al.
Publicado: (2026)
por: Zhan, Zaifu, et al.
Publicado: (2026)
Supervised Chain of Thought
por: Zhang, Xiang, et al.
Publicado: (2024)
por: Zhang, Xiang, et al.
Publicado: (2024)
Chain of Thought Still Thinks Fast: APriCoT Helps with Thinking Slow
por: Moore, Kyle, et al.
Publicado: (2024)
por: Moore, Kyle, et al.
Publicado: (2024)
From Thinking to Output: Chain-of-Thought and Text Generation Characteristics in Reasoning Language Models
por: Liu, Junhao, et al.
Publicado: (2025)
por: Liu, Junhao, et al.
Publicado: (2025)
Mechanics of Bias and Reasoning: Interpreting the Impact of Chain-of-Thought Prompting on Gender Bias in LLMs
por: Pearman, Edie, et al.
Publicado: (2026)
por: Pearman, Edie, et al.
Publicado: (2026)
Fine-Tuned Thoughts: Leveraging Chain-of-Thought Reasoning for Industrial Asset Health Monitoring
por: Lin, Shuxin, et al.
Publicado: (2025)
por: Lin, Shuxin, et al.
Publicado: (2025)
LaRS: Latent Reasoning Skills for Chain-of-Thought Reasoning
por: Xu, Zifan, et al.
Publicado: (2023)
por: Xu, Zifan, et al.
Publicado: (2023)
SafeChain: Safety of Language Models with Long Chain-of-Thought Reasoning Capabilities
por: Jiang, Fengqing, et al.
Publicado: (2025)
por: Jiang, Fengqing, et al.
Publicado: (2025)
Mitigating Misleading Chain-of-Thought Reasoning with Selective Filtering
por: Wu, Yexin, et al.
Publicado: (2024)
por: Wu, Yexin, et al.
Publicado: (2024)
Enhancing Chain-of-Thought Reasoning with Critical Representation Fine-tuning
por: Huang, Chenxi, et al.
Publicado: (2025)
por: Huang, Chenxi, et al.
Publicado: (2025)
Tracing Thought: Using Chain-of-Thought Reasoning to Identify the LLM Behind AI-Generated Text
por: Agrahari, Shifali, et al.
Publicado: (2025)
por: Agrahari, Shifali, et al.
Publicado: (2025)
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
por: Arcuschin, Iván, et al.
Publicado: (2025)
por: Arcuschin, Iván, et al.
Publicado: (2025)
Compositional Reasoning with Transformers, RNNs, and Chain of Thought
por: Yehudai, Gilad, et al.
Publicado: (2025)
por: Yehudai, Gilad, et al.
Publicado: (2025)
Scalable Chain of Thoughts via Elastic Reasoning
por: Xu, Yuhui, et al.
Publicado: (2025)
por: Xu, Yuhui, et al.
Publicado: (2025)
Long Chain-of-Thought Reasoning Across Languages
por: Barua, Josh, et al.
Publicado: (2025)
por: Barua, Josh, et al.
Publicado: (2025)
Preemptive Answer "Attacks" on Chain-of-Thought Reasoning
por: Xu, Rongwu, et al.
Publicado: (2024)
por: Xu, Rongwu, et al.
Publicado: (2024)
Enhancing Generalization in Chain of Thought Reasoning for Smaller Models
por: Yin, Maxwell J., et al.
Publicado: (2025)
por: Yin, Maxwell J., et al.
Publicado: (2025)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
por: Aravindan, Ashwath Vaithinathan, et al.
Publicado: (2026)
por: Aravindan, Ashwath Vaithinathan, et al.
Publicado: (2026)
Explainable Chain-of-Thought Reasoning: An Empirical Analysis on State-Aware Reasoning Dynamics
por: Yu, Sheldon, et al.
Publicado: (2025)
por: Yu, Sheldon, et al.
Publicado: (2025)
Non-Interactive Symbolic-Aided Chain-of-Thought for Logical Reasoning
por: Nguyen, Phuong Minh, et al.
Publicado: (2025)
por: Nguyen, Phuong Minh, et al.
Publicado: (2025)
Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning
por: Turpin, Miles, et al.
Publicado: (2025)
por: Turpin, Miles, et al.
Publicado: (2025)
Latent Chain-of-Thought as Planning: Decoupling Reasoning from Verbalization
por: Wang, Jiecong, et al.
Publicado: (2026)
por: Wang, Jiecong, et al.
Publicado: (2026)
KAM-CoT: Knowledge Augmented Multimodal Chain-of-Thoughts Reasoning
por: Mondal, Debjyoti, et al.
Publicado: (2024)
por: Mondal, Debjyoti, et al.
Publicado: (2024)
Ejemplares similares
-
State Design Matters: How Representations Shape Dynamic Reasoning in Large Language Models
por: Wong, Annie, et al.
Publicado: (2026) -
Reasoning Capabilities of Large Language Models on Dynamic Tasks
por: Wong, Annie, et al.
Publicado: (2025) -
Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought
por: Xiang, Violet, et al.
Publicado: (2025) -
Multi-Step Reasoning with Large Language Models, a Survey
por: Plaat, Aske, et al.
Publicado: (2024) -
Draft-Thinking: Learning Efficient Reasoning in Long Chain-of-Thought LLMs
por: Cao, Jie, et al.
Publicado: (2026)