Quantifying the Necessity of Chain of Thought through Opaque Serial Depth
Fuente:
arXiv
Salvato in:
| Autori principali: | Brown-Cohen, Jonah, Lindner, David, Shah, Rohin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Aligned, Orthogonal or In-conflict: When can we safely optimize Chain-of-Thought?
di: Kaufmann, Max, et al.
Pubblicazione: (2026)
di: Kaufmann, Max, et al.
Pubblicazione: (2026)
When Chain of Thought is Necessary, Language Models Struggle to Evade Monitors
di: Emmons, Scott, et al.
Pubblicazione: (2025)
di: Emmons, Scott, et al.
Pubblicazione: (2025)
Causal Sufficiency and Necessity Improves Chain-of-Thought Reasoning
di: Yu, Xiangning, et al.
Pubblicazione: (2025)
di: Yu, Xiangning, et al.
Pubblicazione: (2025)
Revisiting the Necessity of Lengthy Chain-of-Thought in Vision-centric Reasoning Generalization
di: Du, Yifan, et al.
Pubblicazione: (2025)
di: Du, Yifan, et al.
Pubblicazione: (2025)
MONA: Myopic Optimization with Non-myopic Approval Can Mitigate Multi-step Reward Hacking
di: Farquhar, Sebastian, et al.
Pubblicazione: (2025)
di: Farquhar, Sebastian, et al.
Pubblicazione: (2025)
Can Reasoning Models Obfuscate Reasoning? Stress-Testing Chain-of-Thought Monitorability
di: Zolkowski, Artur, et al.
Pubblicazione: (2025)
di: Zolkowski, Artur, et al.
Pubblicazione: (2025)
Watch Your Steps: Observable and Modular Chains of Thought
di: Cohen, Cassandra A., et al.
Pubblicazione: (2024)
di: Cohen, Cassandra A., et al.
Pubblicazione: (2024)
Latent Chain-of-Thought? Decoding the Depth-Recurrent Transformer
di: Lu, Wenquan, et al.
Pubblicazione: (2025)
di: Lu, Wenquan, et al.
Pubblicazione: (2025)
Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety
di: Korbak, Tomek, et al.
Pubblicazione: (2025)
di: Korbak, Tomek, et al.
Pubblicazione: (2025)
A Rosetta Stone for AI Benchmarks
di: Ho, Anson, et al.
Pubblicazione: (2025)
di: Ho, Anson, et al.
Pubblicazione: (2025)
Avoiding Obfuscation with Prover-Estimator Debate
di: Brown-Cohen, Jonah, et al.
Pubblicazione: (2025)
di: Brown-Cohen, Jonah, et al.
Pubblicazione: (2025)
Chain-of-Thought Hijacking
di: Zhao, Jianli, et al.
Pubblicazione: (2025)
di: Zhao, Jianli, et al.
Pubblicazione: (2025)
Thoughts without Thinking: Reconsidering the Explanatory Value of Chain-of-Thought Reasoning in LLMs through Agentic Pipelines
di: Manuvinakurike, Ramesh, et al.
Pubblicazione: (2025)
di: Manuvinakurike, Ramesh, et al.
Pubblicazione: (2025)
Diagnosing Pathological Chain-of-Thought in Reasoning Models
di: Liu, Manqing, et al.
Pubblicazione: (2026)
di: Liu, Manqing, et al.
Pubblicazione: (2026)
Loong: Synthesize Long Chain-of-Thoughts at Scale through Verifiers
di: Huang, Xingyue, et al.
Pubblicazione: (2025)
di: Huang, Xingyue, et al.
Pubblicazione: (2025)
Upfront Chain-of-Thought: A Cooperative Framework for Chain-of-Thought Compression
di: Li, Chengzhengxu, et al.
Pubblicazione: (2025)
di: Li, Chengzhengxu, et al.
Pubblicazione: (2025)
Tracking the Behavioral Trajectories of Adapting Agents
di: Leshin, Jonah, et al.
Pubblicazione: (2026)
di: Leshin, Jonah, et al.
Pubblicazione: (2026)
Consistency Training Helps Stop Sycophancy and Jailbreaks
di: Irpan, Alex, et al.
Pubblicazione: (2025)
di: Irpan, Alex, et al.
Pubblicazione: (2025)
Supervised Chain of Thought
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
Teaching LLMs to Plan: Logical Chain-of-Thought Instruction Tuning for Symbolic Planning
di: Verma, Pulkit, et al.
Pubblicazione: (2025)
di: Verma, Pulkit, et al.
Pubblicazione: (2025)
Evaluating Chain-of-Thought Reasoning through Reusability and Verifiability
di: Aggarwal, Shashank, et al.
Pubblicazione: (2026)
di: Aggarwal, Shashank, et al.
Pubblicazione: (2026)
Understanding Chain-of-Thought in LLMs through Information Theory
di: Ton, Jean-Francois, et al.
Pubblicazione: (2024)
di: Ton, Jean-Francois, et al.
Pubblicazione: (2024)
LLM Reasoning Is Latent, Not the Chain of Thought
di: Wang, Wenshuo
Pubblicazione: (2026)
di: Wang, Wenshuo
Pubblicazione: (2026)
CoT-BERT: Enhancing Unsupervised Sentence Representation through Chain-of-Thought
di: Zhang, Bowen, et al.
Pubblicazione: (2023)
di: Zhang, Bowen, et al.
Pubblicazione: (2023)
CoIn: Counting the Invisible Reasoning Tokens in Commercial Opaque LLM APIs
di: Sun, Guoheng, et al.
Pubblicazione: (2025)
di: Sun, Guoheng, et al.
Pubblicazione: (2025)
Rethinking Reasoning Quality in Large Language Models through Enhanced Chain-of-Thought via RL
di: He, Haoyang, et al.
Pubblicazione: (2025)
di: He, Haoyang, et al.
Pubblicazione: (2025)
The Explanation Necessity for Healthcare AI
di: Mamalakis, Michail, et al.
Pubblicazione: (2024)
di: Mamalakis, Michail, et al.
Pubblicazione: (2024)
Are Reasoning LLMs Robust to Interventions on Their Chain-of-Thought?
di: von Recum, Alexander, et al.
Pubblicazione: (2026)
di: von Recum, Alexander, et al.
Pubblicazione: (2026)
Reasoning Models Struggle to Control their Chains of Thought
di: Yueh-Han, Chen, et al.
Pubblicazione: (2026)
di: Yueh-Han, Chen, et al.
Pubblicazione: (2026)
Chain Of Thought Compression: A Theoretical Analysis
di: Li, Juncai, et al.
Pubblicazione: (2026)
di: Li, Juncai, et al.
Pubblicazione: (2026)
Learning Composable Chains-of-Thought
di: Yin, Fangcong, et al.
Pubblicazione: (2025)
di: Yin, Fangcong, et al.
Pubblicazione: (2025)
How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
di: Chen, Xi, et al.
Pubblicazione: (2025)
di: Chen, Xi, et al.
Pubblicazione: (2025)
DICE: Structured Reasoning in LLMs through SLM-Guided Chain-of-Thought Correction
di: Li, Yiqi, et al.
Pubblicazione: (2025)
di: Li, Yiqi, et al.
Pubblicazione: (2025)
CoMAT: Chain of Mathematically Annotated Thought Improves Mathematical Reasoning
di: Leang, Joshua Ong Jun, et al.
Pubblicazione: (2024)
di: Leang, Joshua Ong Jun, et al.
Pubblicazione: (2024)
RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
A Pragmatic Way to Measure Chain-of-Thought Monitorability
di: Emmons, Scott, et al.
Pubblicazione: (2025)
di: Emmons, Scott, et al.
Pubblicazione: (2025)
Streaming Hallucination Detection in Long Chain-of-Thought Reasoning
di: Lu, Haolang, et al.
Pubblicazione: (2026)
di: Lu, Haolang, et al.
Pubblicazione: (2026)
Chain-of-Thought Predictive Control
di: Jia, Zhiwei, et al.
Pubblicazione: (2023)
di: Jia, Zhiwei, et al.
Pubblicazione: (2023)
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
Mind the Gap: Bridging Thought Leap for Improved Chain-of-Thought Tuning
di: Xu, Haolei, et al.
Pubblicazione: (2025)
di: Xu, Haolei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Aligned, Orthogonal or In-conflict: When can we safely optimize Chain-of-Thought?
di: Kaufmann, Max, et al.
Pubblicazione: (2026) -
When Chain of Thought is Necessary, Language Models Struggle to Evade Monitors
di: Emmons, Scott, et al.
Pubblicazione: (2025) -
Causal Sufficiency and Necessity Improves Chain-of-Thought Reasoning
di: Yu, Xiangning, et al.
Pubblicazione: (2025) -
Revisiting the Necessity of Lengthy Chain-of-Thought in Vision-centric Reasoning Generalization
di: Du, Yifan, et al.
Pubblicazione: (2025) -
MONA: Myopic Optimization with Non-myopic Approval Can Mitigate Multi-step Reward Hacking
di: Farquhar, Sebastian, et al.
Pubblicazione: (2025)