Reducing Reasoning Costs: The Path of Optimization for Chain of Thought via Sparse Attention Mechanism
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Wang, Libo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dynamic Chain-of-Thought: Towards Adaptive Deep Reasoning
par: Wang, Libo
Publié: (2025)
par: Wang, Libo
Publié: (2025)
Improving Chain-of-Thought for Logical Reasoning via Attention-Aware Intervention
par: Phuong, Nguyen Minh, et autres
Publié: (2026)
par: Phuong, Nguyen Minh, et autres
Publié: (2026)
Graph-of-Causal Evolution: Challenging Chain-of-Model for Reasoning
par: Wang, Libo
Publié: (2025)
par: Wang, Libo
Publié: (2025)
The Cost of Reasoning: Chain-of-Thought Induces Overconfidence in Vision-Language Models
par: Welch, Robert, et autres
Publié: (2026)
par: Welch, Robert, et autres
Publié: (2026)
Chain of Preference Optimization: Improving Chain-of-Thought Reasoning in LLMs
par: Zhang, Xuan, et autres
Publié: (2024)
par: Zhang, Xuan, et autres
Publié: (2024)
Lower Bounds for Chain-of-Thought Reasoning in Hard-Attention Transformers
par: Amiri, Alireza, et autres
Publié: (2025)
par: Amiri, Alireza, et autres
Publié: (2025)
From Sparse Dependence to Sparse Attention: Unveiling How Chain-of-Thought Enhances Transformer Sample Efficiency
par: Wen, Kaiyue, et autres
Publié: (2024)
par: Wen, Kaiyue, et autres
Publié: (2024)
CTRLS: Chain-of-Thought Reasoning via Latent State-Transition
par: Wu, Junda, et autres
Publié: (2025)
par: Wu, Junda, et autres
Publié: (2025)
Scalable Chain of Thoughts via Elastic Reasoning
par: Xu, Yuhui, et autres
Publié: (2025)
par: Xu, Yuhui, et autres
Publié: (2025)
Robotic Control via Embodied Chain-of-Thought Reasoning
par: Zawalski, Michał, et autres
Publié: (2024)
par: Zawalski, Michał, et autres
Publié: (2024)
Stochastic Shortest Path with Sparse Adversarial Costs
par: Johnson, Emmeran, et autres
Publié: (2025)
par: Johnson, Emmeran, et autres
Publié: (2025)
PathCoT: Chain-of-Thought Prompting for Zero-shot Pathology Visual Reasoning
par: Zhou, Junjie, et autres
Publié: (2025)
par: Zhou, Junjie, et autres
Publié: (2025)
On Learning Verifiers and Implications to Chain-of-Thought Reasoning
par: Balcan, Maria-Florina, et autres
Publié: (2025)
par: Balcan, Maria-Florina, et autres
Publié: (2025)
Echoes within the Reasoning: Stealthy and Effective Watermarking via Chain of Thought
par: Lu, Jiacheng, et autres
Publié: (2026)
par: Lu, Jiacheng, et autres
Publié: (2026)
On the Cost and Benefit of Chain of Thought: A Learning-Theoretic Perspective
par: Zhang, Yue, et autres
Publié: (2026)
par: Zhang, Yue, et autres
Publié: (2026)
Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL
par: Yao, Jiarui, et autres
Publié: (2025)
par: Yao, Jiarui, et autres
Publié: (2025)
Fractured Chain-of-Thought Reasoning
par: Liao, Baohao, et autres
Publié: (2025)
par: Liao, Baohao, et autres
Publié: (2025)
Continuous Chain of Thought Enables Parallel Exploration and Reasoning
par: Gozeten, Halil Alperen, et autres
Publié: (2025)
par: Gozeten, Halil Alperen, et autres
Publié: (2025)
Reasoning Models Sometimes Output Illegible Chains of Thought
par: Jose, Arun
Publié: (2025)
par: Jose, Arun
Publié: (2025)
Reinforcing Chain-of-Thought Reasoning with Self-Evolving Rubrics
par: Sheng, Leheng, et autres
Publié: (2026)
par: Sheng, Leheng, et autres
Publié: (2026)
Understanding Hidden Computations in Chain-of-Thought Reasoning
par: Bharadwaj, Aryasomayajula Ram
Publié: (2024)
par: Bharadwaj, Aryasomayajula Ram
Publié: (2024)
Demystifying Long Chain-of-Thought Reasoning in LLMs
par: Yeo, Edward, et autres
Publié: (2025)
par: Yeo, Edward, et autres
Publié: (2025)
Unveiling Confirmation Bias in Chain-of-Thought Reasoning
par: Wan, Yue, et autres
Publié: (2025)
par: Wan, Yue, et autres
Publié: (2025)
Reducing Credit Assignment Variance via Counterfactual Reasoning Paths
par: Ding, Fei, et autres
Publié: (2026)
par: Ding, Fei, et autres
Publié: (2026)
Verifying Chain-of-Thought Reasoning via Its Computational Graph
par: Zhao, Zheng, et autres
Publié: (2025)
par: Zhao, Zheng, et autres
Publié: (2025)
Long Chain-of-Thought Compression via Fine-Grained Group Policy Optimization
par: Han, Xinchen, et autres
Publié: (2026)
par: Han, Xinchen, et autres
Publié: (2026)
Reasoning by Superposition: A Theoretical Perspective on Chain of Continuous Thought
par: Zhu, Hanlin, et autres
Publié: (2025)
par: Zhu, Hanlin, et autres
Publié: (2025)
A Theory of Online Learning with Autoregressive Chain-of-Thought Reasoning
par: Doron-Arad, Ilan, et autres
Publié: (2026)
par: Doron-Arad, Ilan, et autres
Publié: (2026)
CDW-CoT: Clustered Distance-Weighted Chain-of-Thoughts Reasoning
par: Fang, Yuanheng, et autres
Publié: (2025)
par: Fang, Yuanheng, et autres
Publié: (2025)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
par: Ye, Jiacheng, et autres
Publié: (2024)
par: Ye, Jiacheng, et autres
Publié: (2024)
Thought-Transfer: Indirect Targeted Poisoning Attacks on Chain-of-Thought Reasoning Models
par: Chaudhari, Harsh, et autres
Publié: (2026)
par: Chaudhari, Harsh, et autres
Publié: (2026)
Learning from Partial Chain-of-Thought via Truncated-Reasoning Self-Distillation
par: Silvestri, Gianluigi, et autres
Publié: (2026)
par: Silvestri, Gianluigi, et autres
Publié: (2026)
Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression
par: Tang, Yuntian, et autres
Publié: (2026)
par: Tang, Yuntian, et autres
Publié: (2026)
Exploring Chain-of-Thought Reasoning for Steerable Pluralistic Alignment
par: Zhang, Yunfan, et autres
Publié: (2025)
par: Zhang, Yunfan, et autres
Publié: (2025)
Pause and Reflect: Conformal Aggregation for Chain-of-Thought Reasoning
par: Gu, Yu, et autres
Publié: (2026)
par: Gu, Yu, et autres
Publié: (2026)
Enhancing Generalization in Chain of Thought Reasoning for Smaller Models
par: Yin, Maxwell J., et autres
Publié: (2025)
par: Yin, Maxwell J., et autres
Publié: (2025)
Rethinking Chain-of-Thought Reasoning for Videos
par: Zhong, Yiwu, et autres
Publié: (2025)
par: Zhong, Yiwu, et autres
Publié: (2025)
Sample Complexity of Autoregressive Reasoning: Chain-of-Thought vs. End-to-End
par: Hanneke, Steve, et autres
Publié: (2026)
par: Hanneke, Steve, et autres
Publié: (2026)
Bridging Formal Language with Chain-of-Thought Reasoning to Geometry Problem Solving
par: Yang, Tianyun, et autres
Publié: (2025)
par: Yang, Tianyun, et autres
Publié: (2025)
Value-Guided Search for Efficient Chain-of-Thought Reasoning
par: Wang, Kaiwen, et autres
Publié: (2025)
par: Wang, Kaiwen, et autres
Publié: (2025)
Documents similaires
-
Dynamic Chain-of-Thought: Towards Adaptive Deep Reasoning
par: Wang, Libo
Publié: (2025) -
Improving Chain-of-Thought for Logical Reasoning via Attention-Aware Intervention
par: Phuong, Nguyen Minh, et autres
Publié: (2026) -
Graph-of-Causal Evolution: Challenging Chain-of-Model for Reasoning
par: Wang, Libo
Publié: (2025) -
The Cost of Reasoning: Chain-of-Thought Induces Overconfidence in Vision-Language Models
par: Welch, Robert, et autres
Publié: (2026) -
Chain of Preference Optimization: Improving Chain-of-Thought Reasoning in LLMs
par: Zhang, Xuan, et autres
Publié: (2024)