Enhancing Generalization in Chain of Thought Reasoning for Smaller Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yin, Maxwell J., Jiang, Dingyi, Chen, Yongbing, Wang, Boyu, Ling, Charles |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
par: Ye, Jiacheng, et autres
Publié: (2024)
par: Ye, Jiacheng, et autres
Publié: (2024)
Long Chain-of-Thought Reasoning Across Languages
par: Barua, Josh, et autres
Publié: (2025)
par: Barua, Josh, et autres
Publié: (2025)
Fractured Chain-of-Thought Reasoning
par: Liao, Baohao, et autres
Publié: (2025)
par: Liao, Baohao, et autres
Publié: (2025)
Rethinking Chain-of-Thought Reasoning for Videos
par: Zhong, Yiwu, et autres
Publié: (2025)
par: Zhong, Yiwu, et autres
Publié: (2025)
Understanding Reasoning in Chain-of-Thought from the Hopfieldian View
par: Hu, Lijie, et autres
Publié: (2024)
par: Hu, Lijie, et autres
Publié: (2024)
Scalable Chain of Thoughts via Elastic Reasoning
par: Xu, Yuhui, et autres
Publié: (2025)
par: Xu, Yuhui, et autres
Publié: (2025)
Enhancing Auto-regressive Chain-of-Thought through Loop-Aligned Reasoning
par: Yu, Qifan, et autres
Publié: (2025)
par: Yu, Qifan, et autres
Publié: (2025)
Stepwise Penalization for Length-Efficient Chain-of-Thought Reasoning
par: Li, Xintong, et autres
Publié: (2026)
par: Li, Xintong, et autres
Publié: (2026)
SQuARE: Sequential Question Answering Reasoning Engine for Enhanced Chain-of-Thought in Large Language Models
par: Fleischer, Daniel, et autres
Publié: (2025)
par: Fleischer, Daniel, et autres
Publié: (2025)
Reasoning Theater: Disentangling Model Beliefs from Chain-of-Thought
par: Boppana, Siddharth, et autres
Publié: (2026)
par: Boppana, Siddharth, et autres
Publié: (2026)
Value-Guided Search for Efficient Chain-of-Thought Reasoning
par: Wang, Kaiwen, et autres
Publié: (2025)
par: Wang, Kaiwen, et autres
Publié: (2025)
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
par: Arcuschin, Iván, et autres
Publié: (2025)
par: Arcuschin, Iván, et autres
Publié: (2025)
Compositional Reasoning with Transformers, RNNs, and Chain of Thought
par: Yehudai, Gilad, et autres
Publié: (2025)
par: Yehudai, Gilad, et autres
Publié: (2025)
Is Chain-of-Thought Reasoning of LLMs a Mirage? A Data Distribution Lens
par: Zhao, Chengshuai, et autres
Publié: (2025)
par: Zhao, Chengshuai, et autres
Publié: (2025)
FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning
par: Xie, Zhuohan, et autres
Publié: (2025)
par: Xie, Zhuohan, et autres
Publié: (2025)
Integrating Arithmetic Learning Improves Mathematical Reasoning in Smaller Models
par: Gangwar, Neeraj, et autres
Publié: (2025)
par: Gangwar, Neeraj, et autres
Publié: (2025)
Enhancing Zero-Shot Chain-of-Thought Reasoning in Large Language Models through Logic
par: Zhao, Xufeng, et autres
Publié: (2023)
par: Zhao, Xufeng, et autres
Publié: (2023)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
par: Cui, Yingqian, et autres
Publié: (2025)
par: Cui, Yingqian, et autres
Publié: (2025)
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
par: Yang, Ling, et autres
Publié: (2025)
par: Yang, Ling, et autres
Publié: (2025)
NPG-Muse: Scaling Long Chain-of-Thought Reasoning with NP-Hard Graph Problems
par: Wang, Yuyao, et autres
Publié: (2025)
par: Wang, Yuyao, et autres
Publié: (2025)
Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL
par: Yao, Jiarui, et autres
Publié: (2025)
par: Yao, Jiarui, et autres
Publié: (2025)
Chain-of-Defensive-Thought: Structured Reasoning Elicits Robustness in Large Language Models against Reference Corruption
par: Wang, Wenxiao, et autres
Publié: (2025)
par: Wang, Wenxiao, et autres
Publié: (2025)
Verifying Chain-of-Thought Reasoning via Its Computational Graph
par: Zhao, Zheng, et autres
Publié: (2025)
par: Zhao, Zheng, et autres
Publié: (2025)
Think Consistently, Reason Efficiently: Energy-Based Calibration for Implicit Chain-of-Thought
par: Chen, Zhikang, et autres
Publié: (2025)
par: Chen, Zhikang, et autres
Publié: (2025)
A Theoretical Understanding of Chain-of-Thought: Coherent Reasoning and Error-Aware Demonstration
par: Cui, Yingqian, et autres
Publié: (2024)
par: Cui, Yingqian, et autres
Publié: (2024)
Beyond Answers: Transferring Reasoning Capabilities to Smaller LLMs Using Multi-Teacher Knowledge Distillation
par: Tian, Yijun, et autres
Publié: (2024)
par: Tian, Yijun, et autres
Publié: (2024)
Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal
par: Yuan, Aojie, et autres
Publié: (2026)
par: Yuan, Aojie, et autres
Publié: (2026)
CoTAR: Chain-of-Thought Attribution Reasoning with Multi-level Granularity
par: Berchansky, Moshe, et autres
Publié: (2024)
par: Berchansky, Moshe, et autres
Publié: (2024)
Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning
par: Li, Miao, et autres
Publié: (2026)
par: Li, Miao, et autres
Publié: (2026)
Iteration Head: A Mechanistic Study of Chain-of-Thought
par: Cabannes, Vivien, et autres
Publié: (2024)
par: Cabannes, Vivien, et autres
Publié: (2024)
A Hopfieldian View-based Interpretation for Chain-of-Thought Reasoning
par: Hu, Lijie, et autres
Publié: (2024)
par: Hu, Lijie, et autres
Publié: (2024)
Learning to Rank Chain-of-Thought: Using a Small Model
par: Jiang, Eric Hanchen, et autres
Publié: (2025)
par: Jiang, Eric Hanchen, et autres
Publié: (2025)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
par: Aravindan, Ashwath Vaithinathan, et autres
Publié: (2026)
par: Aravindan, Ashwath Vaithinathan, et autres
Publié: (2026)
PathCoT: Chain-of-Thought Prompting for Zero-shot Pathology Visual Reasoning
par: Zhou, Junjie, et autres
Publié: (2025)
par: Zhou, Junjie, et autres
Publié: (2025)
TERMINATOR: Learning Optimal Exit Points for Early Stopping in Chain-of-Thought Reasoning
par: Nagle, Alliot, et autres
Publié: (2026)
par: Nagle, Alliot, et autres
Publié: (2026)
Is Chain-of-Thought Really Not Explainability? Chain-of-Thought Can Be Faithful without Hint Verbalization
par: Zaman, Kerem, et autres
Publié: (2025)
par: Zaman, Kerem, et autres
Publié: (2025)
Generating Chain-of-Thoughts with a Pairwise-Comparison Approach to Searching for the Most Promising Intermediate Thought
par: Zhang, Zhen-Yu, et autres
Publié: (2024)
par: Zhang, Zhen-Yu, et autres
Publié: (2024)
Toward Adaptive Reasoning in Large Language Models with Thought Rollback
par: Chen, Sijia, et autres
Publié: (2024)
par: Chen, Sijia, et autres
Publié: (2024)
Weight-of-Thought Reasoning: Exploring Neural Network Weights for Enhanced LLM Reasoning
par: Punjwani, Saif, et autres
Publié: (2025)
par: Punjwani, Saif, et autres
Publié: (2025)
A Formal Comparison Between Chain of Thought and Latent Thought
par: Xu, Kevin, et autres
Publié: (2025)
par: Xu, Kevin, et autres
Publié: (2025)
Documents similaires
-
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
par: Ye, Jiacheng, et autres
Publié: (2024) -
Long Chain-of-Thought Reasoning Across Languages
par: Barua, Josh, et autres
Publié: (2025) -
Fractured Chain-of-Thought Reasoning
par: Liao, Baohao, et autres
Publié: (2025) -
Rethinking Chain-of-Thought Reasoning for Videos
par: Zhong, Yiwu, et autres
Publié: (2025) -
Understanding Reasoning in Chain-of-Thought from the Hopfieldian View
par: Hu, Lijie, et autres
Publié: (2024)