Through the Valley: Path to Effective Long CoT Training for Small Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Luo, Renjie, Li, Jiaxi, Huang, Chen, Lu, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Efficient Long CoT Reasoning in Small Language Models
di: Wang, Zhaoyang, et al.
Pubblicazione: (2025)
di: Wang, Zhaoyang, et al.
Pubblicazione: (2025)
Parrot: A Training Pipeline Enhances Both Program CoT and Natural Language CoT for Reasoning
di: Jin, Senjie, et al.
Pubblicazione: (2025)
di: Jin, Senjie, et al.
Pubblicazione: (2025)
AS-ES Learning: Towards Efficient CoT Learning in Small Models
di: Xi, Nuwa, et al.
Pubblicazione: (2024)
di: Xi, Nuwa, et al.
Pubblicazione: (2024)
The Synergy Dilemma of Long-CoT SFT and RL: Investigating Post-Training Techniques for Reasoning VLMs
di: Chen, Jierun, et al.
Pubblicazione: (2025)
di: Chen, Jierun, et al.
Pubblicazione: (2025)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
di: Liao, Huanxuan, et al.
Pubblicazione: (2024)
di: Liao, Huanxuan, et al.
Pubblicazione: (2024)
Marathon: A Race Through the Realm of Long Context with Large Language Models
di: Zhang, Lei, et al.
Pubblicazione: (2023)
di: Zhang, Lei, et al.
Pubblicazione: (2023)
Beyond In-Distribution Success: Scaling Curves of CoT Granularity for Language Model Generalization
di: Wang, Ru, et al.
Pubblicazione: (2025)
di: Wang, Ru, et al.
Pubblicazione: (2025)
Mol-R1: Towards Explicit Long-CoT Reasoning in Molecule Discovery
di: Li, Jiatong, et al.
Pubblicazione: (2025)
di: Li, Jiatong, et al.
Pubblicazione: (2025)
Generating Effective CoT Traces for Mitigating Causal Hallucination
di: Zhao, Yiheng, et al.
Pubblicazione: (2026)
di: Zhao, Yiheng, et al.
Pubblicazione: (2026)
Effectiveness of Zero-shot-CoT in Japanese Prompts
di: Takayama, Shusuke, et al.
Pubblicazione: (2025)
di: Takayama, Shusuke, et al.
Pubblicazione: (2025)
Long or short CoT? Investigating Instance-level Switch of Large Reasoning Models
di: Zhang, Ruiqi, et al.
Pubblicazione: (2025)
di: Zhang, Ruiqi, et al.
Pubblicazione: (2025)
Beyond Isolated Capabilities: Bridging Long CoT Reasoning and Long-Context Understanding
di: Wang, Yifei
Pubblicazione: (2025)
di: Wang, Yifei
Pubblicazione: (2025)
From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step
di: Deng, Yuntian, et al.
Pubblicazione: (2024)
di: Deng, Yuntian, et al.
Pubblicazione: (2024)
Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning
di: Yan, Shaotian, et al.
Pubblicazione: (2026)
di: Yan, Shaotian, et al.
Pubblicazione: (2026)
Nash CoT: Multi-Path Inference with Preference Equilibrium
di: Zhang, Ziqi, et al.
Pubblicazione: (2024)
di: Zhang, Ziqi, et al.
Pubblicazione: (2024)
Small Language Model Makes an Effective Long Text Extractor
di: Chen, Yelin, et al.
Pubblicazione: (2025)
di: Chen, Yelin, et al.
Pubblicazione: (2025)
How to Train Long-Context Language Models (Effectively)
di: Gao, Tianyu, et al.
Pubblicazione: (2024)
di: Gao, Tianyu, et al.
Pubblicazione: (2024)
Syzygy of Thoughts: Improving LLM CoT with the Minimal Free Resolution
di: Li, Chenghao, et al.
Pubblicazione: (2025)
di: Li, Chenghao, et al.
Pubblicazione: (2025)
Investigating CoT Monitorability in Large Reasoning Models
di: Yang, Shu, et al.
Pubblicazione: (2025)
di: Yang, Shu, et al.
Pubblicazione: (2025)
Dual-Track CoT: Budget-Aware Stepwise Guidance for Small LMs
di: Chatterjee, Sagnik, et al.
Pubblicazione: (2026)
di: Chatterjee, Sagnik, et al.
Pubblicazione: (2026)
PM-KVQ: Progressive Mixed-precision KV Cache Quantization for Long-CoT LLMs
di: Liu, Tengxuan, et al.
Pubblicazione: (2025)
di: Liu, Tengxuan, et al.
Pubblicazione: (2025)
Data Repetition Beats Data Scaling in Long-CoT Supervised Fine-Tuning
di: Kopiczko, Dawid J., et al.
Pubblicazione: (2026)
di: Kopiczko, Dawid J., et al.
Pubblicazione: (2026)
WildLong: Synthesizing Realistic Long-Context Instruction Data at Scale
di: Li, Jiaxi, et al.
Pubblicazione: (2025)
di: Li, Jiaxi, et al.
Pubblicazione: (2025)
The Curse of CoT: On the Limitations of Chain-of-Thought in In-Context Learning
di: Zheng, Tianshi, et al.
Pubblicazione: (2025)
di: Zheng, Tianshi, et al.
Pubblicazione: (2025)
Zebra-CoT: A Dataset for Interleaved Vision Language Reasoning
di: Li, Ang, et al.
Pubblicazione: (2025)
di: Li, Ang, et al.
Pubblicazione: (2025)
Effectively Prompting Small-sized Language Models for Cross-lingual Tasks via Winning Tickets
di: Li, Mingqi, et al.
Pubblicazione: (2024)
di: Li, Mingqi, et al.
Pubblicazione: (2024)
Large Language Model for Multi-Domain Translation: Benchmarking and Domain CoT Fine-tuning
di: Hu, Tianxiang, et al.
Pubblicazione: (2024)
di: Hu, Tianxiang, et al.
Pubblicazione: (2024)
Chain-of-Tools: Utilizing Massive Unseen Tools in the CoT Reasoning of Frozen Language Models
di: Wu, Mengsong, et al.
Pubblicazione: (2025)
di: Wu, Mengsong, et al.
Pubblicazione: (2025)
CoT Vectors: Transferring and Probing the Reasoning Mechanisms of LLMs
di: Li, Li, et al.
Pubblicazione: (2025)
di: Li, Li, et al.
Pubblicazione: (2025)
Instruction Tuning and CoT Prompting for Contextual Medical QA with LLMs
di: Le, Chenqian, et al.
Pubblicazione: (2025)
di: Le, Chenqian, et al.
Pubblicazione: (2025)
D-SCoRE: Document-Centric Segmentation and CoT Reasoning with Structured Export for QA-CoT Data Generation
di: Zhou, Weibo, et al.
Pubblicazione: (2025)
di: Zhou, Weibo, et al.
Pubblicazione: (2025)
Investigating Mysteries of CoT-Augmented Distillation
di: Wadhwa, Somin, et al.
Pubblicazione: (2024)
di: Wadhwa, Somin, et al.
Pubblicazione: (2024)
Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
CoT-Kinetics: A Theoretical Modeling Assessing LRM Reasoning Process
di: Bi, Jinhe, et al.
Pubblicazione: (2025)
di: Bi, Jinhe, et al.
Pubblicazione: (2025)
To CoT or not to CoT? Chain-of-thought helps mainly on math and symbolic reasoning
di: Sprague, Zayne, et al.
Pubblicazione: (2024)
di: Sprague, Zayne, et al.
Pubblicazione: (2024)
CoT-based Synthesizer: Enhancing LLM Performance through Answer Synthesis
di: Zhang, Bohan, et al.
Pubblicazione: (2025)
di: Zhang, Bohan, et al.
Pubblicazione: (2025)
SIM-CoT: Supervised Implicit Chain-of-Thought
di: Wei, Xilin, et al.
Pubblicazione: (2025)
di: Wei, Xilin, et al.
Pubblicazione: (2025)
TIBSTC-CoT: A Multi-Domain Instruction Dataset for Chain-of-Thought Reasoning in Language Models
di: Gao, Fan, et al.
Pubblicazione: (2025)
di: Gao, Fan, et al.
Pubblicazione: (2025)
Can Pruning Improve Reasoning? Revisiting Long-CoT Compression with Capability in Mind for Better Reasoning
di: Zhao, Shangziqi, et al.
Pubblicazione: (2025)
di: Zhao, Shangziqi, et al.
Pubblicazione: (2025)
On the Effectiveness of Incremental Training of Large Language Models
di: Li, Miles Q., et al.
Pubblicazione: (2024)
di: Li, Miles Q., et al.
Pubblicazione: (2024)
Documenti analoghi
-
Efficient Long CoT Reasoning in Small Language Models
di: Wang, Zhaoyang, et al.
Pubblicazione: (2025) -
Parrot: A Training Pipeline Enhances Both Program CoT and Natural Language CoT for Reasoning
di: Jin, Senjie, et al.
Pubblicazione: (2025) -
AS-ES Learning: Towards Efficient CoT Learning in Small Models
di: Xi, Nuwa, et al.
Pubblicazione: (2024) -
The Synergy Dilemma of Long-CoT SFT and RL: Investigating Post-Training Techniques for Reasoning VLMs
di: Chen, Jierun, et al.
Pubblicazione: (2025) -
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
di: Liao, Huanxuan, et al.
Pubblicazione: (2024)