Guardado en:
| Autores principales: | Luo, Renjie, Li, Jiaxi, Huang, Chen, Lu, Wei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2506.07712 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Efficient Long CoT Reasoning in Small Language Models
por: Wang, Zhaoyang, et al.
Publicado: (2025)
por: Wang, Zhaoyang, et al.
Publicado: (2025)
Parrot: A Training Pipeline Enhances Both Program CoT and Natural Language CoT for Reasoning
por: Jin, Senjie, et al.
Publicado: (2025)
por: Jin, Senjie, et al.
Publicado: (2025)
The Synergy Dilemma of Long-CoT SFT and RL: Investigating Post-Training Techniques for Reasoning VLMs
por: Chen, Jierun, et al.
Publicado: (2025)
por: Chen, Jierun, et al.
Publicado: (2025)
AS-ES Learning: Towards Efficient CoT Learning in Small Models
por: Xi, Nuwa, et al.
Publicado: (2024)
por: Xi, Nuwa, et al.
Publicado: (2024)
Marathon: A Race Through the Realm of Long Context with Large Language Models
por: Zhang, Lei, et al.
Publicado: (2023)
por: Zhang, Lei, et al.
Publicado: (2023)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
por: Liao, Huanxuan, et al.
Publicado: (2024)
por: Liao, Huanxuan, et al.
Publicado: (2024)
Beyond In-Distribution Success: Scaling Curves of CoT Granularity for Language Model Generalization
por: Wang, Ru, et al.
Publicado: (2025)
por: Wang, Ru, et al.
Publicado: (2025)
Mol-R1: Towards Explicit Long-CoT Reasoning in Molecule Discovery
por: Li, Jiatong, et al.
Publicado: (2025)
por: Li, Jiatong, et al.
Publicado: (2025)
Generating Effective CoT Traces for Mitigating Causal Hallucination
por: Zhao, Yiheng, et al.
Publicado: (2026)
por: Zhao, Yiheng, et al.
Publicado: (2026)
Effectiveness of Zero-shot-CoT in Japanese Prompts
por: Takayama, Shusuke, et al.
Publicado: (2025)
por: Takayama, Shusuke, et al.
Publicado: (2025)
Nash CoT: Multi-Path Inference with Preference Equilibrium
por: Zhang, Ziqi, et al.
Publicado: (2024)
por: Zhang, Ziqi, et al.
Publicado: (2024)
From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step
por: Deng, Yuntian, et al.
Publicado: (2024)
por: Deng, Yuntian, et al.
Publicado: (2024)
Long or short CoT? Investigating Instance-level Switch of Large Reasoning Models
por: Zhang, Ruiqi, et al.
Publicado: (2025)
por: Zhang, Ruiqi, et al.
Publicado: (2025)
Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning
por: Yan, Shaotian, et al.
Publicado: (2026)
por: Yan, Shaotian, et al.
Publicado: (2026)
Beyond Isolated Capabilities: Bridging Long CoT Reasoning and Long-Context Understanding
por: Wang, Yifei
Publicado: (2025)
por: Wang, Yifei
Publicado: (2025)
Small Language Model Makes an Effective Long Text Extractor
por: Chen, Yelin, et al.
Publicado: (2025)
por: Chen, Yelin, et al.
Publicado: (2025)
Syzygy of Thoughts: Improving LLM CoT with the Minimal Free Resolution
por: Li, Chenghao, et al.
Publicado: (2025)
por: Li, Chenghao, et al.
Publicado: (2025)
How to Train Long-Context Language Models (Effectively)
por: Gao, Tianyu, et al.
Publicado: (2024)
por: Gao, Tianyu, et al.
Publicado: (2024)
WildLong: Synthesizing Realistic Long-Context Instruction Data at Scale
por: Li, Jiaxi, et al.
Publicado: (2025)
por: Li, Jiaxi, et al.
Publicado: (2025)
Investigating CoT Monitorability in Large Reasoning Models
por: Yang, Shu, et al.
Publicado: (2025)
por: Yang, Shu, et al.
Publicado: (2025)
Dual-Track CoT: Budget-Aware Stepwise Guidance for Small LMs
por: Chatterjee, Sagnik, et al.
Publicado: (2026)
por: Chatterjee, Sagnik, et al.
Publicado: (2026)
Zebra-CoT: A Dataset for Interleaved Vision Language Reasoning
por: Li, Ang, et al.
Publicado: (2025)
por: Li, Ang, et al.
Publicado: (2025)
PM-KVQ: Progressive Mixed-precision KV Cache Quantization for Long-CoT LLMs
por: Liu, Tengxuan, et al.
Publicado: (2025)
por: Liu, Tengxuan, et al.
Publicado: (2025)
The Curse of CoT: On the Limitations of Chain-of-Thought in In-Context Learning
por: Zheng, Tianshi, et al.
Publicado: (2025)
por: Zheng, Tianshi, et al.
Publicado: (2025)
Data Repetition Beats Data Scaling in Long-CoT Supervised Fine-Tuning
por: Kopiczko, Dawid J., et al.
Publicado: (2026)
por: Kopiczko, Dawid J., et al.
Publicado: (2026)
To CoT or not to CoT? Chain-of-thought helps mainly on math and symbolic reasoning
por: Sprague, Zayne, et al.
Publicado: (2024)
por: Sprague, Zayne, et al.
Publicado: (2024)
Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model
por: Ma, Ziyang, et al.
Publicado: (2025)
por: Ma, Ziyang, et al.
Publicado: (2025)
Chain-of-Tools: Utilizing Massive Unseen Tools in the CoT Reasoning of Frozen Language Models
por: Wu, Mengsong, et al.
Publicado: (2025)
por: Wu, Mengsong, et al.
Publicado: (2025)
D-SCoRE: Document-Centric Segmentation and CoT Reasoning with Structured Export for QA-CoT Data Generation
por: Zhou, Weibo, et al.
Publicado: (2025)
por: Zhou, Weibo, et al.
Publicado: (2025)
Instruction Tuning and CoT Prompting for Contextual Medical QA with LLMs
por: Le, Chenqian, et al.
Publicado: (2025)
por: Le, Chenqian, et al.
Publicado: (2025)
CoT Vectors: Transferring and Probing the Reasoning Mechanisms of LLMs
por: Li, Li, et al.
Publicado: (2025)
por: Li, Li, et al.
Publicado: (2025)
Large Language Model for Multi-Domain Translation: Benchmarking and Domain CoT Fine-tuning
por: Hu, Tianxiang, et al.
Publicado: (2024)
por: Hu, Tianxiang, et al.
Publicado: (2024)
CoT-Kinetics: A Theoretical Modeling Assessing LRM Reasoning Process
por: Bi, Jinhe, et al.
Publicado: (2025)
por: Bi, Jinhe, et al.
Publicado: (2025)
Effectively Prompting Small-sized Language Models for Cross-lingual Tasks via Winning Tickets
por: Li, Mingqi, et al.
Publicado: (2024)
por: Li, Mingqi, et al.
Publicado: (2024)
Investigating Mysteries of CoT-Augmented Distillation
por: Wadhwa, Somin, et al.
Publicado: (2024)
por: Wadhwa, Somin, et al.
Publicado: (2024)
The Readout Shortcut: Positional Number Copying Dominates Arithmetic CoT Readout in Small Language Models
por: Liu, Ming
Publicado: (2026)
por: Liu, Ming
Publicado: (2026)
SIM-CoT: Supervised Implicit Chain-of-Thought
por: Wei, Xilin, et al.
Publicado: (2025)
por: Wei, Xilin, et al.
Publicado: (2025)
CoT-based Synthesizer: Enhancing LLM Performance through Answer Synthesis
por: Zhang, Bohan, et al.
Publicado: (2025)
por: Zhang, Bohan, et al.
Publicado: (2025)
TIBSTC-CoT: A Multi-Domain Instruction Dataset for Chain-of-Thought Reasoning in Language Models
por: Gao, Fan, et al.
Publicado: (2025)
por: Gao, Fan, et al.
Publicado: (2025)
To Think or Not to Think: The Hidden Cost of Meta-Training with Excessive CoT Examples
por: Kothapalli, Vignesh, et al.
Publicado: (2025)
por: Kothapalli, Vignesh, et al.
Publicado: (2025)
Ejemplares similares
-
Efficient Long CoT Reasoning in Small Language Models
por: Wang, Zhaoyang, et al.
Publicado: (2025) -
Parrot: A Training Pipeline Enhances Both Program CoT and Natural Language CoT for Reasoning
por: Jin, Senjie, et al.
Publicado: (2025) -
The Synergy Dilemma of Long-CoT SFT and RL: Investigating Post-Training Techniques for Reasoning VLMs
por: Chen, Jierun, et al.
Publicado: (2025) -
AS-ES Learning: Towards Efficient CoT Learning in Small Models
por: Xi, Nuwa, et al.
Publicado: (2024) -
Marathon: A Race Through the Realm of Long Context with Large Language Models
por: Zhang, Lei, et al.
Publicado: (2023)