SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Chenzhi, Hu, Qinzhe, Xu, Yuhang, Chen, Junyi, Wang, Ruijie, Liu, Shengzhong, Li, Jianxin, Wu, Fan, Chen, Guihai |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control
par: He, Xingyang, et autres
Publié: (2025)
par: He, Xingyang, et autres
Publié: (2025)
Nova: Real-Time Agentic Vision-Language Model Serving with Adaptive Cross-Stage Parallelization
par: Xu, Yuhang, et autres
Publié: (2025)
par: Xu, Yuhang, et autres
Publié: (2025)
RouteGoT: Node-Adaptive Routing for Cost-Efficient Graph of Thoughts Reasoning
par: Liu, Yuhang, et autres
Publié: (2026)
par: Liu, Yuhang, et autres
Publié: (2026)
Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning
par: Jiang, Qing, et autres
Publié: (2025)
par: Jiang, Qing, et autres
Publié: (2025)
ABO: Abandon Bayer Filter for Adaptive Edge Offloading in Responsive Augmented Reality
par: Han, Yongxuan, et autres
Publié: (2025)
par: Han, Yongxuan, et autres
Publié: (2025)
Responsive DNN Adaptation for Video Analytics against Environment Shift via Hierarchical Mobile-Cloud Collaborations
par: Zhao, Maozhe, et autres
Publié: (2025)
par: Zhao, Maozhe, et autres
Publié: (2025)
TypedThinker: Diversify Large Language Model Reasoning with Typed Thinking
par: Wang, Danqing, et autres
Publié: (2024)
par: Wang, Danqing, et autres
Publié: (2024)
Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models
par: Chen, Qiguang, et autres
Publié: (2025)
par: Chen, Qiguang, et autres
Publié: (2025)
Audio-DeepThinker: Progressive Reasoning-Aware Reinforcement Learning for High-Quality Chain-of-Thought Emergence in Audio Language Models
par: He, Xiang, et autres
Publié: (2026)
par: He, Xiang, et autres
Publié: (2026)
Leaky Thoughts: Large Reasoning Models Are Not Private Thinkers
par: Green, Tommaso, et autres
Publié: (2025)
par: Green, Tommaso, et autres
Publié: (2025)
Stepwise Penalization for Length-Efficient Chain-of-Thought Reasoning
par: Li, Xintong, et autres
Publié: (2026)
par: Li, Xintong, et autres
Publié: (2026)
SPOT: Span-level Pause-of-Thought for Efficient and Interpretable Latent Reasoning in Large Language Models
par: Chu, Yunlong, et autres
Publié: (2026)
par: Chu, Yunlong, et autres
Publié: (2026)
MONICA: Real-Time Monitoring and Calibration of Chain-of-Thought Sycophancy in Large Reasoning Models
par: Hu, Jingyu, et autres
Publié: (2025)
par: Hu, Jingyu, et autres
Publié: (2025)
AdvChain: Adversarial Chain-of-Thought Tuning for Robust Safety Alignment of Large Reasoning Models
par: Zhu, Zihao, et autres
Publié: (2025)
par: Zhu, Zihao, et autres
Publié: (2025)
Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression
par: Tang, Yuntian, et autres
Publié: (2026)
par: Tang, Yuntian, et autres
Publié: (2026)
Think Consistently, Reason Efficiently: Energy-Based Calibration for Implicit Chain-of-Thought
par: Chen, Zhikang, et autres
Publié: (2025)
par: Chen, Zhikang, et autres
Publié: (2025)
Transformers Provably Learn Chain-of-Thought Reasoning with Length Generalization
par: Huang, Yu, et autres
Publié: (2025)
par: Huang, Yu, et autres
Publié: (2025)
Scaling Graph Chain-of-Thought Reasoning: A Multi-Agent Framework with Efficient LLM Serving
par: Huan, Chengying, et autres
Publié: (2025)
par: Huan, Chengying, et autres
Publié: (2025)
ChartThinker: A Contextual Chain-of-Thought Approach to Optimized Chart Summarization
par: Liu, Mengsha, et autres
Publié: (2024)
par: Liu, Mengsha, et autres
Publié: (2024)
LEAD: Length-Efficient Adaptive and Dynamic Reasoning for Large Language Models
par: Wei, Songtao, et autres
Publié: (2026)
par: Wei, Songtao, et autres
Publié: (2026)
Deep Hidden Cognition Facilitates Reliable Chain-of-Thought Reasoning
par: Chen, Zijun, et autres
Publié: (2025)
par: Chen, Zijun, et autres
Publié: (2025)
Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework
par: Zhang, Chenyuan, et autres
Publié: (2026)
par: Zhang, Chenyuan, et autres
Publié: (2026)
Markov Chain of Thought for Efficient Mathematical Reasoning
par: Yang, Wen, et autres
Publié: (2024)
par: Yang, Wen, et autres
Publié: (2024)
StreamingCoT: A Dataset for Temporal Dynamics and Multimodal Chain-of-Thought Reasoning in Streaming VideoQA
par: Hu, Yuhang, et autres
Publié: (2025)
par: Hu, Yuhang, et autres
Publié: (2025)
ConMax: Confidence-Maximizing Compression for Efficient Chain-of-Thought Reasoning
par: Hu, Minda, et autres
Publié: (2026)
par: Hu, Minda, et autres
Publié: (2026)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
par: Cheng, Xiaoxue, et autres
Publié: (2024)
par: Cheng, Xiaoxue, et autres
Publié: (2024)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
par: Lee, Jooyoung, et autres
Publié: (2024)
par: Lee, Jooyoung, et autres
Publié: (2024)
TokenFlow: Responsive LLM Text Streaming Serving under Request Burst via Preemptive Scheduling
par: Chen, Junyi, et autres
Publié: (2025)
par: Chen, Junyi, et autres
Publié: (2025)
Policy Frameworks for Transparent Chain-of-Thought Reasoning in Large Language Models
par: Chen, Yihang, et autres
Publié: (2025)
par: Chen, Yihang, et autres
Publié: (2025)
Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model
par: Ma, Ziyang, et autres
Publié: (2025)
par: Ma, Ziyang, et autres
Publié: (2025)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
par: Ye, Jiacheng, et autres
Publié: (2024)
par: Ye, Jiacheng, et autres
Publié: (2024)
BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning
par: Xu, Yuhang, et autres
Publié: (2026)
par: Xu, Yuhang, et autres
Publié: (2026)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
par: Cui, Yingqian, et autres
Publié: (2025)
par: Cui, Yingqian, et autres
Publié: (2025)
Automated Privacy Information Annotation in Large Language Model Interactions
par: Zeng, Hang, et autres
Publié: (2025)
par: Zeng, Hang, et autres
Publié: (2025)
Long-Short Chain-of-Thought Mixture Supervised Fine-Tuning Eliciting Efficient Reasoning in Large Language Models
par: Yu, Bin, et autres
Publié: (2025)
par: Yu, Bin, et autres
Publié: (2025)
Injecting Salesperson's Dialogue Strategies in Large Language Models with Chain-of-Thought Reasoning
par: Chang, Wen-Yu, et autres
Publié: (2024)
par: Chang, Wen-Yu, et autres
Publié: (2024)
GraphThinker: Reinforcing Temporally Grounded Video Reasoning with Event Graph Thinking
par: Cheng, Zixu, et autres
Publié: (2026)
par: Cheng, Zixu, et autres
Publié: (2026)
Pre$^3$: Enabling Deterministic Pushdown Automata for Faster Structured LLM Generation
par: Chen, Junyi, et autres
Publié: (2025)
par: Chen, Junyi, et autres
Publié: (2025)
Training Large Reasoning Models Efficiently via Progressive Thought Encoding
par: Zhang, Zeliang, et autres
Publié: (2026)
par: Zhang, Zeliang, et autres
Publié: (2026)
Rethinking Chain-of-Thought Reasoning for Videos
par: Zhong, Yiwu, et autres
Publié: (2025)
par: Zhong, Yiwu, et autres
Publié: (2025)
Documents similaires
-
SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control
par: He, Xingyang, et autres
Publié: (2025) -
Nova: Real-Time Agentic Vision-Language Model Serving with Adaptive Cross-Stage Parallelization
par: Xu, Yuhang, et autres
Publié: (2025) -
RouteGoT: Node-Adaptive Routing for Cost-Efficient Graph of Thoughts Reasoning
par: Liu, Yuhang, et autres
Publié: (2026) -
Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning
par: Jiang, Qing, et autres
Publié: (2025) -
ABO: Abandon Bayer Filter for Adaptive Edge Offloading in Responsive Augmented Reality
par: Han, Yongxuan, et autres
Publié: (2025)