A Short Survey on Small Reasoning Models: Training, Inference, Applications and Research Directions
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Chengyu, Zhang, Taolin, Hong, Richang, Huang, Jun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
An Information-Theoretic Framework for Robust Large Language Model Editing
von: Chen, Qizhou, et al.
Veröffentlicht: (2025)
von: Chen, Qizhou, et al.
Veröffentlicht: (2025)
Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment
von: Cai, Wenrui, et al.
Veröffentlicht: (2025)
von: Cai, Wenrui, et al.
Veröffentlicht: (2025)
HAPO: Training Language Models to Reason Concisely via History-Aware Policy Optimization
von: Huang, Chengyu, et al.
Veröffentlicht: (2025)
von: Huang, Chengyu, et al.
Veröffentlicht: (2025)
Thinking with DistilQwen: A Tale of Four Distilled Reasoning and Reward Model Series
von: Cai, Wenrui, et al.
Veröffentlicht: (2025)
von: Cai, Wenrui, et al.
Veröffentlicht: (2025)
Reasoning with OmniThought: A Large CoT Dataset with Verbosity and Cognitive Difficulty Annotations
von: Cai, Wenrui, et al.
Veröffentlicht: (2025)
von: Cai, Wenrui, et al.
Veröffentlicht: (2025)
Do Large Language Models Understand Logic or Just Mimick Context?
von: Yan, Junbing, et al.
Veröffentlicht: (2024)
von: Yan, Junbing, et al.
Veröffentlicht: (2024)
Speculative Thinking: Enhancing Small-Model Reasoning with Large Model Guidance at Inference Time
von: Yang, Wang, et al.
Veröffentlicht: (2025)
von: Yang, Wang, et al.
Veröffentlicht: (2025)
Big Reasoning with Small Models: Instruction Retrieval at Inference Time
von: Alkiek, Kenan, et al.
Veröffentlicht: (2025)
von: Alkiek, Kenan, et al.
Veröffentlicht: (2025)
From Correction to Mastery: Reinforced Distillation of Large Language Model Agents
von: Lyu, Yuanjie, et al.
Veröffentlicht: (2025)
von: Lyu, Yuanjie, et al.
Veröffentlicht: (2025)
ReasoningGuard: Safeguarding Large Reasoning Models with Inference-time Safety Aha Moments
von: Wang, Yuquan, et al.
Veröffentlicht: (2025)
von: Wang, Yuquan, et al.
Veröffentlicht: (2025)
A Survey on Efficient Inference for Large Language Models
von: Zhou, Zixuan, et al.
Veröffentlicht: (2024)
von: Zhou, Zixuan, et al.
Veröffentlicht: (2024)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
von: Wang, Jingyuan, et al.
Veröffentlicht: (2025)
von: Wang, Jingyuan, et al.
Veröffentlicht: (2025)
EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models
von: Wang, Chengyu, et al.
Veröffentlicht: (2025)
von: Wang, Chengyu, et al.
Veröffentlicht: (2025)
MolQuest: A Benchmark for Agentic Evaluation of Abductive Reasoning in Chemical Structure Elucidation
von: Han, Taolin, et al.
Veröffentlicht: (2026)
von: Han, Taolin, et al.
Veröffentlicht: (2026)
A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems
von: Ke, Zixuan, et al.
Veröffentlicht: (2025)
von: Ke, Zixuan, et al.
Veröffentlicht: (2025)
JiuZhang3.0: Efficiently Improving Mathematical Reasoning by Training Small Data Synthesis Models
von: Zhou, Kun, et al.
Veröffentlicht: (2024)
von: Zhou, Kun, et al.
Veröffentlicht: (2024)
CompassJudger-2: Towards Generalist Judge Model via Verifiable Rewards
von: Zhang, Taolin, et al.
Veröffentlicht: (2025)
von: Zhang, Taolin, et al.
Veröffentlicht: (2025)
Deciphering Trajectory-Aided LLM Reasoning: An Optimization Perspective
von: Liu, Junnan, et al.
Veröffentlicht: (2025)
von: Liu, Junnan, et al.
Veröffentlicht: (2025)
Efficient Reasoning Models: A Survey
von: Feng, Sicheng, et al.
Veröffentlicht: (2025)
von: Feng, Sicheng, et al.
Veröffentlicht: (2025)
QueueEDIT: Structural Self-Correction for Sequential Model Editing in LLMs
von: Zhang, Taolin, et al.
Veröffentlicht: (2025)
von: Zhang, Taolin, et al.
Veröffentlicht: (2025)
Biomedical Relation Extraction via Adaptive Document-Relation Cross-Mapping and Concept Unique Identifier
von: Shang, Yufei, et al.
Veröffentlicht: (2025)
von: Shang, Yufei, et al.
Veröffentlicht: (2025)
Large Language Models and Causal Inference in Collaboration: A Survey
von: Liu, Xiaoyu, et al.
Veröffentlicht: (2024)
von: Liu, Xiaoyu, et al.
Veröffentlicht: (2024)
Coding Triangle: How Does Large Language Model Understand Code?
von: Zhang, Taolin, et al.
Veröffentlicht: (2025)
von: Zhang, Taolin, et al.
Veröffentlicht: (2025)
On the Trustworthiness Landscape of State-of-the-art Generative Models: A Survey and Outlook
von: Fan, Mingyuan, et al.
Veröffentlicht: (2023)
von: Fan, Mingyuan, et al.
Veröffentlicht: (2023)
A Survey of Inductive Reasoning for Large Language Models
von: Chen, Kedi, et al.
Veröffentlicht: (2025)
von: Chen, Kedi, et al.
Veröffentlicht: (2025)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
von: Xu, Fengli, et al.
Veröffentlicht: (2025)
von: Xu, Fengli, et al.
Veröffentlicht: (2025)
Decoupling Understanding from Reasoning via Problem Space Mapping for Small-Scale Model Reasoning
von: Wang, Li, et al.
Veröffentlicht: (2025)
von: Wang, Li, et al.
Veröffentlicht: (2025)
Logical Reasoning in Large Language Models: A Survey
von: Liu, Hanmeng, et al.
Veröffentlicht: (2025)
von: Liu, Hanmeng, et al.
Veröffentlicht: (2025)
Knowledgeable In-Context Tuning: Exploring and Exploiting Factual Knowledge for In-Context Learning
von: Wang, Jianing, et al.
Veröffentlicht: (2023)
von: Wang, Jianing, et al.
Veröffentlicht: (2023)
Direct Value Optimization: Improving Chain-of-Thought Reasoning in LLMs with Refined Values
von: Zhang, Hongbo, et al.
Veröffentlicht: (2025)
von: Zhang, Hongbo, et al.
Veröffentlicht: (2025)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
von: Xie, Congkai, et al.
Veröffentlicht: (2025)
von: Xie, Congkai, et al.
Veröffentlicht: (2025)
A Survey on Large Language Models for Mathematical Reasoning
von: Wang, Peng-Yuan, et al.
Veröffentlicht: (2025)
von: Wang, Peng-Yuan, et al.
Veröffentlicht: (2025)
Better LLM Reasoning via Dual-Play
von: Zhang, Zhengxin, et al.
Veröffentlicht: (2025)
von: Zhang, Zhengxin, et al.
Veröffentlicht: (2025)
The Reasoning-Memorization Interplay in Language Models Is Mediated by a Single Direction
von: Hong, Yihuai, et al.
Veröffentlicht: (2025)
von: Hong, Yihuai, et al.
Veröffentlicht: (2025)
Harnessing the Reasoning Economy: A Survey of Efficient Reasoning for Large Language Models
von: Wang, Rui, et al.
Veröffentlicht: (2025)
von: Wang, Rui, et al.
Veröffentlicht: (2025)
Data Management For Training Large Language Models: A Survey
von: Wang, Zige, et al.
Veröffentlicht: (2023)
von: Wang, Zige, et al.
Veröffentlicht: (2023)
Distilling Mathematical Reasoning Capabilities into Small Language Models
von: Zhu, Xunyu, et al.
Veröffentlicht: (2024)
von: Zhu, Xunyu, et al.
Veröffentlicht: (2024)
Evaluating and Improving Robustness in Large Language Models: A Survey and Future Directions
von: Zhang, Kun, et al.
Veröffentlicht: (2025)
von: Zhang, Kun, et al.
Veröffentlicht: (2025)
Efficient Long CoT Reasoning in Small Language Models
von: Wang, Zhaoyang, et al.
Veröffentlicht: (2025)
von: Wang, Zhaoyang, et al.
Veröffentlicht: (2025)
Causal Inference with Large Language Model: A Survey
von: Ma, Jing
Veröffentlicht: (2024)
von: Ma, Jing
Veröffentlicht: (2024)
Ähnliche Einträge
-
An Information-Theoretic Framework for Robust Large Language Model Editing
von: Chen, Qizhou, et al.
Veröffentlicht: (2025) -
Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment
von: Cai, Wenrui, et al.
Veröffentlicht: (2025) -
HAPO: Training Language Models to Reason Concisely via History-Aware Policy Optimization
von: Huang, Chengyu, et al.
Veröffentlicht: (2025) -
Thinking with DistilQwen: A Tale of Four Distilled Reasoning and Reward Model Series
von: Cai, Wenrui, et al.
Veröffentlicht: (2025) -
Reasoning with OmniThought: A Large CoT Dataset with Verbosity and Cognitive Difficulty Annotations
von: Cai, Wenrui, et al.
Veröffentlicht: (2025)