FutureMind: Equipping Small Language Models with Strategic Thinking-Pattern Priors via Adaptive Knowledge Distillation
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Shaoxiong, Li, Junting, Zhang, Mengyuan, Li, Chao, Liu, Wei, Luan, Jian |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
End-to-End Optimization of LLM-Driven Multi-Agent Search Systems via Heterogeneous-Group-Based Reinforcement Learning
by: Chen, Guanzhong, et al.
Published: (2025)
by: Chen, Guanzhong, et al.
Published: (2025)
Large Model Strategic Thinking, Small Model Efficiency: Transferring Theory of Mind in Large Language Models
by: Lore, Nunzio, et al.
Published: (2024)
by: Lore, Nunzio, et al.
Published: (2024)
Mind's Mirror: Distilling Self-Evaluation Capability and Comprehensive Thinking from Large Language Models
by: Liu, Weize, et al.
Published: (2023)
by: Liu, Weize, et al.
Published: (2023)
Distilling Mathematical Reasoning Capabilities into Small Language Models
by: Zhu, Xunyu, et al.
Published: (2024)
by: Zhu, Xunyu, et al.
Published: (2024)
ICPO: Intrinsic Confidence-Driven Group Relative Preference Optimization for Efficient Reinforcement Learning
by: Wang, Jinpeng, et al.
Published: (2025)
by: Wang, Jinpeng, et al.
Published: (2025)
DynamicMind: A Tri-Mode Thinking System for Large Language Models
by: Li, Wei, et al.
Published: (2025)
by: Li, Wei, et al.
Published: (2025)
SPAST: Arbitrary Style Transfer with Style Priors via Pre-trained Large-scale Model
by: Zhang, Zhanjie, et al.
Published: (2025)
by: Zhang, Zhanjie, et al.
Published: (2025)
MindShot: A Few-Shot Brain Decoding Framework via Transferring Cross-Subject Prior and Distilling Frequency Domain Knowledge
by: Jiang, Shuai, et al.
Published: (2024)
by: Jiang, Shuai, et al.
Published: (2024)
Knowledge Distillation and Dataset Distillation of Large Language Models: Emerging Trends, Challenges, and Future Directions
by: Fang, Luyang, et al.
Published: (2025)
by: Fang, Luyang, et al.
Published: (2025)
Overcoming Language Priors for Visual Question Answering Based on Knowledge Distillation
by: Peng, Daowan, et al.
Published: (2025)
by: Peng, Daowan, et al.
Published: (2025)
Distilling Reasoning Ability from Large Language Models with Adaptive Thinking
by: Chen, Xiaoshu, et al.
Published: (2024)
by: Chen, Xiaoshu, et al.
Published: (2024)
Improving Mathematical Reasoning Capabilities of Small Language Models via Feedback-Driven Distillation
by: Zhu, Xunyu, et al.
Published: (2024)
by: Zhu, Xunyu, et al.
Published: (2024)
Dynamic Frequency-Adaptive Knowledge Distillation for Speech Enhancement
by: Yuan, Xihao, et al.
Published: (2025)
by: Yuan, Xihao, et al.
Published: (2025)
LLM-Oriented Token-Adaptive Knowledge Distillation
by: Xie, Xurong, et al.
Published: (2025)
by: Xie, Xurong, et al.
Published: (2025)
Symbolic Chain-of-Thought Distillation: Small Models Can Also "Think" Step-by-Step
by: Li, Liunian Harold, et al.
Published: (2023)
by: Li, Liunian Harold, et al.
Published: (2023)
Prior Knowledge Distillation Network for Face Super-Resolution
by: Yang, Qiu, et al.
Published: (2024)
by: Yang, Qiu, et al.
Published: (2024)
Revealing the Power of Post-Training for Small Language Models via Knowledge Distillation
by: Rang, Miao, et al.
Published: (2025)
by: Rang, Miao, et al.
Published: (2025)
Learning with Semantic Priors: Stabilizing Point-Supervised Infrared Small Target Detection via Hierarchical Knowledge Distillation
by: Yao, Yuanhang, et al.
Published: (2026)
by: Yao, Yuanhang, et al.
Published: (2026)
Enhancing Adversarial Training with Prior Knowledge Distillation for Robust Image Compression
by: Cao, Zhi, et al.
Published: (2024)
by: Cao, Zhi, et al.
Published: (2024)
Direct Preference Knowledge Distillation for Large Language Models
by: Li, Yixing, et al.
Published: (2024)
by: Li, Yixing, et al.
Published: (2024)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
by: Liao, Huanxuan, et al.
Published: (2024)
by: Liao, Huanxuan, et al.
Published: (2024)
Knowledge Distillation with Multi-granularity Mixture of Priors for Image Super-Resolution
by: Li, Simiao, et al.
Published: (2024)
by: Li, Simiao, et al.
Published: (2024)
LCD: Advancing Extreme Low-Bit Clustering for Large Language Models via Knowledge Distillation
by: Liu, Fangxin, et al.
Published: (2025)
by: Liu, Fangxin, et al.
Published: (2025)
Equipped for the Future Program Materials.
Published: (1999)
Published: (1999)
Adaptive Softassign via Hadamard-Equipped Sinkhorn
by: Shen, Binrui, et al.
Published: (2023)
by: Shen, Binrui, et al.
Published: (2023)
Collaborative Adaptive Curriculum for Progressive Knowledge Distillation
by: Liu, Jing, et al.
Published: (2026)
by: Liu, Jing, et al.
Published: (2026)
Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models
by: Xing, Wang, et al.
Published: (2026)
by: Xing, Wang, et al.
Published: (2026)
Quantification of Large Language Model Distillation
by: Lee, Sunbowen, et al.
Published: (2025)
by: Lee, Sunbowen, et al.
Published: (2025)
Revisiting Knowledge Distillation for Autoregressive Language Models
by: Zhong, Qihuang, et al.
Published: (2024)
by: Zhong, Qihuang, et al.
Published: (2024)
Lightweight Plant Disease Detection With Adaptive Multi‐Scale Model and Relationship‐Based Knowledge Distillation
by: Wei Li, et al.
Published: (2025)
by: Wei Li, et al.
Published: (2025)
KG-Retriever: Efficient Knowledge Indexing for Retrieval-Augmented Large Language Models
by: Chen, Weijie, et al.
Published: (2024)
by: Chen, Weijie, et al.
Published: (2024)
RESURF Ga$_{2}$O$_{3}$-on-SiC Field Effect Transistors for Enhanced Breakdown Voltage
by: Chen, Junting, et al.
Published: (2024)
by: Chen, Junting, et al.
Published: (2024)
ToolRerank: Adaptive and Hierarchy-Aware Reranking for Tool Retrieval
by: Zheng, Yuanhang, et al.
Published: (2024)
by: Zheng, Yuanhang, et al.
Published: (2024)
Refine Knowledge of Large Language Models via Adaptive Contrastive Learning
by: Li, Yinghui, et al.
Published: (2025)
by: Li, Yinghui, et al.
Published: (2025)
AdapThink: Adaptive Thinking Preferences for Reasoning Language Model
by: Wan, Xu, et al.
Published: (2025)
by: Wan, Xu, et al.
Published: (2025)
To Think or Not To Think, That is The Question for Large Reasoning Models in Theory of Mind Tasks
by: Gong, Nanxu, et al.
Published: (2026)
by: Gong, Nanxu, et al.
Published: (2026)
DogeRM: Equipping Reward Models with Domain Knowledge through Model Merging
by: Lin, Tzu-Han, et al.
Published: (2024)
by: Lin, Tzu-Han, et al.
Published: (2024)
Pre-trained Language Model and Knowledge Distillation for Lightweight Sequential Recommendation
by: Li, Li, et al.
Published: (2024)
by: Li, Li, et al.
Published: (2024)
Quantum Knowledge Distillation for Large Language Models
by: Li, Lingxiao, et al.
Published: (2025)
by: Li, Lingxiao, et al.
Published: (2025)
Efficient Knowledge Distillation: Empowering Small Language Models with Teacher Model Insights
by: Ballout, Mohamad, et al.
Published: (2024)
by: Ballout, Mohamad, et al.
Published: (2024)
Similar Items
-
End-to-End Optimization of LLM-Driven Multi-Agent Search Systems via Heterogeneous-Group-Based Reinforcement Learning
by: Chen, Guanzhong, et al.
Published: (2025) -
Large Model Strategic Thinking, Small Model Efficiency: Transferring Theory of Mind in Large Language Models
by: Lore, Nunzio, et al.
Published: (2024) -
Mind's Mirror: Distilling Self-Evaluation Capability and Comprehensive Thinking from Large Language Models
by: Liu, Weize, et al.
Published: (2023) -
Distilling Mathematical Reasoning Capabilities into Small Language Models
by: Zhu, Xunyu, et al.
Published: (2024) -
ICPO: Intrinsic Confidence-Driven Group Relative Preference Optimization for Efficient Reinforcement Learning
by: Wang, Jinpeng, et al.
Published: (2025)