Reasoning-preserved Efficient Distillation of Large Language Models via Activation-aware Initialization

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: He, Junlin, Tang, Yihong, Nie, Tong, Li, Guilong, Yang, Binyu, Du, Jinxiao, Sun, Lijun, Ma, Wei
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!