RLKD: Distilling LLMs' Reasoning via Reinforcement Learning

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Xu, Shicheng, Pang, Liang, Zhu, Yunchang, Gu, Jia, Wei, Zihao, Deng, Jingcheng, Pan, Feiyang, Shen, Huawei, Cheng, Xueqi
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!