Step-wise Adaptive Integration of Supervised Fine-tuning and Reinforcement Learning for Task-Specific LLMs

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Chen, Jack, Liu, Fazhong, Liu, Naruto, Luo, Yuhan, Qin, Erqu, Zheng, Harry, Dong, Tian, Zhu, Haojin, Meng, Yan, Wang, Xiao
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!