Step-wise Adaptive Integration of Supervised Fine-tuning and Reinforcement Learning for Task-Specific LLMs

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Chen, Jack, Liu, Fazhong, Liu, Naruto, Luo, Yuhan, Qin, Erqu, Zheng, Harry, Dong, Tian, Zhu, Haojin, Meng, Yan, Wang, Xiao
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares