Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Wang, Siwei, Shen, Yifei, Sun, Haoran, Feng, Shi, Teng, Shang-Hua, Dong, Li, Hao, Yaru, Chen, Wei
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!