Learning Without Critics? Revisiting GRPO in Classical Reinforcement Learning Environments

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: de Oliveira, Bryan L. M., Frujeri, Felipe V., Queiroz, Marcos P. C. M., Martins, Luana G. B., Soares, Telma W. de L., Melo, Luckeciano C.
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!