Learning Without Critics? Revisiting GRPO in Classical Reinforcement Learning Environments

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: de Oliveira, Bryan L. M., Frujeri, Felipe V., Queiroz, Marcos P. C. M., Martins, Luana G. B., Soares, Telma W. de L., Melo, Luckeciano C.
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi