HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Peng, Jiangweizhi, Liu, Yuanxin, Zhou, Ruida, Fleming, Charles, Wang, Zhaoran, Garcia, Alfredo, Hong, Mingyi
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi