Learning Infinite-Horizon Average-Reward Linear Mixture MDPs of Bounded Span

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Chae, Woojin, Hong, Kihyuk, Zhang, Yufan, Tewari, Ambuj, Lee, Dabeen
Format: Preprint
Veröffentlicht: 2024
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!

Ähnliche Einträge