Mitigating Distribution Shift in Model-based Offline RL via Shifts-aware Reward Learning

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Luo, Wang, Li, Haoran, Zhang, Zicheng, Han, Congying, Zhou, Chi, Lv, Jiayu, Guo, Tiande
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!