Mitigating Distribution Shift in Model-based Offline RL via Shifts-aware Reward Learning

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Luo, Wang, Li, Haoran, Zhang, Zicheng, Han, Congying, Zhou, Chi, Lv, Jiayu, Guo, Tiande
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!