SPLASH! Sample-efficient Preference-based inverse reinforcement learning for Long-horizon Adversarial tasks from Suboptimal Hierarchical demonstrations

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Crowley, Peter, Serlin, Zachary, Paine, Tyler, Mann, Makai, Benjamin, Michael, Belta, Calin
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares