Crowley, P., Serlin, Z., Paine, T., Mann, M., Benjamin, M., & Belta, C. (2025). SPLASH! Sample-efficient Preference-based inverse reinforcement learning for Long-horizon Adversarial tasks from Suboptimal Hierarchical demonstrations.
Chicago-Zitierstil (17. Ausg.)Crowley, Peter, Zachary Serlin, Tyler Paine, Makai Mann, Michael Benjamin, und Calin Belta. SPLASH! Sample-efficient Preference-based Inverse Reinforcement Learning for Long-horizon Adversarial Tasks from Suboptimal Hierarchical Demonstrations. 2025.
MLA-Zitierstil (9. Ausg.)Crowley, Peter, et al. SPLASH! Sample-efficient Preference-based Inverse Reinforcement Learning for Long-horizon Adversarial Tasks from Suboptimal Hierarchical Demonstrations. 2025.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.