Srinivasan, P., & Knottenbelt, W. (2025). Behavior Preference Regression for Offline Reinforcement Learning.
Chicago-Zitierstil (17. Ausg.)Srinivasan, Padmanaba, und William Knottenbelt. Behavior Preference Regression for Offline Reinforcement Learning. 2025.
MLA-Zitierstil (9. Ausg.)Srinivasan, Padmanaba, und William Knottenbelt. Behavior Preference Regression for Offline Reinforcement Learning. 2025.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.