Agrawal, P., & Agrawal, S. (2024). Optimistic Q-learning for average reward and episodic reinforcement learning.
Chicago-Zitierstil (17. Ausg.)Agrawal, Priyank, und Shipra Agrawal. Optimistic Q-learning for Average Reward and Episodic Reinforcement Learning. 2024.
MLA-Zitierstil (9. Ausg.)Agrawal, Priyank, und Shipra Agrawal. Optimistic Q-learning for Average Reward and Episodic Reinforcement Learning. 2024.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.