Dong, J., Guo, M., Fang, E. X., Yang, Z., & Tarokh, V. (2026). In-Context Reinforcement Learning From Suboptimal Historical Data.
Chicago-Zitierstil (17. Ausg.)Dong, Juncheng, Moyang Guo, Ethan X. Fang, Zhuoran Yang, und Vahid Tarokh. In-Context Reinforcement Learning From Suboptimal Historical Data. 2026.
MLA-Zitierstil (9. Ausg.)Dong, Juncheng, et al. In-Context Reinforcement Learning From Suboptimal Historical Data. 2026.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.