APA-Zitierstil (7. Ausg.)

Wang, Q., Zhao, X., Zhang, Z., Lou, Z., Chen, N., Song, D., & He, B. (2026). Making Bias Non-Predictive: Training Robust LLM Reasoning via Reinforcement Learning.

Chicago-Zitierstil (17. Ausg.)

Wang, Qian, Xuandong Zhao, Zirui Zhang, Zhanzhi Lou, Nuo Chen, Dawn Song, und Bingsheng He. Making Bias Non-Predictive: Training Robust LLM Reasoning via Reinforcement Learning. 2026.

MLA-Zitierstil (9. Ausg.)

Wang, Qian, et al. Making Bias Non-Predictive: Training Robust LLM Reasoning via Reinforcement Learning. 2026.

Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.