APA (7th ed.) Citation

Karaman, B. K., Rawal, A., Shakiah, S., Ghavamzadeh, M., Hong, M., Biswas, A., & Zhou, R. (2026). DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning.

Chicago Style (17th ed.) Citation

Karaman, Batuhan K., Aditya Rawal, Suhaila Shakiah, Mohammad Ghavamzadeh, Mingyi Hong, Arijit Biswas, and Ruida Zhou. DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning. 2026.

MLA (9th ed.) Citation

Karaman, Batuhan K., et al. DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning. 2026.

Warning: These citations may not always be 100% accurate.