Chen, H., Liang, T., Zheng, W., & Hu, J. (2026). Breaking $\textit{Winner-Takes-All}$: Cooperative Policy Optimization Improves Diverse LLM Reasoning.
Chicago Style (17th ed.) CitationChen, Haoxuan, Tianming Liang, Wei-Shi Zheng, and Jian-Fang Hu. Breaking $\textit{Winner-Takes-All}$: Cooperative Policy Optimization Improves Diverse LLM Reasoning. 2026.
MLA (9th ed.) CitationChen, Haoxuan, et al. Breaking $\textit{Winner-Takes-All}$: Cooperative Policy Optimization Improves Diverse LLM Reasoning. 2026.
Warning: These citations may not always be 100% accurate.