Du, D., Liu, S., Yang, T., Chen, S., & Li, Y. (2025). UloRL: An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities.
Chicago Style (17th ed.) CitationDu, Dong, Shulin Liu, Tao Yang, Shaohua Chen, and Yang Li. UloRL: An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities. 2025.
MLA (9th ed.) CitationDu, Dong, et al. UloRL: An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities. 2025.
Warning: These citations may not always be 100% accurate.