Du, D., Liu, S., Yang, T., Chen, S., & Li, Y. (2025). UloRL: An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities.
Citazione stile Chigago Style (17a edizione)Du, Dong, Shulin Liu, Tao Yang, Shaohua Chen, e Yang Li. UloRL: An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities. 2025.
Citatione MLA (9a ed.)Du, Dong, et al. UloRL: An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities. 2025.
Attenzione: Queste citazioni potrebbero non essere precise al 100%.