Zhang, X., Wang, J., Cheng, Z., Zhuang, W., Lin, Z., Zhang, M., . . . Yu, B. (2025). SRPO: A Cross-Domain Implementation of Large-Scale Reinforcement Learning on LLM.
Cita Chicago Style (17a ed.)Zhang, Xiaojiang, et al. SRPO: A Cross-Domain Implementation of Large-Scale Reinforcement Learning on LLM. 2025.
Cita MLA (9a ed.)Zhang, Xiaojiang, et al. SRPO: A Cross-Domain Implementation of Large-Scale Reinforcement Learning on LLM. 2025.
Precaución: Estas citas no son 100% exactas.