Xie, Y., Ren, X., Qi, Y., Hu, Y., & Shan, L. (2025). RecLLM-R1: A Two-Stage Training Paradigm with Reinforcement Learning and Chain-of-Thought v1.
Cita Chicago Style (17a ed.)Xie, Yu, Xingkai Ren, Ying Qi, Yao Hu, y Lianlei Shan. RecLLM-R1: A Two-Stage Training Paradigm with Reinforcement Learning and Chain-of-Thought V1. 2025.
Cita MLA (9a ed.)Xie, Yu, et al. RecLLM-R1: A Two-Stage Training Paradigm with Reinforcement Learning and Chain-of-Thought V1. 2025.
Precaución: Estas citas no son 100% exactas.