Wang, Y., Yang, Q., Zeng, Z., Ren, L., Liu, L., Peng, B., . . . Shen, Y. (2025). Reinforcement Learning for Reasoning in Large Language Models with One Training Example.
Cita Chicago Style (17a ed.)Wang, Yiping, et al. Reinforcement Learning for Reasoning in Large Language Models with One Training Example. 2025.
Cita MLA (9a ed.)Wang, Yiping, et al. Reinforcement Learning for Reasoning in Large Language Models with One Training Example. 2025.
Precaución: Estas citas no son 100% exactas.