Tan, Y., Wang, M., Liu, B., Liu, Z., Liang, T., He, S., . . . Liu, K. (2026). From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space.
Cita Chicago Style (17a ed.)Tan, Yuqiao, Minzheng Wang, Bo Liu, Zichen Liu, Tian Liang, Shizhu He, Jun Zhao, y Kang Liu. From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space. 2026.
Cita MLA (9a ed.)Tan, Yuqiao, et al. From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space. 2026.
Precaución: Estas citas no son 100% exactas.