Wang, H., Wu, Z., Kolar, G., Korsapati, H., Bartlett, B., Hull, B., & Sun, J. (2025). Reinforcement Learning for Out-of-Distribution Reasoning in LLMs: An Empirical Study on Diagnosis-Related Group Coding.
Cita Chicago Style (17a ed.)Wang, Hanyin, Zhenbang Wu, Gururaj Kolar, Hariprasad Korsapati, Brian Bartlett, Bryan Hull, y Jimeng Sun. Reinforcement Learning for Out-of-Distribution Reasoning in LLMs: An Empirical Study on Diagnosis-Related Group Coding. 2025.
Cita MLA (9a ed.)Wang, Hanyin, et al. Reinforcement Learning for Out-of-Distribution Reasoning in LLMs: An Empirical Study on Diagnosis-Related Group Coding. 2025.
Precaución: Estas citas no son 100% exactas.