He, L., Shi, T., Huang, P., Chen, B., Chen, Q., & Pan, J. (2024). Role-RL: Online Long-Context Processing with Role Reinforcement Learning for Distinct LLMs in Their Optimal Roles.
Cita Chicago Style (17a ed.)He, Lewei, Tianyu Shi, Pengran Huang, Bingzhi Chen, Qianglong Chen, y Jiahui Pan. Role-RL: Online Long-Context Processing with Role Reinforcement Learning for Distinct LLMs in Their Optimal Roles. 2024.
Cita MLA (9a ed.)He, Lewei, et al. Role-RL: Online Long-Context Processing with Role Reinforcement Learning for Distinct LLMs in Their Optimal Roles. 2024.
Precaución: Estas citas no son 100% exactas.