Zhang, X., Yuan, X., Huang, D., You, W., Hu, C., Ruan, J., . . . Hu, X. (2025). Revisiting Entropy Regularization: Adaptive Coefficient Unlocks Its Potential for LLM Reinforcement Learning.
Style de citation Chicago (17e éd.)Zhang, Xiaoyun, Xiaojian Yuan, Di Huang, Wang You, Chen Hu, Jingqing Ruan, Ai Jian, Kejiang Chen, et Xing Hu. Revisiting Entropy Regularization: Adaptive Coefficient Unlocks Its Potential for LLM Reinforcement Learning. 2025.
Style de citation MLA (9e éd.)Zhang, Xiaoyun, et al. Revisiting Entropy Regularization: Adaptive Coefficient Unlocks Its Potential for LLM Reinforcement Learning. 2025.
Attention : ces citations peuvent ne pas être correctes à 100%.