Style de citation APA (7e éd.)

Hong, H., Yan, Y., Wu, X., Hou, G., Zhang, W., Lu, W., . . . Xiao, J. (2025). Cooper: Co-Optimizing Policy and Reward Models in Reinforcement Learning for Large Language Models.

Style de citation Chicago (17e éd.)

Hong, Haitao, Yuchen Yan, Xingyu Wu, Guiyang Hou, Wenqi Zhang, Weiming Lu, Yongliang Shen, et Jun Xiao. Cooper: Co-Optimizing Policy and Reward Models in Reinforcement Learning for Large Language Models. 2025.

Style de citation MLA (9e éd.)

Hong, Haitao, et al. Cooper: Co-Optimizing Policy and Reward Models in Reinforcement Learning for Large Language Models. 2025.

Attention : ces citations peuvent ne pas être correctes à 100%.