Style de citation APA (7e éd.)

Rafailov, R., Sharma, A., Mitchell, E., Ermon, S., Manning, C. D., & Finn, C. (2023). Direct Preference Optimization: Your Language Model is Secretly a Reward Model.

Style de citation Chicago (17e éd.)

Rafailov, Rafael, Archit Sharma, Eric Mitchell, Stefano Ermon, Christopher D. Manning, et Chelsea Finn. Direct Preference Optimization: Your Language Model Is Secretly a Reward Model. 2023.

Style de citation MLA (9e éd.)

Rafailov, Rafael, et al. Direct Preference Optimization: Your Language Model Is Secretly a Reward Model. 2023.

Attention : ces citations peuvent ne pas être correctes à 100%.