Style de citation APA (7e éd.)

Bao, Q., Leinonen, J., Denny, P., & Witbrock, M. J. (2026). RLearner-LLM: Balancing Logical Grounding and Fluency in Large Language Models via Hybrid Direct Preference Optimization.

Style de citation Chicago (17e éd.)

Bao, Qiming, Juho Leinonen, Paul Denny, et Michael J. Witbrock. RLearner-LLM: Balancing Logical Grounding and Fluency in Large Language Models via Hybrid Direct Preference Optimization. 2026.

Style de citation MLA (9e éd.)

Bao, Qiming, et al. RLearner-LLM: Balancing Logical Grounding and Fluency in Large Language Models via Hybrid Direct Preference Optimization. 2026.

Attention : ces citations peuvent ne pas être correctes à 100%.