Bao, Q., Leinonen, J., Denny, P., & Witbrock, M. J. (2026). RLearner-LLM: Balancing Logical Grounding and Fluency in Large Language Models via Hybrid Direct Preference Optimization.
Style de citation Chicago (17e éd.)Bao, Qiming, Juho Leinonen, Paul Denny, et Michael J. Witbrock. RLearner-LLM: Balancing Logical Grounding and Fluency in Large Language Models via Hybrid Direct Preference Optimization. 2026.
Style de citation MLA (9e éd.)Bao, Qiming, et al. RLearner-LLM: Balancing Logical Grounding and Fluency in Large Language Models via Hybrid Direct Preference Optimization. 2026.
Attention : ces citations peuvent ne pas être correctes à 100%.