Teaching Large Language Models to Maintain Contextual Faithfulness via Synthetic Tasks and Reinforcement Learning

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Si, Shuzheng, Zhao, Haozhe, Gao, Cheng, Bai, Yuzhuo, Wang, Zhitong, Gao, Bofei, Luo, Kangyang, Li, Wenhao, Huang, Yufei, Chen, Gang, Qi, Fanchao, Zhang, Minjia, Chang, Baobao, Sun, Maosong
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!