Comparing Bad Apples to Good Oranges: Aligning Large Language Models via Joint Preference Optimization

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Bansal, Hritik, Suvarna, Ashima, Bhatt, Gantavya, Peng, Nanyun, Chang, Kai-Wei, Grover, Aditya
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires