Preference learning in shades of gray: Interpretable and bias-aware reward modeling for human preferences

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Oprea, Simona-Vasilica, Bâra, Adela
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires