Operationalizing Pluralistic Values in Large Language Model Alignment Reveals Trade-offs in Safety, Inclusivity, and Model Behavior

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Ali, Dalia, Zhao, Dora, Koenecke, Allison, Papakyriakopoulos, Orestis
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!