AI Alignment through Reinforcement Learning from Human Feedback? Contradictions and Limitations

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Lindström, Adam Dahlgren, Methnani, Leila, Krause, Lea, Ericson, Petter, de Troya, Íñigo Martínez de Rituerto, Mollo, Dimitri Coelho, Dobbe, Roel
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!