Reward Modeling from Natural Language Human Feedback

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Wang, Zongqi, Wang, Rui, Wu, Yuchuan, Yu, Yiyao, Zhang, Pinyi, Sun, Shaoning, Yang, Yujiu, Li, Yongbin
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!