R-Align: Enhancing Generative Reward Models through Rationale-Centric Meta-Judging

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Lai, Yanlin, Huang, Mitt, Guo, Hangyu, Wang, Xiangfeng, Li, Haodong, Zhan, Shaoxiong, Zhao, Liang, Yao, Chengyuan, Zhang, Yinmin, Han, Qi, Yuan, Chun, Ge, Zheng, Zhang, Xiangyu, Jiang, Daxin
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!