Structural Reward Model: Enhancing Interpretability, Efficiency, and Scalability in Reward Modeling

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Liu, Xiaoyu, Liang, Di, Dai, Chang, Shan, Hongyu, Liu, Peiyang, Liu, Yonghao, Wu, Muling, Li, Yuntao, Wu, Xianjie, Miao, LI, Shen, Jiangrong, Peng, Minlong
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!