Omni-RRM: Advancing Omni Reward Modeling via Automatic Rubric-Grounded Preference Synthesis

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Kong, Zicheng, Ma, Dehua, Xu, Zhenbo, Yang, Alven, Ru, Yiwei, Wang, Haoran, Zhou, Zixuan, Bie, Fuqing, Xiang, Liuyu, Wu, Huijia, Zhao, Jian, He, Zhaofeng
Format: Preprint
Published: 2026
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!