Joint Reward Modeling: Internalizing Chain-of-Thought for Efficient Visual Reward Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Yang, Yankai, Long, Yancheng, Wei, Hongyang, Chen, Wei, Zhang, Tianke, Jiang, Kaiyu, Fan, Haonan, Liu, Changyi, Chen, Jiankang, Tang, Kaiyu, Wen, Bin, Yang, Fan, Gao, Tingting, Li, Han, Yang, Shuo
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares