Joint Reward Modeling: Internalizing Chain-of-Thought for Efficient Visual Reward Models

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Yang, Yankai, Long, Yancheng, Wei, Hongyang, Chen, Wei, Zhang, Tianke, Jiang, Kaiyu, Fan, Haonan, Liu, Changyi, Chen, Jiankang, Tang, Kaiyu, Wen, Bin, Yang, Fan, Gao, Tingting, Li, Han, Yang, Shuo
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!