StructVRM: Aligning Multimodal Reasoning with Structured and Verifiable Reward Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Zhang, Xiangxiang, Wei, Jingxuan, Zhong, Donghong, Chen, Qi, Jia, Caijun, Tan, Cheng, Gu, Jinming, Qin, Xiaobo, Liu, Zhiping, Hu, Liang, Sun, Tong, Wu, Yuchen, Sun, Zewei, Lou, Chenwei, Zheng, Hua, Zhan, Tianyang, Wang, Changbao, Wu, Shuangzhi, Lin, Zefa, Guo, Chang, Yuan, Sihang, Chen, Riwei, Zhao, Shixiong, Zhang, Yingping, Wu, Gaowei, Yu, Bihui, Wu, Jiahui, Zhao, Zhehui, Liu, Qianqian, Tang, Ruofeng, Huang, Xingyue, Zhao, Bing, Zhang, Mengyang, Zhou, Youqiang
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares