Boosting Virtual Agent Learning and Reasoning: A Step-Wise, Multi-Dimensional, and Generalist Reward Model with Benchmark

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Miao, Bingchen, Wu, Yang, Gao, Minghe, Yu, Qifan, Bu, Wendong, Zhang, Wenqiao, Li, Yunfei, Tang, Siliang, Chua, Tat-Seng, Li, Juncheng
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires