GroundedPRM: Tree-Guided and Fidelity-Aware Process Reward Modeling for Step-Level Reasoning

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Zhang, Yao, Wu, Yu, Zhang, Haowei, Li, Weiguo, Chen, Haokun, Wu, Jingpei, Li, Guohao, Han, Zhen, Tresp, Volker
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!