Training Vision-Language Process Reward Models for Test-Time Scaling in Multimodal Reasoning: Key Insights and Lessons Learned

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Ong, Brandon, Pala, Tej Deep, Toh, Vernon, Tjhi, William Chandra, Poria, Soujanya
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!