VTPerception-R1: Enhancing Multimodal Reasoning via Explicit Visual and Textual Perceptual Grounding

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Ding, Yizhuo, Chen, Mingkang, Feng, Zhibang, Xiao, Tong, Qu, Wanying, Shao, Wenqi, Fu, Yanwei
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!