Ground-V: Teaching VLMs to Ground Complex Instructions in Pixels

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Zong, Yongshuo, Zhang, Qin, An, Dongsheng, Li, Zhihua, Xu, Xiang, Xu, Linghan, Tu, Zhuowen, Xing, Yifan, Dabeer, Onkar
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!