ExpVG: Investigating the Design Space of Visual Grounding in Multimodal Large Language Model

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Kang, Weitai, Zhuang, Weiming, Li, Zhizhong, Yan, Yan, Lyu, Lingjuan
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!