iGVLM: Dynamic Instruction-Guided Vision Encoding for Question-Aware Multimodal Understanding

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Liu, Hanpeng, Li, Yaqian, Wang, Zidan, Zhang, Shuoxi, Bo, Zihao, Takezoe, Rinyoichi, Long, Kaiwen, He, Kun
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires