Visual Question Decomposition on Multimodal Large Language Models

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Zhang, Haowei, Liu, Jianzhe, Han, Zhen, Chen, Shuo, He, Bailan, Tresp, Volker, Xu, Zhiqiang, Gu, Jindong
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!