MMFuser: Multimodal Multi-Layer Feature Fuser for Fine-Grained Vision-Language Understanding

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Cao, Yue, Liu, Yangzhou, Chen, Zhe, Shi, Guangchen, Wang, Wenhai, Zhao, Danhuai, Lu, Tong
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires