HoVLE: Unleashing the Power of Monolithic Vision-Language Models with Holistic Vision-Language Embedding

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Tao, Chenxin, Su, Shiqian, Zhu, Xizhou, Zhang, Chenyu, Chen, Zhe, Liu, Jiawen, Wang, Wenhai, Lu, Lewei, Huang, Gao, Qiao, Yu, Dai, Jifeng
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!