Deciphering Cross-Modal Alignment in Large Vision-Language Models with Modality Integration Rate

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Huang, Qidong, Dong, Xiaoyi, Zhang, Pan, Zang, Yuhang, Cao, Yuhang, Wang, Jiaqi, Lin, Dahua, Zhang, Weiming, Yu, Nenghai
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!