VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Fu, Chaoyou, Lin, Haojia, Wang, Xiong, Zhang, Yi-Fan, Shen, Yunhang, Liu, Xiaoyu, Cao, Haoyu, Long, Zuwei, Gao, Heting, Li, Ke, Ma, Long, Zheng, Xiawu, Ji, Rongrong, Sun, Xing, Shan, Caifeng, He, Ran
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!