Long-VITA: Scaling Large Multi-modal Models to 1 Million Tokens with Leading Short-Context Accuracy

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Shen, Yunhang, Fu, Chaoyou, Dong, Shaoqi, Wang, Xiong, Zhang, Yi-Fan, Chen, Peixian, Zhang, Mengdan, Cao, Haoyu, Li, Ke, Lin, Shaohui, Zheng, Xiawu, Zhang, Yan, Zhou, Yiyi, He, Ran, Shan, Caifeng, Ji, Rongrong, Sun, Xing
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!