InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Wang, Yi, He, Yinan, Li, Yizhuo, Li, Kunchang, Yu, Jiashuo, Ma, Xin, Li, Xinhao, Chen, Guo, Chen, Xinyuan, Wang, Yaohui, He, Conghui, Luo, Ping, Liu, Ziwei, Wang, Yali, Wang, Limin, Qiao, Yu
Format: Preprint
Publié: 2023
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!