Video-LaVIT: Unified Video-Language Pre-training with Decoupled Visual-Motional Tokenization

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Jin, Yang, Sun, Zhicheng, Xu, Kun, Chen, Liwei, Jiang, Hao, Huang, Quzhe, Song, Chengru, Liu, Yuliang, Zhang, Di, Song, Yang, Gai, Kun, Mu, Yadong
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!