Vision Model Pre-training on Interleaved Image-Text Data via Latent Compression Learning

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Yang, Chenyu, Zhu, Xizhou, Zhu, Jinguo, Su, Weijie, Wang, Junjie, Dong, Xuan, Wang, Wenhai, Lu, Lewei, Li, Bin, Zhou, Jie, Qiao, Yu, Dai, Jifeng
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!