TokLIP: Marry Visual Tokens to CLIP for Multimodal Comprehension and Generation

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Lin, Haokun, Wang, Teng, Ge, Yixiao, Ge, Yuying, Lu, Zhichao, Wei, Ying, Zhang, Qingfu, Sun, Zhenan, Shan, Ying
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!