Florence-VL: Enhancing Vision-Language Models with Generative Vision Encoder and Depth-Breadth Fusion

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Chen, Jiuhai, Yang, Jianwei, Wu, Haiping, Li, Dianqi, Gao, Jianfeng, Zhou, Tianyi, Xiao, Bin
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!