Enhancing Visual Grounding and Generalization: A Multi-Task Cycle Training Approach for Vision-Language Models

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Yang, Xiaoyu, Xu, Lijian, Sun, Hao, Li, Hongsheng, Zhang, Shaoting
Format: Preprint
Published: 2023
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!