LLaVA-VSD: Large Language-and-Vision Assistant for Visual Spatial Description

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Jin, Yizhang, Li, Jian, Zhang, Jiangning, Hu, Jianlong, Gan, Zhenye, Tan, Xin, Liu, Yong, Wang, Yabiao, Wang, Chengjie, Ma, Lizhuang
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!