LLaVA-SpaceSGG: Visual Instruct Tuning for Open-vocabulary Scene Graph Generation with Enhanced Spatial Relations

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Xu, Mingjie, Wu, Mengyang, Zhao, Yuzhi, Li, Jason Chun Lok, Ou, Weifeng
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!