Harnessing Vision-Language Pretrained Models with Temporal-Aware Adaptation for Referring Video Object Segmentation

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Zhou, Zikun, Xiong, Wentao, Zhou, Li, Li, Xin, He, Zhenyu, Wang, Yaowei
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!