Multi-granularity Contrastive Cross-modal Collaborative Generation for End-to-End Long-term Video Question Answering

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Yu, Ting, Fu, Kunhao, Zhang, Jian, Huang, Qingming, Yu, Jun
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!