Locality-aware Cross-modal Correspondence Learning for Dense Audio-Visual Events Localization

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Xing, Ling, Qu, Hongyu, Yan, Rui, Shu, Xiangbo, Tang, Jinhui
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!