Dual-Stream Decoupled Learning for Temporal Consistency and Speaker Interaction in AVSD

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Xiao, Junhao, Feng, Shun, Wu, Zhiyu, Yu, Jinghan, Yao, Haibiao, Ma, Zhiyuan, Li, Jianjun, Bao, Youjun, Chen, Yi
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!