VSSFlow: Unifying Video-conditioned Sound and Speech Generation via Joint Learning

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Cheng, Xin, Wang, Yuyue, Wang, Xihua, Wu, Yihan, Guan, Kaisi, Chen, Yijing, Zhang, Peng, Liu, Xiaojiang, Cao, Meng, Song, Ruihua
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!