SpeechCLIP+: Self-supervised multi-task representation learning for speech via CLIP and speech-image data

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Wang, Hsuan-Fu, Shih, Yi-Jen, Chang, Heng-Jui, Berry, Layne, Peng, Puyuan, Lee, Hung-yi, Wang, Hsin-Min, Harwath, David
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!