Kim, J., Jung, J., Lee, J., & Woo, S. H. (2024). EnCLAP: Combining Neural Audio Codec and Audio-Text Joint Embedding for Automated Audio Captioning.
Chicago-Zitierstil (17. Ausg.)Kim, Jaeyeon, Jaeyoon Jung, Jinjoo Lee, und Sang Hoon Woo. EnCLAP: Combining Neural Audio Codec and Audio-Text Joint Embedding for Automated Audio Captioning. 2024.
MLA-Zitierstil (9. Ausg.)Kim, Jaeyeon, et al. EnCLAP: Combining Neural Audio Codec and Audio-Text Joint Embedding for Automated Audio Captioning. 2024.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.