Appiani, A., & Beyan, C. (2024). CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection.
Style de citation Chicago (17e éd.)Appiani, Andrea, et Cigdem Beyan. CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection. 2024.
Style de citation MLA (9e éd.)Appiani, Andrea, et Cigdem Beyan. CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection. 2024.
Attention : ces citations peuvent ne pas être correctes à 100%.