APA (7th ed.) Citation

Appiani, A., & Beyan, C. (2024). CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection.

Chicago Style (17th ed.) Citation

Appiani, Andrea, and Cigdem Beyan. CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection. 2024.

MLA (9th ed.) Citation

Appiani, Andrea, and Cigdem Beyan. CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection. 2024.

Warning: These citations may not always be 100% accurate.