APA (7th ed.) Citation

Liu, J., Chen, S., He, X., Guo, L., Zhu, X., Wang, W., & Tang, J. (2023). VALOR: Vision-Audio-Language Omni-Perception Pretraining Model and Dataset.

Chicago Style (17th ed.) Citation

Liu, Jing, Sihan Chen, Xingjian He, Longteng Guo, Xinxin Zhu, Weining Wang, and Jinhui Tang. VALOR: Vision-Audio-Language Omni-Perception Pretraining Model and Dataset. 2023.

MLA (9th ed.) Citation

Liu, Jing, et al. VALOR: Vision-Audio-Language Omni-Perception Pretraining Model and Dataset. 2023.

Warning: These citations may not always be 100% accurate.