Zhang, J., Zhang, T., Wang, J., Gao, J., Qian, X., & Yin, X. (2024). I2TTS: Image-indicated Immersive Text-to-speech Synthesis with Spatial Perception.
Chicago Style (17th ed.) CitationZhang, Jiawei, Tian-Hao Zhang, Jun Wang, Jiaran Gao, Xinyuan Qian, and Xu-Cheng Yin. I2TTS: Image-indicated Immersive Text-to-speech Synthesis with Spatial Perception. 2024.
MLA (9th ed.) CitationZhang, Jiawei, et al. I2TTS: Image-indicated Immersive Text-to-speech Synthesis with Spatial Perception. 2024.
Warning: These citations may not always be 100% accurate.