Zhang, X., Southwell, B. J., Pan, S., Niu, X., Ahmed, B., & Epps, J. (2026). Why Your Tokenizer Fails in Information Fusion: A Timing-Aware Pre-Quantization Fusion for Video-Enhanced Audio Tokenization.
Chicago Style (17th ed.) CitationZhang, Xiangyu, Benjamin John Southwell, Siqi Pan, Xinlei Niu, Beena Ahmed, and Julien Epps. Why Your Tokenizer Fails in Information Fusion: A Timing-Aware Pre-Quantization Fusion for Video-Enhanced Audio Tokenization. 2026.
MLA (9th ed.) CitationZhang, Xiangyu, et al. Why Your Tokenizer Fails in Information Fusion: A Timing-Aware Pre-Quantization Fusion for Video-Enhanced Audio Tokenization. 2026.
Warning: These citations may not always be 100% accurate.