Bai, B., Cao, J., Luo, Y., & Chen, T. (2025). Local Information Matters: Inference Acceleration For Grounded Conversation Generation Models Through Adaptive Local-Aware Token Pruning.
Chicago Style (17th ed.) CitationBai, Bizhe, Jianjian Cao, Yadan Luo, and Tao Chen. Local Information Matters: Inference Acceleration For Grounded Conversation Generation Models Through Adaptive Local-Aware Token Pruning. 2025.
MLA (9th ed.) CitationBai, Bizhe, et al. Local Information Matters: Inference Acceleration For Grounded Conversation Generation Models Through Adaptive Local-Aware Token Pruning. 2025.
Warning: These citations may not always be 100% accurate.