Fan, Y., Tong, J., Zhao, A., & Shen, X. (2026). What Do Visual Tokens Really Encode? Uncovering Sparsity and Redundancy in Multimodal Large Language Models.
Citazione stile Chigago Style (17a edizione)Fan, Yingqi, Junlong Tong, Anhao Zhao, e Xiaoyu Shen. What Do Visual Tokens Really Encode? Uncovering Sparsity and Redundancy in Multimodal Large Language Models. 2026.
Citatione MLA (9a ed.)Fan, Yingqi, et al. What Do Visual Tokens Really Encode? Uncovering Sparsity and Redundancy in Multimodal Large Language Models. 2026.
Attenzione: Queste citazioni potrebbero non essere precise al 100%.