ForestPrune: High-ratio Visual Token Compression for Video Multimodal Large Language Models via Spatial-Temporal Forest Modeling

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Ju, Shaobo, Song, Baiyang, Chen, Tao, Zhang, Jiapeng, Wu, Qiong, Chang, Chao, Wang, HuaiXi, Zhou, Yiyi, Ji, Rongrong
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!