FrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Vision Language Models

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Fu, Tianyu, Liu, Tengxuan, Han, Qinghao, Dai, Guohao, Yan, Shengen, Yang, Huazhong, Ning, Xuefei, Wang, Yu
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!