Can Visual Input Be Compressed? A Visual Token Compression Benchmark for Large Multimodal Models

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Peng, Tianfan, Du, Yuntao, Ji, Pengzhou, Dong, Shijie, Jiang, Kailin, Ma, Mingchuan, Tian, Yijun, Bi, Jinhe, Li, Qian, Du, Wei, Xiao, Feng, Cui, Lizhen
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!