Can Visual Input Be Compressed? A Visual Token Compression Benchmark for Large Multimodal Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Peng, Tianfan, Du, Yuntao, Ji, Pengzhou, Dong, Shijie, Jiang, Kailin, Ma, Mingchuan, Tian, Yijun, Bi, Jinhe, Li, Qian, Du, Wei, Xiao, Feng, Cui, Lizhen
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!