AirCache: Activating Inter-modal Relevancy KV Cache Compression for Efficient Large Vision-Language Model Inference

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Huang, Kai, Zou, Hao, Wang, Bochen, Xi, Ye, Xie, Zhen, Wang, Hao
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!