KV Cache Compression for Inference Efficiency in LLMs: A Review

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Liu, Yanyu, Fu, Jingying, Liu, Sixiang, Zou, Yitian, Fu, You, Zhou, Jiehan, Zhang, Shouhua
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!