LayerKV: Optimizing Large Language Model Serving with Layer-wise KV Cache Management

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Xiong, Yi, Wu, Hao, Shao, Changxu, Wang, Ziqing, Zhang, Rui, Guo, Yuhong, Zhao, Junping, Zhang, Ke, Pan, Zhenxuan
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!