TokenSelect: Efficient Long-Context Inference and Length Extrapolation for LLMs via Dynamic Token-Level KV Cache Selection

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Wu, Wei, Pan, Zhuoshi, Wang, Chao, Chen, Liyi, Bai, Yunchu, Wang, Tianfu, Fu, Kun, Wang, Zheng, Xiong, Hui
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!