Spotlight Attention: Towards Efficient LLM Generation via Non-linear Hashing-based KV Cache Retrieval

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Li, Wenhao, Zhang, Yuxin, Luo, Gen, Wan, Haiyuan, Gong, Ziyang, Chao, Fei, Ji, Rongrong
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!