HATA: Trainable and Hardware-Efficient Hash-Aware Top-k Attention for Scalable Large Model Inference

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Gong, Ping, Yi, Jiawei, Wang, Shengnan, Zhang, Juncheng, Jin, Zewen, Zhou, Ouxiang, Liu, Ruibo, Xu, Guanbin, Bai, Youhui, Ye, Bowen, Yuan, Kun, Yang, Tong, Zhang, Gong, Chen, Renhai, Wu, Feng, Li, Cheng
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!