EVA: Recasting LLM Decoding into GEMM via an Efficient Vector Quantization Architecture

Fuente: Zenodo
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Duan, Bowen, Guo, Cong, Wei, Chiyue, Shan, Haoxuan, Fu, Yuzhe, Chen, Xinhua, Xu, Yifan, Zhang, Ziyue, Zhou, Changchun, Li, Hai, Chen, Yiran
Format: Recurso digital
Publié: Zenodo 2026
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires