PQS (Prune, Quantize, and Sort): Low-Bitwidth Accumulation of Dot Products in Neural Network Computations

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Natesh, Vikas, Kung, H. T.
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!