Inference Performance Optimization for Large Language Models on CPUs

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: He, Pujiang, Zhou, Shan, Huang, Wenhuan, Li, Changqing, Wang, Duyi, Guo, Bin, Meng, Chen, Gui, Sheng, Yu, Weifei, Xie, Yi
Format: Preprint
Veröffentlicht: 2024
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!