Inference Performance Optimization for Large Language Models on CPUs

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: He, Pujiang, Zhou, Shan, Huang, Wenhuan, Li, Changqing, Wang, Duyi, Guo, Bin, Meng, Chen, Gui, Sheng, Yu, Weifei, Xie, Yi
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!