Model Compression and Efficient Inference for Large Language Models: A Survey

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Wang, Wenxiao, Chen, Wei, Luo, Yicong, Long, Yongliu, Lin, Zhengkai, Zhang, Liye, Lin, Binbin, Cai, Deng, He, Xiaofei
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!