I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Hu, Xing, Cheng, Yuan, Yang, Dawei, Yuan, Zhihang, Yu, Jiangyong, Xu, Chen, Zhou, Sifan
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares