VPTQ: Extreme Low-bit Vector Post-Training Quantization for Large Language Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Liu, Yifei, Wen, Jicheng, Wang, Yang, Ye, Shengyu, Zhang, Li Lyna, Cao, Ting, Li, Cheng, Yang, Mao
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!