Prefixing Attention Sinks can Mitigate Activation Outliers for Large Language Model Quantization

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Son, Seungwoo, Park, Wonpyo, Han, Woohyun, Kim, Kyuyeun, Lee, Jaeho
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!