ELAS: Efficient Pre-Training of Low-Rank Large Language Models via 2:4 Activation Sparsity

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Li, Jiaxi, Yin, Lu, Shen, Li, Xu, Jinjin, Liu, Yuhui, Wang, Wenwu, Liu, Shiwei, Wang, Xilu
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!