Entropy-Based Block Pruning for Efficient Large Language Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Yang, Liangwei, Xu, Yuhui, Tan, Juntao, Sahoo, Doyen, Savarese, Silvio, Xiong, Caiming, Wang, Huan, Heinecke, Shelby
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!