Pruning Large Language Models to Intra-module Low-rank Architecture with Transitional Activations

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Shen, Bowen, Lin, Zheng, Zha, Daren, Liu, Wei, Luan, Jian, Wang, Bin, Wang, Weiping
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!