Minitron-SSM: Efficient Hybrid Language Model Compression through Group-Aware SSM Pruning

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Taghibakhshi, Ali, Sreenivas, Sharath Turuvekere, Muralidharan, Saurav, Chochowski, Marcin, Karnati, Yashaswi, Joshi, Raviraj, Mahabaleshwarkar, Ameya Sunil, Chen, Zijia, Suhara, Yoshi, Olabiyi, Oluwatobi, Korzekwa, Daniel, Patwary, Mostofa, Shoeybi, Mohammad, Kautz, Jan, Catanzaro, Bryan, Aithal, Ashwath, Tajbakhsh, Nima, Molchanov, Pavlo
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!