Shen, B., Lin, Z., Zha, D., Liu, W., Luan, J., Wang, B., & Wang, W. (2024). Pruning Large Language Models to Intra-module Low-rank Architecture with Transitional Activations.
Chicago Style (17th ed.) CitationShen, Bowen, Zheng Lin, Daren Zha, Wei Liu, Jian Luan, Bin Wang, and Weiping Wang. Pruning Large Language Models to Intra-module Low-rank Architecture with Transitional Activations. 2024.
MLA (9th ed.) CitationShen, Bowen, et al. Pruning Large Language Models to Intra-module Low-rank Architecture with Transitional Activations. 2024.
Warning: These citations may not always be 100% accurate.