NutePrune: Efficient Progressive Pruning with Numerous Teachers for Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Shengrui, Chen, Junzhe, Han, Xueting, Bai, Jing |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
DRPruning: Efficient Large Language Model Pruning through Distributionally Robust Optimization
von: Deng, Hexuan, et al.
Veröffentlicht: (2024)
von: Deng, Hexuan, et al.
Veröffentlicht: (2024)
DLP: Dynamic Layerwise Pruning in Large Language Models
von: Chen, Yuli, et al.
Veröffentlicht: (2025)
von: Chen, Yuli, et al.
Veröffentlicht: (2025)
Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models
von: Sun, Chuan, et al.
Veröffentlicht: (2025)
von: Sun, Chuan, et al.
Veröffentlicht: (2025)
IG-Pruning: Input-Guided Block Pruning for Large Language Models
von: Qiao, Kangyu, et al.
Veröffentlicht: (2025)
von: Qiao, Kangyu, et al.
Veröffentlicht: (2025)
Instruction-Following Pruning for Large Language Models
von: Hou, Bairu, et al.
Veröffentlicht: (2025)
von: Hou, Bairu, et al.
Veröffentlicht: (2025)
Sparsity Induction for Accurate Post-Training Pruning of Large Language Models
von: Jiang, Minhao, et al.
Veröffentlicht: (2026)
von: Jiang, Minhao, et al.
Veröffentlicht: (2026)
BlockPruner: Fine-grained Pruning for Large Language Models
von: Zhong, Longguang, et al.
Veröffentlicht: (2024)
von: Zhong, Longguang, et al.
Veröffentlicht: (2024)
E$^3$-Pruner: Towards Efficient, Economical, and Effective Layer Pruning for Large Language Models
von: Yuan, Tao, et al.
Veröffentlicht: (2025)
von: Yuan, Tao, et al.
Veröffentlicht: (2025)
MINI-LLM: Memory-Efficient Structured Pruning for Large Language Models
von: Cheng, Hongrong, et al.
Veröffentlicht: (2024)
von: Cheng, Hongrong, et al.
Veröffentlicht: (2024)
KVPruner: Structural Pruning for Faster and Memory-Efficient Large Language Models
von: Lv, Bo, et al.
Veröffentlicht: (2024)
von: Lv, Bo, et al.
Veröffentlicht: (2024)
SparseLLM: Towards Global Pruning for Pre-trained Language Models
von: Bai, Guangji, et al.
Veröffentlicht: (2024)
von: Bai, Guangji, et al.
Veröffentlicht: (2024)
Large Language Model Pruning
von: Huang, Hanjuan, et al.
Veröffentlicht: (2024)
von: Huang, Hanjuan, et al.
Veröffentlicht: (2024)
Entropy-Based Block Pruning for Efficient Large Language Models
von: Yang, Liangwei, et al.
Veröffentlicht: (2025)
von: Yang, Liangwei, et al.
Veröffentlicht: (2025)
High-Fidelity Pruning for Large Language Models
von: Zhu, Yijun, et al.
Veröffentlicht: (2026)
von: Zhu, Yijun, et al.
Veröffentlicht: (2026)
ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models
von: Chen, Hao, et al.
Veröffentlicht: (2025)
von: Chen, Hao, et al.
Veröffentlicht: (2025)
PASER: Post-Training Data Selection for Efficient Pruned Large Language Model Recovery
von: He, Bowei, et al.
Veröffentlicht: (2025)
von: He, Bowei, et al.
Veröffentlicht: (2025)
A Simple Linear Patch Revives Layer-Pruned Large Language Models
von: Chen, Xinrui, et al.
Veröffentlicht: (2025)
von: Chen, Xinrui, et al.
Veröffentlicht: (2025)
Efficient Post-Training Pruning of Large Language Models with Statistical Correction
von: Yu, Peiqi, et al.
Veröffentlicht: (2026)
von: Yu, Peiqi, et al.
Veröffentlicht: (2026)
Olica: Efficient Structured Pruning of Large Language Models without Retraining
von: He, Jiujun, et al.
Veröffentlicht: (2025)
von: He, Jiujun, et al.
Veröffentlicht: (2025)
Pruning Multilingual Large Language Models for Multilingual Inference
von: Kim, Hwichan, et al.
Veröffentlicht: (2024)
von: Kim, Hwichan, et al.
Veröffentlicht: (2024)
Deterministic Differentiable Structured Pruning for Large Language Models
von: Huang, Weiyu, et al.
Veröffentlicht: (2026)
von: Huang, Weiyu, et al.
Veröffentlicht: (2026)
PAT: Pruning-Aware Tuning for Large Language Models
von: Liu, Yijiang, et al.
Veröffentlicht: (2024)
von: Liu, Yijiang, et al.
Veröffentlicht: (2024)
Pruning General Large Language Models into Customized Expert Models
von: Zhao, Yirao, et al.
Veröffentlicht: (2025)
von: Zhao, Yirao, et al.
Veröffentlicht: (2025)
Think Before You Prune: Selective Self-Generated Calibration for Pruning Large Reasoning Models
von: Xiang, Yang, et al.
Veröffentlicht: (2025)
von: Xiang, Yang, et al.
Veröffentlicht: (2025)
Structural Pruning of Large Vision Language Models: A Comprehensive Study on Pruning Dynamics, Recovery, and Data Efficiency
von: Huang, Yiran, et al.
Veröffentlicht: (2026)
von: Huang, Yiran, et al.
Veröffentlicht: (2026)
Towards Robust Pruning: An Adaptive Knowledge-Retention Pruning Strategy for Language Models
von: Li, Jianwei, et al.
Veröffentlicht: (2023)
von: Li, Jianwei, et al.
Veröffentlicht: (2023)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
von: Zheng, Haotian, et al.
Veröffentlicht: (2024)
von: Zheng, Haotian, et al.
Veröffentlicht: (2024)
GPTailor: Large Language Model Pruning Through Layer Cutting and Stitching
von: Su, Guinan, et al.
Veröffentlicht: (2025)
von: Su, Guinan, et al.
Veröffentlicht: (2025)
Cluster-Driven Expert Pruning for Mixture-of-Experts Large Language Models
von: Guo, Hongcheng, et al.
Veröffentlicht: (2025)
von: Guo, Hongcheng, et al.
Veröffentlicht: (2025)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
von: Xu, Peng, et al.
Veröffentlicht: (2024)
von: Xu, Peng, et al.
Veröffentlicht: (2024)
Beware of Calibration Data for Pruning Large Language Models
von: Ji, Yixin, et al.
Veröffentlicht: (2024)
von: Ji, Yixin, et al.
Veröffentlicht: (2024)
SDMPrune: Self-Distillation MLP Pruning for Efficient Large Language Models
von: Zhu, Hourun, et al.
Veröffentlicht: (2025)
von: Zhu, Hourun, et al.
Veröffentlicht: (2025)
POP: Prefill-Only Pruning for Efficient Large Model Inference
von: He, Junhui, et al.
Veröffentlicht: (2026)
von: He, Junhui, et al.
Veröffentlicht: (2026)
Prompt-based Depth Pruning of Large Language Models
von: Wee, Juyun, et al.
Veröffentlicht: (2025)
von: Wee, Juyun, et al.
Veröffentlicht: (2025)
Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation
von: Chen, Xinrui, et al.
Veröffentlicht: (2025)
von: Chen, Xinrui, et al.
Veröffentlicht: (2025)
Fit and Prune: Fast and Training-free Visual Token Pruning for Multi-modal Large Language Models
von: Ye, Weihao, et al.
Veröffentlicht: (2024)
von: Ye, Weihao, et al.
Veröffentlicht: (2024)
MI-PRUN: Optimize Large Language Model Pruning via Mutual Information
von: Zhang, Hao, et al.
Veröffentlicht: (2026)
von: Zhang, Hao, et al.
Veröffentlicht: (2026)
EfficientXpert: Efficient Domain Adaptation for Large Language Models via Propagation-Aware Pruning
von: Zhao, Songlin, et al.
Veröffentlicht: (2025)
von: Zhao, Songlin, et al.
Veröffentlicht: (2025)
Pruning Large Language Models by Identifying and Preserving Functional Networks
von: Liu, Yiheng, et al.
Veröffentlicht: (2025)
von: Liu, Yiheng, et al.
Veröffentlicht: (2025)
RCPU: Rotation-Constrained Error Compensation for Structured Pruning of Large Language Models
von: Haruta, Shuichiro, et al.
Veröffentlicht: (2025)
von: Haruta, Shuichiro, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
DRPruning: Efficient Large Language Model Pruning through Distributionally Robust Optimization
von: Deng, Hexuan, et al.
Veröffentlicht: (2024) -
DLP: Dynamic Layerwise Pruning in Large Language Models
von: Chen, Yuli, et al.
Veröffentlicht: (2025) -
Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models
von: Sun, Chuan, et al.
Veröffentlicht: (2025) -
IG-Pruning: Input-Guided Block Pruning for Large Language Models
von: Qiao, Kangyu, et al.
Veröffentlicht: (2025) -
Instruction-Following Pruning for Large Language Models
von: Hou, Bairu, et al.
Veröffentlicht: (2025)