Salvato in:
| Autori principali: | Li, Shengrui, Chen, Junzhe, Han, Xueting, Bai, Jing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2402.09773 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DRPruning: Efficient Large Language Model Pruning through Distributionally Robust Optimization
di: Deng, Hexuan, et al.
Pubblicazione: (2024)
di: Deng, Hexuan, et al.
Pubblicazione: (2024)
DLP: Dynamic Layerwise Pruning in Large Language Models
di: Chen, Yuli, et al.
Pubblicazione: (2025)
di: Chen, Yuli, et al.
Pubblicazione: (2025)
Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models
di: Sun, Chuan, et al.
Pubblicazione: (2025)
di: Sun, Chuan, et al.
Pubblicazione: (2025)
IG-Pruning: Input-Guided Block Pruning for Large Language Models
di: Qiao, Kangyu, et al.
Pubblicazione: (2025)
di: Qiao, Kangyu, et al.
Pubblicazione: (2025)
Sparsity Induction for Accurate Post-Training Pruning of Large Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2026)
di: Jiang, Minhao, et al.
Pubblicazione: (2026)
Instruction-Following Pruning for Large Language Models
di: Hou, Bairu, et al.
Pubblicazione: (2025)
di: Hou, Bairu, et al.
Pubblicazione: (2025)
Large Language Model Pruning
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
E$^3$-Pruner: Towards Efficient, Economical, and Effective Layer Pruning for Large Language Models
di: Yuan, Tao, et al.
Pubblicazione: (2025)
di: Yuan, Tao, et al.
Pubblicazione: (2025)
BlockPruner: Fine-grained Pruning for Large Language Models
di: Zhong, Longguang, et al.
Pubblicazione: (2024)
di: Zhong, Longguang, et al.
Pubblicazione: (2024)
SparseLLM: Towards Global Pruning for Pre-trained Language Models
di: Bai, Guangji, et al.
Pubblicazione: (2024)
di: Bai, Guangji, et al.
Pubblicazione: (2024)
Entropy-Based Block Pruning for Efficient Large Language Models
di: Yang, Liangwei, et al.
Pubblicazione: (2025)
di: Yang, Liangwei, et al.
Pubblicazione: (2025)
MINI-LLM: Memory-Efficient Structured Pruning for Large Language Models
di: Cheng, Hongrong, et al.
Pubblicazione: (2024)
di: Cheng, Hongrong, et al.
Pubblicazione: (2024)
KVPruner: Structural Pruning for Faster and Memory-Efficient Large Language Models
di: Lv, Bo, et al.
Pubblicazione: (2024)
di: Lv, Bo, et al.
Pubblicazione: (2024)
ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models
di: Chen, Hao, et al.
Pubblicazione: (2025)
di: Chen, Hao, et al.
Pubblicazione: (2025)
High-Fidelity Pruning for Large Language Models
di: Zhu, Yijun, et al.
Pubblicazione: (2026)
di: Zhu, Yijun, et al.
Pubblicazione: (2026)
A Simple Linear Patch Revives Layer-Pruned Large Language Models
di: Chen, Xinrui, et al.
Pubblicazione: (2025)
di: Chen, Xinrui, et al.
Pubblicazione: (2025)
PASER: Post-Training Data Selection for Efficient Pruned Large Language Model Recovery
di: He, Bowei, et al.
Pubblicazione: (2025)
di: He, Bowei, et al.
Pubblicazione: (2025)
PAT: Pruning-Aware Tuning for Large Language Models
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
Deterministic Differentiable Structured Pruning for Large Language Models
di: Huang, Weiyu, et al.
Pubblicazione: (2026)
di: Huang, Weiyu, et al.
Pubblicazione: (2026)
Efficient Post-Training Pruning of Large Language Models with Statistical Correction
di: Yu, Peiqi, et al.
Pubblicazione: (2026)
di: Yu, Peiqi, et al.
Pubblicazione: (2026)
Olica: Efficient Structured Pruning of Large Language Models without Retraining
di: He, Jiujun, et al.
Pubblicazione: (2025)
di: He, Jiujun, et al.
Pubblicazione: (2025)
Pruning Multilingual Large Language Models for Multilingual Inference
di: Kim, Hwichan, et al.
Pubblicazione: (2024)
di: Kim, Hwichan, et al.
Pubblicazione: (2024)
Pruning General Large Language Models into Customized Expert Models
di: Zhao, Yirao, et al.
Pubblicazione: (2025)
di: Zhao, Yirao, et al.
Pubblicazione: (2025)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
di: Zheng, Haotian, et al.
Pubblicazione: (2024)
di: Zheng, Haotian, et al.
Pubblicazione: (2024)
Think Before You Prune: Selective Self-Generated Calibration for Pruning Large Reasoning Models
di: Xiang, Yang, et al.
Pubblicazione: (2025)
di: Xiang, Yang, et al.
Pubblicazione: (2025)
Towards Robust Pruning: An Adaptive Knowledge-Retention Pruning Strategy for Language Models
di: Li, Jianwei, et al.
Pubblicazione: (2023)
di: Li, Jianwei, et al.
Pubblicazione: (2023)
Structural Pruning of Large Vision Language Models: A Comprehensive Study on Pruning Dynamics, Recovery, and Data Efficiency
di: Huang, Yiran, et al.
Pubblicazione: (2026)
di: Huang, Yiran, et al.
Pubblicazione: (2026)
Beware of Calibration Data for Pruning Large Language Models
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
di: Xu, Peng, et al.
Pubblicazione: (2024)
di: Xu, Peng, et al.
Pubblicazione: (2024)
SDMPrune: Self-Distillation MLP Pruning for Efficient Large Language Models
di: Zhu, Hourun, et al.
Pubblicazione: (2025)
di: Zhu, Hourun, et al.
Pubblicazione: (2025)
POP: Prefill-Only Pruning for Efficient Large Model Inference
di: He, Junhui, et al.
Pubblicazione: (2026)
di: He, Junhui, et al.
Pubblicazione: (2026)
GPTailor: Large Language Model Pruning Through Layer Cutting and Stitching
di: Su, Guinan, et al.
Pubblicazione: (2025)
di: Su, Guinan, et al.
Pubblicazione: (2025)
Pruning Large Language Models by Identifying and Preserving Functional Networks
di: Liu, Yiheng, et al.
Pubblicazione: (2025)
di: Liu, Yiheng, et al.
Pubblicazione: (2025)
Fit and Prune: Fast and Training-free Visual Token Pruning for Multi-modal Large Language Models
di: Ye, Weihao, et al.
Pubblicazione: (2024)
di: Ye, Weihao, et al.
Pubblicazione: (2024)
Cluster-Driven Expert Pruning for Mixture-of-Experts Large Language Models
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
Prompt-based Depth Pruning of Large Language Models
di: Wee, Juyun, et al.
Pubblicazione: (2025)
di: Wee, Juyun, et al.
Pubblicazione: (2025)
Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation
di: Chen, Xinrui, et al.
Pubblicazione: (2025)
di: Chen, Xinrui, et al.
Pubblicazione: (2025)
Pruning Weights but Not Truth: Safeguarding Truthfulness While Pruning LLMs
di: Fu, Yao, et al.
Pubblicazione: (2025)
di: Fu, Yao, et al.
Pubblicazione: (2025)
Mostly Text, Smart Visuals: Asymmetric Text-Visual Pruning for Large Vision-Language Models
di: Li, Sijie, et al.
Pubblicazione: (2026)
di: Li, Sijie, et al.
Pubblicazione: (2026)
EfficientXpert: Efficient Domain Adaptation for Large Language Models via Propagation-Aware Pruning
di: Zhao, Songlin, et al.
Pubblicazione: (2025)
di: Zhao, Songlin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DRPruning: Efficient Large Language Model Pruning through Distributionally Robust Optimization
di: Deng, Hexuan, et al.
Pubblicazione: (2024) -
DLP: Dynamic Layerwise Pruning in Large Language Models
di: Chen, Yuli, et al.
Pubblicazione: (2025) -
Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models
di: Sun, Chuan, et al.
Pubblicazione: (2025) -
IG-Pruning: Input-Guided Block Pruning for Large Language Models
di: Qiao, Kangyu, et al.
Pubblicazione: (2025) -
Sparsity Induction for Accurate Post-Training Pruning of Large Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2026)