MINI-LLM: Memory-Efficient Structured Pruning for Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cheng, Hongrong, Zhang, Miao, Shi, Javen Qinfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Survey on Deep Neural Network Pruning-Taxonomy, Comparison, Analysis, and Recommendations
par: Cheng, Hongrong, et autres
Publié: (2023)
par: Cheng, Hongrong, et autres
Publié: (2023)
KVPruner: Structural Pruning for Faster and Memory-Efficient Large Language Models
par: Lv, Bo, et autres
Publié: (2024)
par: Lv, Bo, et autres
Publié: (2024)
Iterative Structured Pruning for Large Language Models with Multi-Domain Calibration
par: Wu, Guangxin, et autres
Publié: (2026)
par: Wu, Guangxin, et autres
Publié: (2026)
DISP-LLM: Dimension-Independent Structural Pruning for Large Language Models
par: Gao, Shangqian, et autres
Publié: (2024)
par: Gao, Shangqian, et autres
Publié: (2024)
Olica: Efficient Structured Pruning of Large Language Models without Retraining
par: He, Jiujun, et autres
Publié: (2025)
par: He, Jiujun, et autres
Publié: (2025)
Deterministic Differentiable Structured Pruning for Large Language Models
par: Huang, Weiyu, et autres
Publié: (2026)
par: Huang, Weiyu, et autres
Publié: (2026)
NutePrune: Efficient Progressive Pruning with Numerous Teachers for Large Language Models
par: Li, Shengrui, et autres
Publié: (2024)
par: Li, Shengrui, et autres
Publié: (2024)
Chem4DLLM: 4D Multimodal LLMs for Chemical Dynamics Understanding
par: Li, Xinyu, et autres
Publié: (2026)
par: Li, Xinyu, et autres
Publié: (2026)
IG-Pruning: Input-Guided Block Pruning for Large Language Models
par: Qiao, Kangyu, et autres
Publié: (2025)
par: Qiao, Kangyu, et autres
Publié: (2025)
Semantic Role Labeling Guided Out-of-distribution Detection
par: Zou, Jinan, et autres
Publié: (2023)
par: Zou, Jinan, et autres
Publié: (2023)
DLP: Dynamic Layerwise Pruning in Large Language Models
par: Chen, Yuli, et autres
Publié: (2025)
par: Chen, Yuli, et autres
Publié: (2025)
LEO-MINI: An Efficient Multimodal Large Language Model using Conditional Token Reduction and Mixture of Multi-Modal Experts
par: Wang, Yimu, et autres
Publié: (2025)
par: Wang, Yimu, et autres
Publié: (2025)
Learning to Reason and Navigate: Parameter Efficient Action Planning with Large Language Models
par: Mohammadi, Bahram, et autres
Publié: (2025)
par: Mohammadi, Bahram, et autres
Publié: (2025)
DRPruning: Efficient Large Language Model Pruning through Distributionally Robust Optimization
par: Deng, Hexuan, et autres
Publié: (2024)
par: Deng, Hexuan, et autres
Publié: (2024)
Truth as a Trajectory: What Internal Representations Reveal About Large Language Model Reasoning
par: Damirchi, Hamed, et autres
Publié: (2026)
par: Damirchi, Hamed, et autres
Publié: (2026)
LLM-BIP: Structured Pruning for Large Language Models with Block-Wise Forward Importance Propagation
par: Wu, Haihang
Publié: (2024)
par: Wu, Haihang
Publié: (2024)
PAT: Pruning-Aware Tuning for Large Language Models
par: Liu, Yijiang, et autres
Publié: (2024)
par: Liu, Yijiang, et autres
Publié: (2024)
MI-PRUN: Optimize Large Language Model Pruning via Mutual Information
par: Zhang, Hao, et autres
Publié: (2026)
par: Zhang, Hao, et autres
Publié: (2026)
Structured Memory Mechanisms for Stable Context Representation in Large Language Models
par: Xing, Yue, et autres
Publié: (2025)
par: Xing, Yue, et autres
Publié: (2025)
PASER: Post-Training Data Selection for Efficient Pruned Large Language Model Recovery
par: He, Bowei, et autres
Publié: (2025)
par: He, Bowei, et autres
Publié: (2025)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
par: Zheng, Haotian, et autres
Publié: (2024)
par: Zheng, Haotian, et autres
Publié: (2024)
Sample-aware Adaptive Structured Pruning for Large Language Models
par: Kong, Jun, et autres
Publié: (2025)
par: Kong, Jun, et autres
Publié: (2025)
Structural Pruning of Large Vision Language Models: A Comprehensive Study on Pruning Dynamics, Recovery, and Data Efficiency
par: Huang, Yiran, et autres
Publié: (2026)
par: Huang, Yiran, et autres
Publié: (2026)
Entropy-Based Block Pruning for Efficient Large Language Models
par: Yang, Liangwei, et autres
Publié: (2025)
par: Yang, Liangwei, et autres
Publié: (2025)
DarwinLM: Evolutionary Structured Pruning of Large Language Models
par: Tang, Shengkun, et autres
Publié: (2025)
par: Tang, Shengkun, et autres
Publié: (2025)
RCPU: Rotation-Constrained Error Compensation for Structured Pruning of Large Language Models
par: Haruta, Shuichiro, et autres
Publié: (2025)
par: Haruta, Shuichiro, et autres
Publié: (2025)
E$^3$-Pruner: Towards Efficient, Economical, and Effective Layer Pruning for Large Language Models
par: Yuan, Tao, et autres
Publié: (2025)
par: Yuan, Tao, et autres
Publié: (2025)
ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models
par: Chen, Hao, et autres
Publié: (2025)
par: Chen, Hao, et autres
Publié: (2025)
Instruction-Following Pruning for Large Language Models
par: Hou, Bairu, et autres
Publié: (2025)
par: Hou, Bairu, et autres
Publié: (2025)
High-Fidelity Pruning for Large Language Models
par: Zhu, Yijun, et autres
Publié: (2026)
par: Zhu, Yijun, et autres
Publié: (2026)
Efficient Post-Training Pruning of Large Language Models with Statistical Correction
par: Yu, Peiqi, et autres
Publié: (2026)
par: Yu, Peiqi, et autres
Publié: (2026)
Pruning Large Language Models with Semi-Structural Adaptive Sparse Training
par: Huang, Weiyu, et autres
Publié: (2024)
par: Huang, Weiyu, et autres
Publié: (2024)
Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
par: Pan, Rui, et autres
Publié: (2025)
par: Pan, Rui, et autres
Publié: (2025)
SR-LLM: Rethinking the Structured Representation in Large Language Model
par: Zhang, Jiahuan, et autres
Publié: (2025)
par: Zhang, Jiahuan, et autres
Publié: (2025)
LLM in a flash: Efficient Large Language Model Inference with Limited Memory
par: Alizadeh, Keivan, et autres
Publié: (2023)
par: Alizadeh, Keivan, et autres
Publié: (2023)
DPPA: Pruning Method for Large Language Model to Model Merging
par: Zhu, Yaochen, et autres
Publié: (2024)
par: Zhu, Yaochen, et autres
Publié: (2024)
Disentangling Memory and Reasoning Ability in Large Language Models
par: Jin, Mingyu, et autres
Publié: (2024)
par: Jin, Mingyu, et autres
Publié: (2024)
PIP: Perturbation-based Iterative Pruning for Large Language Models
par: Cao, Yi, et autres
Publié: (2025)
par: Cao, Yi, et autres
Publié: (2025)
Pruning Multilingual Large Language Models for Multilingual Inference
par: Kim, Hwichan, et autres
Publié: (2024)
par: Kim, Hwichan, et autres
Publié: (2024)
Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models
par: Sun, Chuan, et autres
Publié: (2025)
par: Sun, Chuan, et autres
Publié: (2025)
Documents similaires
-
A Survey on Deep Neural Network Pruning-Taxonomy, Comparison, Analysis, and Recommendations
par: Cheng, Hongrong, et autres
Publié: (2023) -
KVPruner: Structural Pruning for Faster and Memory-Efficient Large Language Models
par: Lv, Bo, et autres
Publié: (2024) -
Iterative Structured Pruning for Large Language Models with Multi-Domain Calibration
par: Wu, Guangxin, et autres
Publié: (2026) -
DISP-LLM: Dimension-Independent Structural Pruning for Large Language Models
par: Gao, Shangqian, et autres
Publié: (2024) -
Olica: Efficient Structured Pruning of Large Language Models without Retraining
par: He, Jiujun, et autres
Publié: (2025)