Prune, Update and Trim: Robust Structured Pruning for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Mecke, Diego Coello de Portugal, Hanika, Tom, Schmidth-Thieme, Lars |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
STADE: Standard Deviation as a Pruning Metric
di: Mecke, Diego Coello de Portugal, et al.
Pubblicazione: (2025)
di: Mecke, Diego Coello de Portugal, et al.
Pubblicazione: (2025)
HexFormer: Hyperbolic Vision Transformer with Exponential Map Aggregation
di: Alyoussef, Haya, et al.
Pubblicazione: (2026)
di: Alyoussef, Haya, et al.
Pubblicazione: (2026)
Valid and Expressive Copulas for Irregular Multivariate Time Series
di: Klötergens, Christian, et al.
Pubblicazione: (2026)
di: Klötergens, Christian, et al.
Pubblicazione: (2026)
LAtte: Hyperbolic Lorentz Attention for Cross-Subject EEG Classification
di: Bdeir, Ahmad, et al.
Pubblicazione: (2026)
di: Bdeir, Ahmad, et al.
Pubblicazione: (2026)
Fast and Effective Weight Update for Pruned Large Language Models
di: Boža, Vladimír
Pubblicazione: (2024)
di: Boža, Vladimír
Pubblicazione: (2024)
Are EEG Sequences Time Series? EEG Classification with Time Series Models and Joint Subject Training
di: Burchert, Johannes, et al.
Pubblicazione: (2024)
di: Burchert, Johannes, et al.
Pubblicazione: (2024)
Alpha-Trimming: Locally Adaptive Tree Pruning for Random Forests
di: Surjanovic, Nikola, et al.
Pubblicazione: (2024)
di: Surjanovic, Nikola, et al.
Pubblicazione: (2024)
FASP: Fast and Accurate Structured Pruning of Large Language Models
di: Hu, Hanyu, et al.
Pubblicazione: (2025)
di: Hu, Hanyu, et al.
Pubblicazione: (2025)
SlimLLM: Accurate Structured Pruning for Large Language Models
di: Guo, Jialong, et al.
Pubblicazione: (2025)
di: Guo, Jialong, et al.
Pubblicazione: (2025)
Deterministic Differentiable Structured Pruning for Large Language Models
di: Huang, Weiyu, et al.
Pubblicazione: (2026)
di: Huang, Weiyu, et al.
Pubblicazione: (2026)
SwiftPrune: Hessian-Free Weight Pruning for Large Language Models
di: Kang, Yuhan, et al.
Pubblicazione: (2025)
di: Kang, Yuhan, et al.
Pubblicazione: (2025)
QPruner: Probabilistic Decision Quantization for Structured Pruning in Large Language Models
di: Zhou, Changhai, et al.
Pubblicazione: (2024)
di: Zhou, Changhai, et al.
Pubblicazione: (2024)
Large Language Model Pruning
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
DarwinLM: Evolutionary Structured Pruning of Large Language Models
di: Tang, Shengkun, et al.
Pubblicazione: (2025)
di: Tang, Shengkun, et al.
Pubblicazione: (2025)
Symmetric Pruning of Large Language Models
di: Yi, Kai, et al.
Pubblicazione: (2025)
di: Yi, Kai, et al.
Pubblicazione: (2025)
ResPrune: Text-Conditioned Subspace Reconstruction for Visual Token Pruning in Large Vision-Language Models
di: Li, Xu, et al.
Pubblicazione: (2026)
di: Li, Xu, et al.
Pubblicazione: (2026)
GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
di: Liu, Xiaoyun, et al.
Pubblicazione: (2026)
di: Liu, Xiaoyun, et al.
Pubblicazione: (2026)
The Structural Scalpel: Automated Contiguous Layer Pruning for Large Language Models
di: Lu, Yao, et al.
Pubblicazione: (2025)
di: Lu, Yao, et al.
Pubblicazione: (2025)
Olica: Efficient Structured Pruning of Large Language Models without Retraining
di: He, Jiujun, et al.
Pubblicazione: (2025)
di: He, Jiujun, et al.
Pubblicazione: (2025)
DISP-LLM: Dimension-Independent Structural Pruning for Large Language Models
di: Gao, Shangqian, et al.
Pubblicazione: (2024)
di: Gao, Shangqian, et al.
Pubblicazione: (2024)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
di: Zheng, Haotian, et al.
Pubblicazione: (2024)
di: Zheng, Haotian, et al.
Pubblicazione: (2024)
Sample-aware Adaptive Structured Pruning for Large Language Models
di: Kong, Jun, et al.
Pubblicazione: (2025)
di: Kong, Jun, et al.
Pubblicazione: (2025)
Exploring Federated Pruning for Large Language Models
di: Guo, Pengxin, et al.
Pubblicazione: (2025)
di: Guo, Pengxin, et al.
Pubblicazione: (2025)
MoreauPruner: Robust Pruning of Large Language Models against Weight Perturbations
di: Wang, Zixiao, et al.
Pubblicazione: (2024)
di: Wang, Zixiao, et al.
Pubblicazione: (2024)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
Relative Kinetic Utility for Reasoning-Aware Structural Pruning in Large Language Models
di: Qian, Tianhao
Pubblicazione: (2026)
di: Qian, Tianhao
Pubblicazione: (2026)
Towards Efficient Automatic Self-Pruning of Large Language Models
di: Huang, Weizhong, et al.
Pubblicazione: (2025)
di: Huang, Weizhong, et al.
Pubblicazione: (2025)
Holistic Adversarially Robust Pruning
di: Zhao, Qi, et al.
Pubblicazione: (2024)
di: Zhao, Qi, et al.
Pubblicazione: (2024)
AlphaPruning: Using Heavy-Tailed Self Regularization Theory for Improved Layer-wise Pruning of Large Language Models
di: Lu, Haiquan, et al.
Pubblicazione: (2024)
di: Lu, Haiquan, et al.
Pubblicazione: (2024)
BMRS: Bayesian Model Reduction for Structured Pruning
di: Wright, Dustin, et al.
Pubblicazione: (2024)
di: Wright, Dustin, et al.
Pubblicazione: (2024)
Restoring Pruned Large Language Models via Lost Component Compensation
di: Feng, Zijian, et al.
Pubblicazione: (2025)
di: Feng, Zijian, et al.
Pubblicazione: (2025)
Mitigating Catastrophic Forgetting in Large Language Models with Forgetting-aware Pruning
di: Huang, Wei, et al.
Pubblicazione: (2025)
di: Huang, Wei, et al.
Pubblicazione: (2025)
STUN: Structured-Then-Unstructured Pruning for Scalable MoE Pruning
di: Lee, Jaeseong, et al.
Pubblicazione: (2024)
di: Lee, Jaeseong, et al.
Pubblicazione: (2024)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
Segmentwise Pruning in Audio-Language Models
di: Gibier, Marcel, et al.
Pubblicazione: (2025)
di: Gibier, Marcel, et al.
Pubblicazione: (2025)
EGGS-PTP: An Expander-Graph Guided Structured Post-training Pruning Method for Large Language Models
di: Bazarbachi, Omar, et al.
Pubblicazione: (2025)
di: Bazarbachi, Omar, et al.
Pubblicazione: (2025)
PagedEviction: Structured Block-wise KV Cache Pruning for Efficient Large Language Model Inference
di: Chitty-Venkata, Krishna Teja, et al.
Pubblicazione: (2025)
di: Chitty-Venkata, Krishna Teja, et al.
Pubblicazione: (2025)
On the Limits of Layer Pruning for Generative Reasoning in Large Language Models
di: Shrestha, Safal, et al.
Pubblicazione: (2026)
di: Shrestha, Safal, et al.
Pubblicazione: (2026)
Frustratingly Easy Task-aware Pruning for Large Language Models
di: Tian, Yuanhe, et al.
Pubblicazione: (2025)
di: Tian, Yuanhe, et al.
Pubblicazione: (2025)
Detecting and Pruning Prominent but Detrimental Neurons in Large Language Models
di: Ali, Ameen, et al.
Pubblicazione: (2025)
di: Ali, Ameen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
STADE: Standard Deviation as a Pruning Metric
di: Mecke, Diego Coello de Portugal, et al.
Pubblicazione: (2025) -
HexFormer: Hyperbolic Vision Transformer with Exponential Map Aggregation
di: Alyoussef, Haya, et al.
Pubblicazione: (2026) -
Valid and Expressive Copulas for Irregular Multivariate Time Series
di: Klötergens, Christian, et al.
Pubblicazione: (2026) -
LAtte: Hyperbolic Lorentz Attention for Cross-Subject EEG Classification
di: Bdeir, Ahmad, et al.
Pubblicazione: (2026) -
Fast and Effective Weight Update for Pruned Large Language Models
di: Boža, Vladimír
Pubblicazione: (2024)