SwiftPrune: Hessian-Free Weight Pruning for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Kang, Yuhan, Shi, Yang, We, Mei, He, Jun, Yang, Jianchao, Xue, Zeyu, Feng, Jing, Liu, Xinwang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HEAPr: Hessian-based Efficient Atomic Expert Pruning in Output Space
di: Li, Ke, et al.
Pubblicazione: (2025)
di: Li, Ke, et al.
Pubblicazione: (2025)
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026)
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026)
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
di: Liu, Jun, et al.
Pubblicazione: (2024)
di: Liu, Jun, et al.
Pubblicazione: (2024)
MaskPrune: Mask-based LLM Pruning for Layer-wise Uniform Structures
di: Qin, Jiayu, et al.
Pubblicazione: (2025)
di: Qin, Jiayu, et al.
Pubblicazione: (2025)
PAT: Pruning-Aware Tuning for Large Language Models
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
Large Language Model Pruning
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
SepPrune: Structured Pruning for Efficient Deep Speech Separation
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
Prune-then-Quantize or Quantize-then-Prune? Understanding the Impact of Compression Order in Joint Model Compression
di: Kim, Minjun, et al.
Pubblicazione: (2026)
di: Kim, Minjun, et al.
Pubblicazione: (2026)
Systematic Weight Evaluation for Pruning Large Language Models: Enhancing Performance and Sustainability
di: Islam, Ashhadul, et al.
Pubblicazione: (2025)
di: Islam, Ashhadul, et al.
Pubblicazione: (2025)
Understanding Performance Collapse in Layer-Pruned Large Language Models via Decision Representation Transitions
di: Shi, Boyu, et al.
Pubblicazione: (2026)
di: Shi, Boyu, et al.
Pubblicazione: (2026)
Symmetric Pruning of Large Language Models
di: Yi, Kai, et al.
Pubblicazione: (2025)
di: Yi, Kai, et al.
Pubblicazione: (2025)
Exploring Federated Pruning for Large Language Models
di: Guo, Pengxin, et al.
Pubblicazione: (2025)
di: Guo, Pengxin, et al.
Pubblicazione: (2025)
Sparsity Induction for Accurate Post-Training Pruning of Large Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2026)
di: Jiang, Minhao, et al.
Pubblicazione: (2026)
LaCo: Large Language Model Pruning via Layer Collapse
di: Yang, Yifei, et al.
Pubblicazione: (2024)
di: Yang, Yifei, et al.
Pubblicazione: (2024)
Beware of Calibration Data for Pruning Large Language Models
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
di: Li, Ao, et al.
Pubblicazione: (2025)
di: Li, Ao, et al.
Pubblicazione: (2025)
How Pruning Reshapes Features: Sparse Autoencoder Analysis of Weight-Pruned Language Models
di: Borobia, Hector, et al.
Pubblicazione: (2026)
di: Borobia, Hector, et al.
Pubblicazione: (2026)
Entropy-Based Block Pruning for Efficient Large Language Models
di: Yang, Liangwei, et al.
Pubblicazione: (2025)
di: Yang, Liangwei, et al.
Pubblicazione: (2025)
Sample-aware Adaptive Structured Pruning for Large Language Models
di: Kong, Jun, et al.
Pubblicazione: (2025)
di: Kong, Jun, et al.
Pubblicazione: (2025)
IG-Pruning: Input-Guided Block Pruning for Large Language Models
di: Qiao, Kangyu, et al.
Pubblicazione: (2025)
di: Qiao, Kangyu, et al.
Pubblicazione: (2025)
When Large Vision-Language Model Meets Large Remote Sensing Imagery: Coarse-to-Fine Text-Guided Token Pruning
di: Luo, Junwei, et al.
Pubblicazione: (2025)
di: Luo, Junwei, et al.
Pubblicazione: (2025)
FoPru: Focal Pruning for Efficient Large Vision-Language Models
di: Jiang, Lei, et al.
Pubblicazione: (2024)
di: Jiang, Lei, et al.
Pubblicazione: (2024)
PruneHal: Reducing Hallucinations in Multi-modal Large Language Models through Adaptive KV Cache Pruning
di: Sun, Fengyuan, et al.
Pubblicazione: (2025)
di: Sun, Fengyuan, et al.
Pubblicazione: (2025)
Soft Label Pruning and Quantization for Large-Scale Dataset Distillation
di: Lingao, Xiao, et al.
Pubblicazione: (2026)
di: Lingao, Xiao, et al.
Pubblicazione: (2026)
Pruning Large Language Models with Semi-Structural Adaptive Sparse Training
di: Huang, Weiyu, et al.
Pubblicazione: (2024)
di: Huang, Weiyu, et al.
Pubblicazione: (2024)
POP: Prefill-Only Pruning for Efficient Large Model Inference
di: He, Junhui, et al.
Pubblicazione: (2026)
di: He, Junhui, et al.
Pubblicazione: (2026)
ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving
di: Sha, Lin, et al.
Pubblicazione: (2026)
di: Sha, Lin, et al.
Pubblicazione: (2026)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
Orthogonal Soft Pruning for Efficient Class Unlearning
di: Gong, Qinghui, et al.
Pubblicazione: (2025)
di: Gong, Qinghui, et al.
Pubblicazione: (2025)
SlimGPT: Layer-wise Structured Pruning for Large Language Models
di: Ling, Gui, et al.
Pubblicazione: (2024)
di: Ling, Gui, et al.
Pubblicazione: (2024)
DLP: Dynamic Layerwise Pruning in Large Language Models
di: Chen, Yuli, et al.
Pubblicazione: (2025)
di: Chen, Yuli, et al.
Pubblicazione: (2025)
Prompt-based Depth Pruning of Large Language Models
di: Wee, Juyun, et al.
Pubblicazione: (2025)
di: Wee, Juyun, et al.
Pubblicazione: (2025)
Wanda++: Pruning Large Language Models via Regional Gradients
di: Yang, Yifan, et al.
Pubblicazione: (2025)
di: Yang, Yifan, et al.
Pubblicazione: (2025)
SDFP: Speculative Decoding with FIT-Pruned Models for Training-Free and Plug-and-Play LLM Acceleration
di: Wei, Hanyu, et al.
Pubblicazione: (2026)
di: Wei, Hanyu, et al.
Pubblicazione: (2026)
CLASP: Class-Adaptive Layer Fusion and Dual-Stage Pruning for Multimodal Large Language Models
di: Dang, Yunkai, et al.
Pubblicazione: (2026)
di: Dang, Yunkai, et al.
Pubblicazione: (2026)
A Simple and Effective Pruning Approach for Large Language Models
di: Sun, Mingjie, et al.
Pubblicazione: (2023)
di: Sun, Mingjie, et al.
Pubblicazione: (2023)
Swift Cross-Dataset Pruning: Enhancing Fine-Tuning Efficiency in Natural Language Understanding
di: Nguyen, Binh-Nguyen, et al.
Pubblicazione: (2025)
di: Nguyen, Binh-Nguyen, et al.
Pubblicazione: (2025)
Pruning General Large Language Models into Customized Expert Models
di: Zhao, Yirao, et al.
Pubblicazione: (2025)
di: Zhao, Yirao, et al.
Pubblicazione: (2025)
DPPA: Pruning Method for Large Language Model to Model Merging
di: Zhu, Yaochen, et al.
Pubblicazione: (2024)
di: Zhu, Yaochen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
HEAPr: Hessian-based Efficient Atomic Expert Pruning in Output Space
di: Li, Ke, et al.
Pubblicazione: (2025) -
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026) -
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
di: Liu, Jun, et al.
Pubblicazione: (2024) -
MaskPrune: Mask-based LLM Pruning for Layer-wise Uniform Structures
di: Qin, Jiayu, et al.
Pubblicazione: (2025) -
PAT: Pruning-Aware Tuning for Large Language Models
di: Liu, Yijiang, et al.
Pubblicazione: (2024)