StructPrune: Structured Global Pruning asymptotics with $\mathcal{O}(\sqrt{N})$ GPU Memory
Fuente:
arXiv
Salvato in:
| Autori principali: | Song, Xinyuan, Bai, Guangji, Zhao, Liang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EMP: Enhance Memory in Data Pruning
di: Xiao, Jinying, et al.
Pubblicazione: (2024)
di: Xiao, Jinying, et al.
Pubblicazione: (2024)
Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts Models
di: Hu, Wentao, et al.
Pubblicazione: (2025)
di: Hu, Wentao, et al.
Pubblicazione: (2025)
IPPRO: Importance-based Pruning with PRojective Offset for Magnitude-indifferent Structural Pruning
di: Jung, Jaeheun, et al.
Pubblicazione: (2025)
di: Jung, Jaeheun, et al.
Pubblicazione: (2025)
Continuous Temporal Domain Generalization
di: Cai, Zekun, et al.
Pubblicazione: (2024)
di: Cai, Zekun, et al.
Pubblicazione: (2024)
Structured vs. Unstructured Pruning: An Exponential Gap
di: Ferre', Davide, et al.
Pubblicazione: (2026)
di: Ferre', Davide, et al.
Pubblicazione: (2026)
Numerical Pruning for Efficient Autoregressive Models
di: Shen, Xuan, et al.
Pubblicazione: (2024)
di: Shen, Xuan, et al.
Pubblicazione: (2024)
Sparsest Models Elude Pruning: An Exposé of Pruning's Current Capabilities
di: Zhang, Stephen, et al.
Pubblicazione: (2024)
di: Zhang, Stephen, et al.
Pubblicazione: (2024)
MaskPrune: Mask-based LLM Pruning for Layer-wise Uniform Structures
di: Qin, Jiayu, et al.
Pubblicazione: (2025)
di: Qin, Jiayu, et al.
Pubblicazione: (2025)
GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
di: Liu, Xiaoyun, et al.
Pubblicazione: (2026)
di: Liu, Xiaoyun, et al.
Pubblicazione: (2026)
SwiftPrune: Hessian-Free Weight Pruning for Large Language Models
di: Kang, Yuhan, et al.
Pubblicazione: (2025)
di: Kang, Yuhan, et al.
Pubblicazione: (2025)
Beyond Linear Approximations: A Novel Pruning Approach for Attention Matrix
di: Liang, Yingyu, et al.
Pubblicazione: (2024)
di: Liang, Yingyu, et al.
Pubblicazione: (2024)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
PrunePEFT: Iterative Hybrid Pruning for Parameter-Efficient Fine-tuning of LLMs
di: Yu, Tongzhou, et al.
Pubblicazione: (2025)
di: Yu, Tongzhou, et al.
Pubblicazione: (2025)
TopoPrune: Robust Data Pruning via Unified Latent Space Topology
di: Roy, Arjun, et al.
Pubblicazione: (2026)
di: Roy, Arjun, et al.
Pubblicazione: (2026)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
Large Language Model Pruning
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
Prune-OPD: Efficient and Reliable On-Policy Distillation for Long-Horizon Reasoning
di: Yang, Zhicheng, et al.
Pubblicazione: (2026)
di: Yang, Zhicheng, et al.
Pubblicazione: (2026)
Beyond One-Way Pruning: Bidirectional Pruning-Regrowth for Extreme Accuracy-Sparsity Tradeoff
di: Liu, Junchen, et al.
Pubblicazione: (2025)
di: Liu, Junchen, et al.
Pubblicazione: (2025)
PruneSymNet: A Symbolic Neural Network and Pruning Algorithm for Symbolic Regression
di: Wu, Min, et al.
Pubblicazione: (2024)
di: Wu, Min, et al.
Pubblicazione: (2024)
Less is More: Unlocking Specialization of Time Series Foundation Models via Structured Pruning
di: Zhao, Lifan, et al.
Pubblicazione: (2025)
di: Zhao, Lifan, et al.
Pubblicazione: (2025)
IDEA Prune: An Integrated Enlarge-and-Prune Pipeline in Generative Language Model Pretraining
di: Li, Yixiao, et al.
Pubblicazione: (2025)
di: Li, Yixiao, et al.
Pubblicazione: (2025)
On the Limitations of Language Targeted Pruning: Investigating the Calibration Language Impact in Multilingual LLM Pruning
di: Kurz, Simon, et al.
Pubblicazione: (2024)
di: Kurz, Simon, et al.
Pubblicazione: (2024)
The Neural Pruning Law Hypothesis
di: Barbulescu, Eugen, et al.
Pubblicazione: (2025)
di: Barbulescu, Eugen, et al.
Pubblicazione: (2025)
Continuous Domain Generalization
di: Cai, Zekun, et al.
Pubblicazione: (2025)
di: Cai, Zekun, et al.
Pubblicazione: (2025)
Safe Pruning LoRA: Robust Distance-Guided Pruning for Safety Alignment in Adaptation of LLMs
di: Ao, Shuang, et al.
Pubblicazione: (2025)
di: Ao, Shuang, et al.
Pubblicazione: (2025)
UniPruning: Unifying Local Metric and Global Feedback for Scalable Sparse LLMs
di: Ding, Yizhuo, et al.
Pubblicazione: (2025)
di: Ding, Yizhuo, et al.
Pubblicazione: (2025)
The Structural Scalpel: Automated Contiguous Layer Pruning for Large Language Models
di: Lu, Yao, et al.
Pubblicazione: (2025)
di: Lu, Yao, et al.
Pubblicazione: (2025)
Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models
di: Xu, Zihuai, et al.
Pubblicazione: (2025)
di: Xu, Zihuai, et al.
Pubblicazione: (2025)
Rapid Deployment of DNNs for Edge Computing via Structured Pruning at Initialization
di: Eccles, Bailey J., et al.
Pubblicazione: (2024)
di: Eccles, Bailey J., et al.
Pubblicazione: (2024)
Influence Functions for Preference Dataset Pruning
di: Fein, Daniel, et al.
Pubblicazione: (2025)
di: Fein, Daniel, et al.
Pubblicazione: (2025)
Severing Spurious Correlations with Data Pruning
di: Mulchandani, Varun, et al.
Pubblicazione: (2025)
di: Mulchandani, Varun, et al.
Pubblicazione: (2025)
Symmetric Pruning of Large Language Models
di: Yi, Kai, et al.
Pubblicazione: (2025)
di: Yi, Kai, et al.
Pubblicazione: (2025)
FedSpaLLM: Federated Pruning of Large Language Models
di: Bai, Guangji, et al.
Pubblicazione: (2024)
di: Bai, Guangji, et al.
Pubblicazione: (2024)
Catalyst: a Novel Regularizer for Structured Pruning with Auxiliary Extension of Parameter Space
di: Jung, Jaeheun, et al.
Pubblicazione: (2025)
di: Jung, Jaeheun, et al.
Pubblicazione: (2025)
Earley-Driven Dynamic Pruning for Efficient Structured Decoding
di: Sun, Xintong, et al.
Pubblicazione: (2025)
di: Sun, Xintong, et al.
Pubblicazione: (2025)
Two-Stage Regularization-Based Structured Pruning for LLMs
di: Feng, Mingkuan, et al.
Pubblicazione: (2025)
di: Feng, Mingkuan, et al.
Pubblicazione: (2025)
SST: Multi-Scale Hybrid Mamba-Transformer Experts for Time Series Forecasting
di: Xu, Xiongxiao, et al.
Pubblicazione: (2024)
di: Xu, Xiongxiao, et al.
Pubblicazione: (2024)
Balanced Edge Pruning for Graph Anomaly Detection with Noisy Labels
di: Wang, Zhu, et al.
Pubblicazione: (2024)
di: Wang, Zhu, et al.
Pubblicazione: (2024)
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
di: Le, Qi, et al.
Pubblicazione: (2025)
di: Le, Qi, et al.
Pubblicazione: (2025)
Learning from Complexity: Exploring Dynamic Sample Pruning of Spatio-Temporal Training
di: Chen, Wei, et al.
Pubblicazione: (2026)
di: Chen, Wei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
EMP: Enhance Memory in Data Pruning
di: Xiao, Jinying, et al.
Pubblicazione: (2024) -
Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts Models
di: Hu, Wentao, et al.
Pubblicazione: (2025) -
IPPRO: Importance-based Pruning with PRojective Offset for Magnitude-indifferent Structural Pruning
di: Jung, Jaeheun, et al.
Pubblicazione: (2025) -
Continuous Temporal Domain Generalization
di: Cai, Zekun, et al.
Pubblicazione: (2024) -
Structured vs. Unstructured Pruning: An Exponential Gap
di: Ferre', Davide, et al.
Pubblicazione: (2026)