Symmetric Pruning of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yi, Kai, Richtárik, Peter |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Thanos: A Block-wise Pruning Algorithm for Efficient Large Language Model Compression
par: Ilin, Ivan, et autres
Publié: (2025)
par: Ilin, Ivan, et autres
Publié: (2025)
FedComLoc: Communication-Efficient Distributed Training of Sparse and Quantized Models
par: Yi, Kai, et autres
Publié: (2024)
par: Yi, Kai, et autres
Publié: (2024)
SwiftPrune: Hessian-Free Weight Pruning for Large Language Models
par: Kang, Yuhan, et autres
Publié: (2025)
par: Kang, Yuhan, et autres
Publié: (2025)
Exploring Federated Pruning for Large Language Models
par: Guo, Pengxin, et autres
Publié: (2025)
par: Guo, Pengxin, et autres
Publié: (2025)
Large Language Model Pruning
par: Huang, Hanjuan, et autres
Publié: (2024)
par: Huang, Hanjuan, et autres
Publié: (2024)
On the Limits of Layer Pruning for Generative Reasoning in Large Language Models
par: Shrestha, Safal, et autres
Publié: (2026)
par: Shrestha, Safal, et autres
Publié: (2026)
The Structural Scalpel: Automated Contiguous Layer Pruning for Large Language Models
par: Lu, Yao, et autres
Publié: (2025)
par: Lu, Yao, et autres
Publié: (2025)
LEAP: Learnable End-to-End Adaptive Pruning of Large Language Models
par: Mozaffari, Mohammad, et autres
Publié: (2026)
par: Mozaffari, Mohammad, et autres
Publié: (2026)
GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
par: Liu, Xiaoyun, et autres
Publié: (2026)
par: Liu, Xiaoyun, et autres
Publié: (2026)
Wanda++: Pruning Large Language Models via Regional Gradients
par: Yang, Yifan, et autres
Publié: (2025)
par: Yang, Yifan, et autres
Publié: (2025)
LLM-Rank: A Graph Theoretical Approach to Pruning Large Language Models
par: Hoffmann, David, et autres
Publié: (2024)
par: Hoffmann, David, et autres
Publié: (2024)
Beware of Calibration Data for Pruning Large Language Models
par: Ji, Yixin, et autres
Publié: (2024)
par: Ji, Yixin, et autres
Publié: (2024)
COPAL: Continual Pruning in Large Language Generative Models
par: Malla, Srikanth, et autres
Publié: (2024)
par: Malla, Srikanth, et autres
Publié: (2024)
PAT: Pruning-Aware Tuning for Large Language Models
par: Liu, Yijiang, et autres
Publié: (2024)
par: Liu, Yijiang, et autres
Publié: (2024)
Pruning Large Language Models by Identifying and Preserving Functional Networks
par: Liu, Yiheng, et autres
Publié: (2025)
par: Liu, Yiheng, et autres
Publié: (2025)
Pruning as a Defense: Reducing Memorization in Large Language Models
par: Gupta, Mansi, et autres
Publié: (2025)
par: Gupta, Mansi, et autres
Publié: (2025)
Sample-aware Adaptive Structured Pruning for Large Language Models
par: Kong, Jun, et autres
Publié: (2025)
par: Kong, Jun, et autres
Publié: (2025)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
par: Zheng, Haotian, et autres
Publié: (2024)
par: Zheng, Haotian, et autres
Publié: (2024)
A Simple and Effective Pruning Approach for Large Language Models
par: Sun, Mingjie, et autres
Publié: (2023)
par: Sun, Mingjie, et autres
Publié: (2023)
A Novel Unified Parametric Assumption for Nonconvex Optimization
par: Riabinin, Artem, et autres
Publié: (2025)
par: Riabinin, Artem, et autres
Publié: (2025)
Beyond One-Way Pruning: Bidirectional Pruning-Regrowth for Extreme Accuracy-Sparsity Tradeoff
par: Liu, Junchen, et autres
Publié: (2025)
par: Liu, Junchen, et autres
Publié: (2025)
SDMPrune: Self-Distillation MLP Pruning for Efficient Large Language Models
par: Zhu, Hourun, et autres
Publié: (2025)
par: Zhu, Hourun, et autres
Publié: (2025)
Learning on Graphs with Large Language Models(LLMs): A Deep Dive into Model Robustness
par: Guo, Kai, et autres
Publié: (2024)
par: Guo, Kai, et autres
Publié: (2024)
Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models
par: Xu, Zihuai, et autres
Publié: (2025)
par: Xu, Zihuai, et autres
Publié: (2025)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
par: Wang, Ziyan, et autres
Publié: (2025)
par: Wang, Ziyan, et autres
Publié: (2025)
Beyond Size: How Gradients Shape Pruning Decisions in Large Language Models
par: Das, Rocktim Jyoti, et autres
Publié: (2023)
par: Das, Rocktim Jyoti, et autres
Publié: (2023)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
par: Xu, Peng, et autres
Publié: (2024)
par: Xu, Peng, et autres
Publié: (2024)
Sparsest Models Elude Pruning: An Exposé of Pruning's Current Capabilities
par: Zhang, Stephen, et autres
Publié: (2024)
par: Zhang, Stephen, et autres
Publié: (2024)
Safe Pruning LoRA: Robust Distance-Guided Pruning for Safety Alignment in Adaptation of LLMs
par: Ao, Shuang, et autres
Publié: (2025)
par: Ao, Shuang, et autres
Publié: (2025)
IDEA Prune: An Integrated Enlarge-and-Prune Pipeline in Generative Language Model Pretraining
par: Li, Yixiao, et autres
Publié: (2025)
par: Li, Yixiao, et autres
Publié: (2025)
Doubly Robust Alignment for Large Language Models
par: Xu, Erhan, et autres
Publié: (2025)
par: Xu, Erhan, et autres
Publié: (2025)
Measuring Sample Importance in Data Pruning for Language Models based on Information Entropy
par: Kim, Minsang, et autres
Publié: (2024)
par: Kim, Minsang, et autres
Publié: (2024)
Beam Prediction based on Large Language Models
par: Sheng, Yucheng, et autres
Publié: (2024)
par: Sheng, Yucheng, et autres
Publié: (2024)
Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts Models
par: Hu, Wentao, et autres
Publié: (2025)
par: Hu, Wentao, et autres
Publié: (2025)
Streamlining in the Riemannian Realm: Efficient Riemannian Optimization with Loopless Variance Reduction
par: Demidovich, Yury, et autres
Publié: (2024)
par: Demidovich, Yury, et autres
Publié: (2024)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
par: Wang, Ziyan, et autres
Publié: (2025)
par: Wang, Ziyan, et autres
Publié: (2025)
Sink-Aware Pruning for Diffusion Language Models
par: Myrzakhan, Aidar, et autres
Publié: (2026)
par: Myrzakhan, Aidar, et autres
Publié: (2026)
Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models
par: Lu, Xudong, et autres
Publié: (2024)
par: Lu, Xudong, et autres
Publié: (2024)
FedP3: Federated Personalized and Privacy-friendly Network Pruning under Model Heterogeneity
par: Yi, Kai, et autres
Publié: (2024)
par: Yi, Kai, et autres
Publié: (2024)
Numerical Pruning for Efficient Autoregressive Models
par: Shen, Xuan, et autres
Publié: (2024)
par: Shen, Xuan, et autres
Publié: (2024)
Documents similaires
-
Thanos: A Block-wise Pruning Algorithm for Efficient Large Language Model Compression
par: Ilin, Ivan, et autres
Publié: (2025) -
FedComLoc: Communication-Efficient Distributed Training of Sparse and Quantized Models
par: Yi, Kai, et autres
Publié: (2024) -
SwiftPrune: Hessian-Free Weight Pruning for Large Language Models
par: Kang, Yuhan, et autres
Publié: (2025) -
Exploring Federated Pruning for Large Language Models
par: Guo, Pengxin, et autres
Publié: (2025) -
Large Language Model Pruning
par: Huang, Hanjuan, et autres
Publié: (2024)