Less is KEN: a Universal and Simple Non-Parametric Pruning Algorithm for Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mastromattei, Michele, Zanzotto, Fabio Massimo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Linguistic Fingerprint in Transformer Models: How Language Variation Influences Parameter Selection in Irony Detection
par: Mastromattei, Michele, et autres
Publié: (2024)
par: Mastromattei, Michele, et autres
Publié: (2024)
Preserving Privacy in Large Language Models: A Survey on Current Threats and Solutions
par: Miranda, Michele, et autres
Publié: (2024)
par: Miranda, Michele, et autres
Publié: (2024)
Investigating the Impact of Data Contamination of Large Language Models in Text-to-SQL Translation
par: Ranaldi, Federico, et autres
Publié: (2024)
par: Ranaldi, Federico, et autres
Publié: (2024)
Exploring Linguistic Properties of Monolingual BERTs with Typological Classification among Languages
par: Ruzzetti, Elena Sofia, et autres
Publié: (2023)
par: Ruzzetti, Elena Sofia, et autres
Publié: (2023)
A Simple and Effective Pruning Approach for Large Language Models
par: Sun, Mingjie, et autres
Publié: (2023)
par: Sun, Mingjie, et autres
Publié: (2023)
The Dark Side of the Language: Pre-trained Transformers in the DarkNet
par: Ranaldi, Leonardo, et autres
Publié: (2022)
par: Ranaldi, Leonardo, et autres
Publié: (2022)
Animate, or Inanimate, That is the Question for Large Language Models
par: Ranaldi, Leonardo, et autres
Publié: (2024)
par: Ranaldi, Leonardo, et autres
Publié: (2024)
NeuroPrune: A Neuro-inspired Topological Sparse Training Algorithm for Large Language Models
par: Dhurandhar, Amit, et autres
Publié: (2024)
par: Dhurandhar, Amit, et autres
Publié: (2024)
Every time I fire a conversational designer, the performance of the dialog system goes down
par: Xompero, Giancarlo A., et autres
Publié: (2021)
par: Xompero, Giancarlo A., et autres
Publié: (2021)
Large Language Model Pruning
par: Huang, Hanjuan, et autres
Publié: (2024)
par: Huang, Hanjuan, et autres
Publié: (2024)
Deterministic Differentiable Structured Pruning for Large Language Models
par: Huang, Weiyu, et autres
Publié: (2026)
par: Huang, Weiyu, et autres
Publié: (2026)
Fast and Effective Weight Update for Pruned Large Language Models
par: Boža, Vladimír
Publié: (2024)
par: Boža, Vladimír
Publié: (2024)
DarwinLM: Evolutionary Structured Pruning of Large Language Models
par: Tang, Shengkun, et autres
Publié: (2025)
par: Tang, Shengkun, et autres
Publié: (2025)
Frustratingly Easy Task-aware Pruning for Large Language Models
par: Tian, Yuanhe, et autres
Publié: (2025)
par: Tian, Yuanhe, et autres
Publié: (2025)
Detecting and Pruning Prominent but Detrimental Neurons in Large Language Models
par: Ali, Ameen, et autres
Publié: (2025)
par: Ali, Ameen, et autres
Publié: (2025)
PIP: Perturbation-based Iterative Pruning for Large Language Models
par: Cao, Yi, et autres
Publié: (2025)
par: Cao, Yi, et autres
Publié: (2025)
Self-Data Distillation for Recovering Quality in Pruned Large Language Models
par: Thangarasa, Vithursan, et autres
Publié: (2024)
par: Thangarasa, Vithursan, et autres
Publié: (2024)
DISP-LLM: Dimension-Independent Structural Pruning for Large Language Models
par: Gao, Shangqian, et autres
Publié: (2024)
par: Gao, Shangqian, et autres
Publié: (2024)
Efficient Post-Training Pruning of Large Language Models with Statistical Correction
par: Yu, Peiqi, et autres
Publié: (2026)
par: Yu, Peiqi, et autres
Publié: (2026)
Olica: Efficient Structured Pruning of Large Language Models without Retraining
par: He, Jiujun, et autres
Publié: (2025)
par: He, Jiujun, et autres
Publié: (2025)
Cram Less to Fit More: Training Data Pruning Improves Memorization of Facts
par: Ye, Jiayuan, et autres
Publié: (2026)
par: Ye, Jiayuan, et autres
Publié: (2026)
Abstract Activation Spaces for Content-Invariant Reasoning in Large Language Models
par: Maraia, Gabriele, et autres
Publié: (2026)
par: Maraia, Gabriele, et autres
Publié: (2026)
Less but Better: Parameter-Efficient Fine-Tuning of Large Language Models for Personality Detection
par: Shen, Lingzhi, et autres
Publié: (2025)
par: Shen, Lingzhi, et autres
Publié: (2025)
Efficient Non-Parametric Uncertainty Quantification for Black-Box Large Language Models and Decision Planning
par: Tsai, Yao-Hung Hubert, et autres
Publié: (2024)
par: Tsai, Yao-Hung Hubert, et autres
Publié: (2024)
Rethinking Pruning Large Language Models: Benefits and Pitfalls of Reconstruction Error Minimization
par: Shin, Sungbin, et autres
Publié: (2024)
par: Shin, Sungbin, et autres
Publié: (2024)
MoreauPruner: Robust Pruning of Large Language Models against Weight Perturbations
par: Wang, Zixiao, et autres
Publié: (2024)
par: Wang, Zixiao, et autres
Publié: (2024)
Relative Kinetic Utility for Reasoning-Aware Structural Pruning in Large Language Models
par: Qian, Tianhao
Publié: (2026)
par: Qian, Tianhao
Publié: (2026)
Are Compressed Language Models Less Subgroup Robust?
par: Gee, Leonidas, et autres
Publié: (2024)
par: Gee, Leonidas, et autres
Publié: (2024)
Pruning as a Defense: Reducing Memorization in Large Language Models
par: Gupta, Mansi, et autres
Publié: (2025)
par: Gupta, Mansi, et autres
Publié: (2025)
Building a Strong Instruction Language Model for a Less-Resourced Language
par: Vreš, Domen, et autres
Publié: (2026)
par: Vreš, Domen, et autres
Publié: (2026)
Less Diverse, Less Safe: The Indirect But Pervasive Risk of Test-Time Scaling in Large Language Models
par: Nahin, Shahriar Kabir, et autres
Publié: (2025)
par: Nahin, Shahriar Kabir, et autres
Publié: (2025)
Beware of Calibration Data for Pruning Large Language Models
par: Ji, Yixin, et autres
Publié: (2024)
par: Ji, Yixin, et autres
Publié: (2024)
COPAL: Continual Pruning in Large Language Generative Models
par: Malla, Srikanth, et autres
Publié: (2024)
par: Malla, Srikanth, et autres
Publié: (2024)
PAT: Pruning-Aware Tuning for Large Language Models
par: Liu, Yijiang, et autres
Publié: (2024)
par: Liu, Yijiang, et autres
Publié: (2024)
FoldGPT: Simple and Effective Large Language Model Compression Scheme
par: Liu, Songwei, et autres
Publié: (2024)
par: Liu, Songwei, et autres
Publié: (2024)
Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods
par: Kim, Bo-Kyeong, et autres
Publié: (2024)
par: Kim, Bo-Kyeong, et autres
Publié: (2024)
Z-Pruner: Post-Training Pruning of Large Language Models for Efficiency without Retraining
par: Bhuiyan, Samiul Basir, et autres
Publié: (2025)
par: Bhuiyan, Samiul Basir, et autres
Publié: (2025)
FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing
par: Smith, James Seale, et autres
Publié: (2025)
par: Smith, James Seale, et autres
Publié: (2025)
Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models
par: Jain, Neel, et autres
Publié: (2024)
par: Jain, Neel, et autres
Publié: (2024)
EfficientXpert: Efficient Domain Adaptation for Large Language Models via Propagation-Aware Pruning
par: Zhao, Songlin, et autres
Publié: (2025)
par: Zhao, Songlin, et autres
Publié: (2025)
Documents similaires
-
Linguistic Fingerprint in Transformer Models: How Language Variation Influences Parameter Selection in Irony Detection
par: Mastromattei, Michele, et autres
Publié: (2024) -
Preserving Privacy in Large Language Models: A Survey on Current Threats and Solutions
par: Miranda, Michele, et autres
Publié: (2024) -
Investigating the Impact of Data Contamination of Large Language Models in Text-to-SQL Translation
par: Ranaldi, Federico, et autres
Publié: (2024) -
Exploring Linguistic Properties of Monolingual BERTs with Typological Classification among Languages
par: Ruzzetti, Elena Sofia, et autres
Publié: (2023) -
A Simple and Effective Pruning Approach for Large Language Models
par: Sun, Mingjie, et autres
Publié: (2023)