Less is KEN: a Universal and Simple Non-Parametric Pruning Algorithm for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Mastromattei, Michele, Zanzotto, Fabio Massimo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Linguistic Fingerprint in Transformer Models: How Language Variation Influences Parameter Selection in Irony Detection
di: Mastromattei, Michele, et al.
Pubblicazione: (2024)
di: Mastromattei, Michele, et al.
Pubblicazione: (2024)
Preserving Privacy in Large Language Models: A Survey on Current Threats and Solutions
di: Miranda, Michele, et al.
Pubblicazione: (2024)
di: Miranda, Michele, et al.
Pubblicazione: (2024)
Investigating the Impact of Data Contamination of Large Language Models in Text-to-SQL Translation
di: Ranaldi, Federico, et al.
Pubblicazione: (2024)
di: Ranaldi, Federico, et al.
Pubblicazione: (2024)
Exploring Linguistic Properties of Monolingual BERTs with Typological Classification among Languages
di: Ruzzetti, Elena Sofia, et al.
Pubblicazione: (2023)
di: Ruzzetti, Elena Sofia, et al.
Pubblicazione: (2023)
A Simple and Effective Pruning Approach for Large Language Models
di: Sun, Mingjie, et al.
Pubblicazione: (2023)
di: Sun, Mingjie, et al.
Pubblicazione: (2023)
The Dark Side of the Language: Pre-trained Transformers in the DarkNet
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2022)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2022)
Animate, or Inanimate, That is the Question for Large Language Models
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2024)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2024)
NeuroPrune: A Neuro-inspired Topological Sparse Training Algorithm for Large Language Models
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)
Every time I fire a conversational designer, the performance of the dialog system goes down
di: Xompero, Giancarlo A., et al.
Pubblicazione: (2021)
di: Xompero, Giancarlo A., et al.
Pubblicazione: (2021)
Large Language Model Pruning
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
Deterministic Differentiable Structured Pruning for Large Language Models
di: Huang, Weiyu, et al.
Pubblicazione: (2026)
di: Huang, Weiyu, et al.
Pubblicazione: (2026)
Fast and Effective Weight Update for Pruned Large Language Models
di: Boža, Vladimír
Pubblicazione: (2024)
di: Boža, Vladimír
Pubblicazione: (2024)
DarwinLM: Evolutionary Structured Pruning of Large Language Models
di: Tang, Shengkun, et al.
Pubblicazione: (2025)
di: Tang, Shengkun, et al.
Pubblicazione: (2025)
Frustratingly Easy Task-aware Pruning for Large Language Models
di: Tian, Yuanhe, et al.
Pubblicazione: (2025)
di: Tian, Yuanhe, et al.
Pubblicazione: (2025)
Detecting and Pruning Prominent but Detrimental Neurons in Large Language Models
di: Ali, Ameen, et al.
Pubblicazione: (2025)
di: Ali, Ameen, et al.
Pubblicazione: (2025)
PIP: Perturbation-based Iterative Pruning for Large Language Models
di: Cao, Yi, et al.
Pubblicazione: (2025)
di: Cao, Yi, et al.
Pubblicazione: (2025)
Self-Data Distillation for Recovering Quality in Pruned Large Language Models
di: Thangarasa, Vithursan, et al.
Pubblicazione: (2024)
di: Thangarasa, Vithursan, et al.
Pubblicazione: (2024)
DISP-LLM: Dimension-Independent Structural Pruning for Large Language Models
di: Gao, Shangqian, et al.
Pubblicazione: (2024)
di: Gao, Shangqian, et al.
Pubblicazione: (2024)
Efficient Post-Training Pruning of Large Language Models with Statistical Correction
di: Yu, Peiqi, et al.
Pubblicazione: (2026)
di: Yu, Peiqi, et al.
Pubblicazione: (2026)
Olica: Efficient Structured Pruning of Large Language Models without Retraining
di: He, Jiujun, et al.
Pubblicazione: (2025)
di: He, Jiujun, et al.
Pubblicazione: (2025)
Cram Less to Fit More: Training Data Pruning Improves Memorization of Facts
di: Ye, Jiayuan, et al.
Pubblicazione: (2026)
di: Ye, Jiayuan, et al.
Pubblicazione: (2026)
Abstract Activation Spaces for Content-Invariant Reasoning in Large Language Models
di: Maraia, Gabriele, et al.
Pubblicazione: (2026)
di: Maraia, Gabriele, et al.
Pubblicazione: (2026)
Less but Better: Parameter-Efficient Fine-Tuning of Large Language Models for Personality Detection
di: Shen, Lingzhi, et al.
Pubblicazione: (2025)
di: Shen, Lingzhi, et al.
Pubblicazione: (2025)
Efficient Non-Parametric Uncertainty Quantification for Black-Box Large Language Models and Decision Planning
di: Tsai, Yao-Hung Hubert, et al.
Pubblicazione: (2024)
di: Tsai, Yao-Hung Hubert, et al.
Pubblicazione: (2024)
Rethinking Pruning Large Language Models: Benefits and Pitfalls of Reconstruction Error Minimization
di: Shin, Sungbin, et al.
Pubblicazione: (2024)
di: Shin, Sungbin, et al.
Pubblicazione: (2024)
MoreauPruner: Robust Pruning of Large Language Models against Weight Perturbations
di: Wang, Zixiao, et al.
Pubblicazione: (2024)
di: Wang, Zixiao, et al.
Pubblicazione: (2024)
Relative Kinetic Utility for Reasoning-Aware Structural Pruning in Large Language Models
di: Qian, Tianhao
Pubblicazione: (2026)
di: Qian, Tianhao
Pubblicazione: (2026)
Are Compressed Language Models Less Subgroup Robust?
di: Gee, Leonidas, et al.
Pubblicazione: (2024)
di: Gee, Leonidas, et al.
Pubblicazione: (2024)
Pruning as a Defense: Reducing Memorization in Large Language Models
di: Gupta, Mansi, et al.
Pubblicazione: (2025)
di: Gupta, Mansi, et al.
Pubblicazione: (2025)
Building a Strong Instruction Language Model for a Less-Resourced Language
di: Vreš, Domen, et al.
Pubblicazione: (2026)
di: Vreš, Domen, et al.
Pubblicazione: (2026)
Less Diverse, Less Safe: The Indirect But Pervasive Risk of Test-Time Scaling in Large Language Models
di: Nahin, Shahriar Kabir, et al.
Pubblicazione: (2025)
di: Nahin, Shahriar Kabir, et al.
Pubblicazione: (2025)
Beware of Calibration Data for Pruning Large Language Models
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
COPAL: Continual Pruning in Large Language Generative Models
di: Malla, Srikanth, et al.
Pubblicazione: (2024)
di: Malla, Srikanth, et al.
Pubblicazione: (2024)
PAT: Pruning-Aware Tuning for Large Language Models
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
FoldGPT: Simple and Effective Large Language Model Compression Scheme
di: Liu, Songwei, et al.
Pubblicazione: (2024)
di: Liu, Songwei, et al.
Pubblicazione: (2024)
Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods
di: Kim, Bo-Kyeong, et al.
Pubblicazione: (2024)
di: Kim, Bo-Kyeong, et al.
Pubblicazione: (2024)
Z-Pruner: Post-Training Pruning of Large Language Models for Efficiency without Retraining
di: Bhuiyan, Samiul Basir, et al.
Pubblicazione: (2025)
di: Bhuiyan, Samiul Basir, et al.
Pubblicazione: (2025)
FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing
di: Smith, James Seale, et al.
Pubblicazione: (2025)
di: Smith, James Seale, et al.
Pubblicazione: (2025)
Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models
di: Jain, Neel, et al.
Pubblicazione: (2024)
di: Jain, Neel, et al.
Pubblicazione: (2024)
EfficientXpert: Efficient Domain Adaptation for Large Language Models via Propagation-Aware Pruning
di: Zhao, Songlin, et al.
Pubblicazione: (2025)
di: Zhao, Songlin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Linguistic Fingerprint in Transformer Models: How Language Variation Influences Parameter Selection in Irony Detection
di: Mastromattei, Michele, et al.
Pubblicazione: (2024) -
Preserving Privacy in Large Language Models: A Survey on Current Threats and Solutions
di: Miranda, Michele, et al.
Pubblicazione: (2024) -
Investigating the Impact of Data Contamination of Large Language Models in Text-to-SQL Translation
di: Ranaldi, Federico, et al.
Pubblicazione: (2024) -
Exploring Linguistic Properties of Monolingual BERTs with Typological Classification among Languages
di: Ruzzetti, Elena Sofia, et al.
Pubblicazione: (2023) -
A Simple and Effective Pruning Approach for Large Language Models
di: Sun, Mingjie, et al.
Pubblicazione: (2023)