One-Shot Sensitivity-Aware Mixed Sparsity Pruning for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Shao, Hang, Liu, Bei, Xiao, Bo, Zeng, Ke, Wan, Guanglu, Qian, Yanmin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LLM-Barber: Block-Aware Rebuilder for Sparsity Mask in One-Shot for Large Language Models
por: Su, Yupeng, et al.
Publicado: (2024)
por: Su, Yupeng, et al.
Publicado: (2024)
Sparsity Induction for Accurate Post-Training Pruning of Large Language Models
por: Jiang, Minhao, et al.
Publicado: (2026)
por: Jiang, Minhao, et al.
Publicado: (2026)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
por: Xu, Peng, et al.
Publicado: (2024)
por: Xu, Peng, et al.
Publicado: (2024)
PGB: One-Shot Pruning for BERT via Weight Grouping and Permutation
por: Lim, Hyemin, et al.
Publicado: (2025)
por: Lim, Hyemin, et al.
Publicado: (2025)
Sensitivity Meets Sparsity: The Impact of Extremely Sparse Parameter Patterns on Theory-of-Mind of Large Language Models
por: Wu, Yuheng, et al.
Publicado: (2025)
por: Wu, Yuheng, et al.
Publicado: (2025)
PAT: Pruning-Aware Tuning for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2024)
por: Liu, Yijiang, et al.
Publicado: (2024)
DenoiseRotator: Enhance Pruning Robustness for LLMs via Importance Concentration
por: Gu, Tianteng, et al.
Publicado: (2025)
por: Gu, Tianteng, et al.
Publicado: (2025)
One-Shot Learning as Instruction Data Prospector for Large Language Models
por: Li, Yunshui, et al.
Publicado: (2023)
por: Li, Yunshui, et al.
Publicado: (2023)
Enhancing Large Language Model for Knowledge Graph Completion via Structure-Aware Alignment-Tuning
por: Liu, Yu, et al.
Publicado: (2025)
por: Liu, Yu, et al.
Publicado: (2025)
Training-Free Activation Sparsity in Large Language Models
por: Liu, James, et al.
Publicado: (2024)
por: Liu, James, et al.
Publicado: (2024)
DLP: Dynamic Layerwise Pruning in Large Language Models
por: Chen, Yuli, et al.
Publicado: (2025)
por: Chen, Yuli, et al.
Publicado: (2025)
M-Wanda: Improving One-Shot Pruning for Multilingual LLMs
por: Choenni, Rochelle, et al.
Publicado: (2025)
por: Choenni, Rochelle, et al.
Publicado: (2025)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
por: Zheng, Haotian, et al.
Publicado: (2024)
por: Zheng, Haotian, et al.
Publicado: (2024)
Dependency-Aware Semi-Structured Sparsity of GLU Variants in Large Language Models
por: Guo, Zhiyu, et al.
Publicado: (2024)
por: Guo, Zhiyu, et al.
Publicado: (2024)
SparK: Query-Aware Unstructured Sparsity with Recoverable KV Cache Channel Pruning
por: Liao, Huanxuan, et al.
Publicado: (2025)
por: Liao, Huanxuan, et al.
Publicado: (2025)
CLAQ: Pushing the Limits of Low-Bit Post-Training Quantization for LLMs
por: Wang, Haoyu, et al.
Publicado: (2024)
por: Wang, Haoyu, et al.
Publicado: (2024)
Large Language Model Pruning
por: Huang, Hanjuan, et al.
Publicado: (2024)
por: Huang, Hanjuan, et al.
Publicado: (2024)
TOFA: Training-Free One-Shot Federated Adaptation for Vision-Language Models
por: Zhang, Li, et al.
Publicado: (2025)
por: Zhang, Li, et al.
Publicado: (2025)
Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models
por: Cheng, Xin, et al.
Publicado: (2026)
por: Cheng, Xin, et al.
Publicado: (2026)
OneNet: A Fine-Tuning Free Framework for Few-Shot Entity Linking via Large Language Model Prompting
por: Liu, Xukai, et al.
Publicado: (2024)
por: Liu, Xukai, et al.
Publicado: (2024)
Learn To be Efficient: Build Structured Sparsity in Large Language Models
por: Zheng, Haizhong, et al.
Publicado: (2024)
por: Zheng, Haizhong, et al.
Publicado: (2024)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
por: Huang, Pengcheng, et al.
Publicado: (2024)
por: Huang, Pengcheng, et al.
Publicado: (2024)
Prompt-based Depth Pruning of Large Language Models
por: Wee, Juyun, et al.
Publicado: (2025)
por: Wee, Juyun, et al.
Publicado: (2025)
Sink-Aware Pruning for Diffusion Language Models
por: Myrzakhan, Aidar, et al.
Publicado: (2026)
por: Myrzakhan, Aidar, et al.
Publicado: (2026)
ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models
por: Chen, Hao, et al.
Publicado: (2025)
por: Chen, Hao, et al.
Publicado: (2025)
Pruning General Large Language Models into Customized Expert Models
por: Zhao, Yirao, et al.
Publicado: (2025)
por: Zhao, Yirao, et al.
Publicado: (2025)
DPPA: Pruning Method for Large Language Model to Model Merging
por: Zhu, Yaochen, et al.
Publicado: (2024)
por: Zhu, Yaochen, et al.
Publicado: (2024)
Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs
por: Li, Bo, et al.
Publicado: (2026)
por: Li, Bo, et al.
Publicado: (2026)
Meta In-Context Learning Makes Large Language Models Better Zero and Few-Shot Relation Extractors
por: Li, Guozheng, et al.
Publicado: (2024)
por: Li, Guozheng, et al.
Publicado: (2024)
RegMix: Data Mixture as Regression for Language Model Pre-training
por: Liu, Qian, et al.
Publicado: (2024)
por: Liu, Qian, et al.
Publicado: (2024)
Investigating Hallucinations in Pruned Large Language Models for Abstractive Summarization
por: Chrysostomou, George, et al.
Publicado: (2023)
por: Chrysostomou, George, et al.
Publicado: (2023)
Entropy-Based Block Pruning for Efficient Large Language Models
por: Yang, Liangwei, et al.
Publicado: (2025)
por: Yang, Liangwei, et al.
Publicado: (2025)
Saliency-driven Dynamic Token Pruning for Large Language Models
por: Tao, Yao, et al.
Publicado: (2025)
por: Tao, Yao, et al.
Publicado: (2025)
Do Large Language Models Possess Sensitive to Sentiment?
por: Liu, Yang, et al.
Publicado: (2024)
por: Liu, Yang, et al.
Publicado: (2024)
FedPT: Federated Proxy-Tuning of Large Language Models on Resource-Constrained Edge Devices
por: Gao, Zhidong, et al.
Publicado: (2024)
por: Gao, Zhidong, et al.
Publicado: (2024)
CoVoMix: Advancing Zero-Shot Speech Generation for Human-like Multi-talker Conversations
por: Zhang, Leying, et al.
Publicado: (2024)
por: Zhang, Leying, et al.
Publicado: (2024)
Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification
por: Liu, Bei, et al.
Publicado: (2024)
por: Liu, Bei, et al.
Publicado: (2024)
One2set + Large Language Model: Best Partners for Keyphrase Generation
por: Shao, Liangying, et al.
Publicado: (2024)
por: Shao, Liangying, et al.
Publicado: (2024)
A Simple and Effective Pruning Approach for Large Language Models
por: Sun, Mingjie, et al.
Publicado: (2023)
por: Sun, Mingjie, et al.
Publicado: (2023)
Pruning Large Language Models to Intra-module Low-rank Architecture with Transitional Activations
por: Shen, Bowen, et al.
Publicado: (2024)
por: Shen, Bowen, et al.
Publicado: (2024)
Ejemplares similares
-
LLM-Barber: Block-Aware Rebuilder for Sparsity Mask in One-Shot for Large Language Models
por: Su, Yupeng, et al.
Publicado: (2024) -
Sparsity Induction for Accurate Post-Training Pruning of Large Language Models
por: Jiang, Minhao, et al.
Publicado: (2026) -
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
por: Xu, Peng, et al.
Publicado: (2024) -
PGB: One-Shot Pruning for BERT via Weight Grouping and Permutation
por: Lim, Hyemin, et al.
Publicado: (2025) -
Sensitivity Meets Sparsity: The Impact of Extremely Sparse Parameter Patterns on Theory-of-Mind of Large Language Models
por: Wu, Yuheng, et al.
Publicado: (2025)