GRASPrune: Global Gating for Budgeted Structured Pruning of Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Ziyang, Xiao, Jiangfeng, Xiao, Chuan, Li, Ruoxiang, Mao, Rui, Qin, Jianbin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SlimGPT: Layer-wise Structured Pruning for Large Language Models
por: Ling, Gui, et al.
Publicado: (2024)
por: Ling, Gui, et al.
Publicado: (2024)
MODIX: A Training-Free Multimodal Information-Driven Positional Index Scaling for Vision-Language Models
por: Huang, Ruoxiang, et al.
Publicado: (2026)
por: Huang, Ruoxiang, et al.
Publicado: (2026)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
por: Wang, Ziyan, et al.
Publicado: (2025)
por: Wang, Ziyan, et al.
Publicado: (2025)
Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models
por: Sun, Chuan, et al.
Publicado: (2025)
por: Sun, Chuan, et al.
Publicado: (2025)
Large Language Models as Data Preprocessors
por: Zhang, Haochen, et al.
Publicado: (2023)
por: Zhang, Haochen, et al.
Publicado: (2023)
DPPA: Pruning Method for Large Language Model to Model Merging
por: Zhu, Yaochen, et al.
Publicado: (2024)
por: Zhu, Yaochen, et al.
Publicado: (2024)
Phased Instruction Fine-Tuning for Large Language Models
por: Pang, Wei, et al.
Publicado: (2024)
por: Pang, Wei, et al.
Publicado: (2024)
Affective Flow Language Model for Emotional Support Conversation
por: Zou, Chenghui, et al.
Publicado: (2026)
por: Zou, Chenghui, et al.
Publicado: (2026)
ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models
por: Chen, Hao, et al.
Publicado: (2025)
por: Chen, Hao, et al.
Publicado: (2025)
Open-SQL Framework: Enhancing Text-to-SQL on Open-source Large Language Models
por: Chen, Xiaojun, et al.
Publicado: (2024)
por: Chen, Xiaojun, et al.
Publicado: (2024)
Exploring Federated Pruning for Large Language Models
por: Guo, Pengxin, et al.
Publicado: (2025)
por: Guo, Pengxin, et al.
Publicado: (2025)
The Structural Scalpel: Automated Contiguous Layer Pruning for Large Language Models
por: Lu, Yao, et al.
Publicado: (2025)
por: Lu, Yao, et al.
Publicado: (2025)
Sample-aware Adaptive Structured Pruning for Large Language Models
por: Kong, Jun, et al.
Publicado: (2025)
por: Kong, Jun, et al.
Publicado: (2025)
One-Shot Sensitivity-Aware Mixed Sparsity Pruning for Large Language Models
por: Shao, Hang, et al.
Publicado: (2023)
por: Shao, Hang, et al.
Publicado: (2023)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
por: Zheng, Haotian, et al.
Publicado: (2024)
por: Zheng, Haotian, et al.
Publicado: (2024)
Toward Graph-Tokenizing Large Language Models with Reconstructive Graph Instruction Tuning
por: Zhang, Zhongjian, et al.
Publicado: (2026)
por: Zhang, Zhongjian, et al.
Publicado: (2026)
GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
por: Liu, Xiaoyun, et al.
Publicado: (2026)
por: Liu, Xiaoyun, et al.
Publicado: (2026)
Pruning Large Language Models with Semi-Structural Adaptive Sparse Training
por: Huang, Weiyu, et al.
Publicado: (2024)
por: Huang, Weiyu, et al.
Publicado: (2024)
SwapMoE: Serving Off-the-shelf MoE-based Large Language Models with Tunable Memory Budget
por: Kong, Rui, et al.
Publicado: (2023)
por: Kong, Rui, et al.
Publicado: (2023)
Understanding Performance Collapse in Layer-Pruned Large Language Models via Decision Representation Transitions
por: Shi, Boyu, et al.
Publicado: (2026)
por: Shi, Boyu, et al.
Publicado: (2026)
CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
por: Tang, Zicong, et al.
Publicado: (2025)
por: Tang, Zicong, et al.
Publicado: (2025)
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
por: Chang, Aofei, et al.
Publicado: (2024)
por: Chang, Aofei, et al.
Publicado: (2024)
Training Large Language Models To Reason In Parallel With Global Forking Tokens
por: Jia, Sheng, et al.
Publicado: (2025)
por: Jia, Sheng, et al.
Publicado: (2025)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
por: Wang, Ziyan, et al.
Publicado: (2025)
por: Wang, Ziyan, et al.
Publicado: (2025)
Symmetric Pruning of Large Language Models
por: Yi, Kai, et al.
Publicado: (2025)
por: Yi, Kai, et al.
Publicado: (2025)
Jellyfish: A Large Language Model for Data Preprocessing
por: Zhang, Haochen, et al.
Publicado: (2023)
por: Zhang, Haochen, et al.
Publicado: (2023)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
por: Li, Ao, et al.
Publicado: (2025)
por: Li, Ao, et al.
Publicado: (2025)
Large Language Model Pruning
por: Huang, Hanjuan, et al.
Publicado: (2024)
por: Huang, Hanjuan, et al.
Publicado: (2024)
SwiftPrune: Hessian-Free Weight Pruning for Large Language Models
por: Kang, Yuhan, et al.
Publicado: (2025)
por: Kang, Yuhan, et al.
Publicado: (2025)
Enhancing Conversational Recommender Systems with Tree-Structured Knowledge and Pretrained Language Models
por: Ren, Yongwen, et al.
Publicado: (2025)
por: Ren, Yongwen, et al.
Publicado: (2025)
Beware of Calibration Data for Pruning Large Language Models
por: Ji, Yixin, et al.
Publicado: (2024)
por: Ji, Yixin, et al.
Publicado: (2024)
The Emergence of Altruism in Large-Language-Model Agents Society
por: Li, Haoyang, et al.
Publicado: (2025)
por: Li, Haoyang, et al.
Publicado: (2025)
DLP: Dynamic Layerwise Pruning in Large Language Models
por: Chen, Yuli, et al.
Publicado: (2025)
por: Chen, Yuli, et al.
Publicado: (2025)
Adaptive Layer Selection for Layer-Wise Token Pruning in LLM Inference
por: Taniguchi, Rei, et al.
Publicado: (2026)
por: Taniguchi, Rei, et al.
Publicado: (2026)
The Emergence of Social Science of Large Language Models
por: Jia, Xiao, et al.
Publicado: (2025)
por: Jia, Xiao, et al.
Publicado: (2025)
Saliency-driven Dynamic Token Pruning for Large Language Models
por: Tao, Yao, et al.
Publicado: (2025)
por: Tao, Yao, et al.
Publicado: (2025)
Liger: Linearizing Large Language Models to Gated Recurrent Structures
por: Lan, Disen, et al.
Publicado: (2025)
por: Lan, Disen, et al.
Publicado: (2025)
POP: Online Structural Pruning Enables Efficient Inference of Large Foundation Models
por: Chen, Yi, et al.
Publicado: (2026)
por: Chen, Yi, et al.
Publicado: (2026)
PAT: Pruning-Aware Tuning for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2024)
por: Liu, Yijiang, et al.
Publicado: (2024)
A Comprehensive Study of Structural Pruning for Vision Models
por: Li, Changhao, et al.
Publicado: (2024)
por: Li, Changhao, et al.
Publicado: (2024)
Ejemplares similares
-
SlimGPT: Layer-wise Structured Pruning for Large Language Models
por: Ling, Gui, et al.
Publicado: (2024) -
MODIX: A Training-Free Multimodal Information-Driven Positional Index Scaling for Vision-Language Models
por: Huang, Ruoxiang, et al.
Publicado: (2026) -
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
por: Wang, Ziyan, et al.
Publicado: (2025) -
Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models
por: Sun, Chuan, et al.
Publicado: (2025) -
Large Language Models as Data Preprocessors
por: Zhang, Haochen, et al.
Publicado: (2023)