From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Ziyan, Diao, Enmao, Le, Qi, Wang, Pu, Lee, Minwoo, Yeh, Shu-ping, Stupachenko, Evgeny, Feng, Hao, Yang, Li |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
by: Wang, Ziyan, et al.
Published: (2025)
by: Wang, Ziyan, et al.
Published: (2025)
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
by: Le, Qi, et al.
Published: (2025)
by: Le, Qi, et al.
Published: (2025)
OBCache: Optimal Brain KV Cache Pruning for Efficient Long-Context LLM Inference
by: Gu, Yuzhe, et al.
Published: (2025)
by: Gu, Yuzhe, et al.
Published: (2025)
ESC: Efficient Speech Coding with Cross-Scale Residual Vector Quantized Transformers
by: Gu, Yuzhe, et al.
Published: (2024)
by: Gu, Yuzhe, et al.
Published: (2024)
Large Deviation Analysis of Score-based Hypothesis Testing
by: Diao, Enmao, et al.
Published: (2024)
by: Diao, Enmao, et al.
Published: (2024)
DynamicFL: Federated Learning with Dynamic Communication Resource Allocation
by: Le, Qi, et al.
Published: (2024)
by: Le, Qi, et al.
Published: (2024)
Toward Unifying Group Fairness Evaluation from a Sparsity Perspective
by: Sheng, Zhecheng, et al.
Published: (2025)
by: Sheng, Zhecheng, et al.
Published: (2025)
ColA: Collaborative Adaptation with Gradient Learning
by: Diao, Enmao, et al.
Published: (2024)
by: Diao, Enmao, et al.
Published: (2024)
Does Sentiment Measured Through Language Models Encompass a Broader Expanse of Information From the Options Market?
by: Enmao Liu, et al.
Published: (2025)
by: Enmao Liu, et al.
Published: (2025)
GRASPrune: Global Gating for Budgeted Structured Pruning of Large Language Models
by: Wang, Ziyang, et al.
Published: (2026)
by: Wang, Ziyang, et al.
Published: (2026)
Graph Tokenization for Bridging Graphs and Transformers
by: Guo, Zeyuan, et al.
Published: (2026)
by: Guo, Zeyuan, et al.
Published: (2026)
ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models
by: Chen, Hao, et al.
Published: (2025)
by: Chen, Hao, et al.
Published: (2025)
MAP: Multi-Human-Value Alignment Palette
by: Wang, Xinran, et al.
Published: (2024)
by: Wang, Xinran, et al.
Published: (2024)
Synthetic Tabular Data Generation: A Comparative Survey for Modern Techniques
by: Challagundla, Raju, et al.
Published: (2025)
by: Challagundla, Raju, et al.
Published: (2025)
MMM: Generative Masked Motion Model
by: Pinyoanuntapong, Ekkasit, et al.
Published: (2023)
by: Pinyoanuntapong, Ekkasit, et al.
Published: (2023)
Decolonizing the Global: Contested Cosmopolitanisms in Global Queer Activism
by: Minwoo Jung
Published: (2025)
by: Minwoo Jung
Published: (2025)
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
by: Liu, Jun, et al.
Published: (2024)
by: Liu, Jun, et al.
Published: (2024)
Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
by: Pan, Rui, et al.
Published: (2025)
by: Pan, Rui, et al.
Published: (2025)
Automatic Pruning Discovery for Large Language Models
by: Kang, Haidong, et al.
Published: (2025)
by: Kang, Haidong, et al.
Published: (2025)
SlimLLM: Accurate Structured Pruning for Large Language Models
by: Guo, Jialong, et al.
Published: (2025)
by: Guo, Jialong, et al.
Published: (2025)
Sample-aware Adaptive Structured Pruning for Large Language Models
by: Kong, Jun, et al.
Published: (2025)
by: Kong, Jun, et al.
Published: (2025)
TAMP: Token-Adaptive Layerwise Pruning in Multimodal Large Language Models
by: Lee, Jaewoo, et al.
Published: (2025)
by: Lee, Jaewoo, et al.
Published: (2025)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
by: Luan, Bozhi, et al.
Published: (2025)
by: Luan, Bozhi, et al.
Published: (2025)
Large Language Models and Impossible Language Acquisition: "False Promise" or an Overturn of our Current Perspective towards AI
by: Wang, Ziyan, et al.
Published: (2026)
by: Wang, Ziyan, et al.
Published: (2026)
Revisiting Large Language Model Pruning using Neuron Semantic Attribution
by: Ding, Yizhuo, et al.
Published: (2025)
by: Ding, Yizhuo, et al.
Published: (2025)
Large Language Model Pruning
by: Huang, Hanjuan, et al.
Published: (2024)
by: Huang, Hanjuan, et al.
Published: (2024)
FASP: Fast and Accurate Structured Pruning of Large Language Models
by: Hu, Hanyu, et al.
Published: (2025)
by: Hu, Hanyu, et al.
Published: (2025)
Iterative Structured Pruning for Large Language Models with Multi-Domain Calibration
by: Wu, Guangxin, et al.
Published: (2026)
by: Wu, Guangxin, et al.
Published: (2026)
The Novel HLA‐B*15:681 Allele, Identified by Sanger Dideoxy Nucleotide Sequencing in a Chinese Individual
by: You‐fan Feng, et al.
Published: (2026)
by: You‐fan Feng, et al.
Published: (2026)
SlimGPT: Layer-wise Structured Pruning for Large Language Models
by: Ling, Gui, et al.
Published: (2024)
by: Ling, Gui, et al.
Published: (2024)
Prune, Update and Trim: Robust Structured Pruning for Large Language Models
by: Mecke, Diego Coello de Portugal, et al.
Published: (2026)
by: Mecke, Diego Coello de Portugal, et al.
Published: (2026)
The Structural Scalpel: Automated Contiguous Layer Pruning for Large Language Models
by: Lu, Yao, et al.
Published: (2025)
by: Lu, Yao, et al.
Published: (2025)
Zero-Shot Chinese Character Recognition via Global-Local Dual-Branch Alignment and Hierarchical Inference
by: Cao, Wei, et al.
Published: (2026)
by: Cao, Wei, et al.
Published: (2026)
IG-Pruning: Input-Guided Block Pruning for Large Language Models
by: Qiao, Kangyu, et al.
Published: (2025)
by: Qiao, Kangyu, et al.
Published: (2025)
KVPruner: Structural Pruning for Faster and Memory-Efficient Large Language Models
by: Lv, Bo, et al.
Published: (2024)
by: Lv, Bo, et al.
Published: (2024)
DLGE: Dual Local-Global Encoding for Generalizable Cross-BCI-Paradigm
by: Wang, Jingyuan, et al.
Published: (2025)
by: Wang, Jingyuan, et al.
Published: (2025)
Revisiting Uncertainty Estimation and Calibration of Large Language Models
by: Tao, Linwei, et al.
Published: (2025)
by: Tao, Linwei, et al.
Published: (2025)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
by: Huang, Xiaohu, et al.
Published: (2024)
by: Huang, Xiaohu, et al.
Published: (2024)
Robust Score-Based Quickest Change Detection
by: Moushegian, Sean, et al.
Published: (2024)
by: Moushegian, Sean, et al.
Published: (2024)
RPS: Information Elicitation with Reinforcement Prompt Selection
by: Wang, Tao, et al.
Published: (2026)
by: Wang, Tao, et al.
Published: (2026)
Similar Items
-
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
by: Wang, Ziyan, et al.
Published: (2025) -
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
by: Le, Qi, et al.
Published: (2025) -
OBCache: Optimal Brain KV Cache Pruning for Efficient Long-Context LLM Inference
by: Gu, Yuzhe, et al.
Published: (2025) -
ESC: Efficient Speech Coding with Cross-Scale Residual Vector Quantized Transformers
by: Gu, Yuzhe, et al.
Published: (2024) -
Large Deviation Analysis of Score-based Hypothesis Testing
by: Diao, Enmao, et al.
Published: (2024)