GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Xiaoyun, Saxena, Divya, Cao, Jiannong, Zhao, Yuqing, Dong, Yiying, Ruan, Penghui |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MGAS: Multi-Granularity Architecture Search for Trade-Off Between Model Effectiveness and Efficiency
by: Liu, Xiaoyun, et al.
Published: (2023)
by: Liu, Xiaoyun, et al.
Published: (2023)
AdaptCL: Adaptive Continual Learning for Tackling Heterogeneity in Sequential Datasets
by: Zhao, Yuqing, et al.
Published: (2022)
by: Zhao, Yuqing, et al.
Published: (2022)
FedDistill: Global Model Distillation for Local Model De-Biasing in Non-IID Federated Learning
by: Song, Changlin, et al.
Published: (2024)
by: Song, Changlin, et al.
Published: (2024)
Overcoming Growth-Induced Forgetting in Task-Agnostic Continual Learning
by: Zhao, Yuqing, et al.
Published: (2024)
by: Zhao, Yuqing, et al.
Published: (2024)
Inductive Spatial Temporal Prediction Under Data Drift with Informative Graph Neural Network
by: Zheng, Jialun, et al.
Published: (2024)
by: Zheng, Jialun, et al.
Published: (2024)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
by: Zheng, Haotian, et al.
Published: (2024)
by: Zheng, Haotian, et al.
Published: (2024)
PAT: Pruning-Aware Tuning for Large Language Models
by: Liu, Yijiang, et al.
Published: (2024)
by: Liu, Yijiang, et al.
Published: (2024)
Prompt-prompted Adaptive Structured Pruning for Efficient LLM Generation
by: Dong, Harry, et al.
Published: (2024)
by: Dong, Harry, et al.
Published: (2024)
SwiftPrune: Hessian-Free Weight Pruning for Large Language Models
by: Kang, Yuhan, et al.
Published: (2025)
by: Kang, Yuhan, et al.
Published: (2025)
The Structural Scalpel: Automated Contiguous Layer Pruning for Large Language Models
by: Lu, Yao, et al.
Published: (2025)
by: Lu, Yao, et al.
Published: (2025)
On the Limits of Layer Pruning for Generative Reasoning in Large Language Models
by: Shrestha, Safal, et al.
Published: (2026)
by: Shrestha, Safal, et al.
Published: (2026)
Exploring Federated Pruning for Large Language Models
by: Guo, Pengxin, et al.
Published: (2025)
by: Guo, Pengxin, et al.
Published: (2025)
LLM-Rank: A Graph Theoretical Approach to Pruning Large Language Models
by: Hoffmann, David, et al.
Published: (2024)
by: Hoffmann, David, et al.
Published: (2024)
Effective Illicit Account Detection on Large Cryptocurrency MultiGraphs
by: Ding, Zhihao, et al.
Published: (2023)
by: Ding, Zhihao, et al.
Published: (2023)
ClimateLLM: Efficient Weather Forecasting via Frequency-Aware Large Language Models
by: Li, Shixuan, et al.
Published: (2025)
by: Li, Shixuan, et al.
Published: (2025)
Symmetric Pruning of Large Language Models
by: Yi, Kai, et al.
Published: (2025)
by: Yi, Kai, et al.
Published: (2025)
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
by: Liu, Jun, et al.
Published: (2024)
by: Liu, Jun, et al.
Published: (2024)
Sample-aware Adaptive Structured Pruning for Large Language Models
by: Kong, Jun, et al.
Published: (2025)
by: Kong, Jun, et al.
Published: (2025)
COPAL: Continual Pruning in Large Language Generative Models
by: Malla, Srikanth, et al.
Published: (2024)
by: Malla, Srikanth, et al.
Published: (2024)
Locality-Aware Redundancy Pruning for LLM Depth Compression
by: Yun, Vincent-Daniel, et al.
Published: (2026)
by: Yun, Vincent-Daniel, et al.
Published: (2026)
Large Language Model Pruning
by: Huang, Hanjuan, et al.
Published: (2024)
by: Huang, Hanjuan, et al.
Published: (2024)
Manifold-Aware Temporal Domain Generalization for Large Language Models
by: Yao, Yiheng, et al.
Published: (2026)
by: Yao, Yiheng, et al.
Published: (2026)
On the Limitations of Language Targeted Pruning: Investigating the Calibration Language Impact in Multilingual LLM Pruning
by: Kurz, Simon, et al.
Published: (2024)
by: Kurz, Simon, et al.
Published: (2024)
Sink-Aware Pruning for Diffusion Language Models
by: Myrzakhan, Aidar, et al.
Published: (2026)
by: Myrzakhan, Aidar, et al.
Published: (2026)
IDEA Prune: An Integrated Enlarge-and-Prune Pipeline in Generative Language Model Pretraining
by: Li, Yixiao, et al.
Published: (2025)
by: Li, Yixiao, et al.
Published: (2025)
FedRD: Reducing Divergences for Generalized Federated Learning via Heterogeneity-aware Parameter Guidance
by: Wang, Kaile, et al.
Published: (2026)
by: Wang, Kaile, et al.
Published: (2026)
Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models
by: Xu, Zihuai, et al.
Published: (2025)
by: Xu, Zihuai, et al.
Published: (2025)
Understanding Post-Training Structural Changes in Large Language Models
by: He, Xinyu, et al.
Published: (2025)
by: He, Xinyu, et al.
Published: (2025)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
by: Wang, Ziyan, et al.
Published: (2025)
by: Wang, Ziyan, et al.
Published: (2025)
On Predictability of Reinforcement Learning Dynamics for Large Language Models
by: Cai, Yuchen, et al.
Published: (2025)
by: Cai, Yuchen, et al.
Published: (2025)
CATP-LLM: Empowering Large Language Models for Cost-Aware Tool Planning
by: Wu, Duo, et al.
Published: (2024)
by: Wu, Duo, et al.
Published: (2024)
PickLLM: Context-Aware RL-Assisted Large Language Model Routing
by: Sikeridis, Dimitrios, et al.
Published: (2024)
by: Sikeridis, Dimitrios, et al.
Published: (2024)
LEAP: Learnable End-to-End Adaptive Pruning of Large Language Models
by: Mozaffari, Mohammad, et al.
Published: (2026)
by: Mozaffari, Mohammad, et al.
Published: (2026)
PaTaRM: Bridging Pairwise and Pointwise Signals via Preference-Aware Task-Adaptive Reward Modeling
by: Jian, Ai, et al.
Published: (2025)
by: Jian, Ai, et al.
Published: (2025)
Exploiting Latent Linearity in LLMs Improves Explainable Molecular Representation Learning
by: Li, Zhuoran, et al.
Published: (2024)
by: Li, Zhuoran, et al.
Published: (2024)
Less is More: Unlocking Specialization of Time Series Foundation Models via Structured Pruning
by: Zhao, Lifan, et al.
Published: (2025)
by: Zhao, Lifan, et al.
Published: (2025)
A Simple and Effective Pruning Approach for Large Language Models
by: Sun, Mingjie, et al.
Published: (2023)
by: Sun, Mingjie, et al.
Published: (2023)
FedCCA: Client-Centric Adaptation against Data Heterogeneity in Federated Learning on IoT Devices
by: Wang, Kaile, et al.
Published: (2026)
by: Wang, Kaile, et al.
Published: (2026)
On Token's Dilemma: Dynamic MoE with Drift-Aware Token Assignment for Continual Learning of Large Vision Language Models
by: Zhao, Chongyang, et al.
Published: (2026)
by: Zhao, Chongyang, et al.
Published: (2026)
StructPrune: Structured Global Pruning asymptotics with $\mathcal{O}(\sqrt{N})$ GPU Memory
by: Song, Xinyuan, et al.
Published: (2025)
by: Song, Xinyuan, et al.
Published: (2025)
Similar Items
-
MGAS: Multi-Granularity Architecture Search for Trade-Off Between Model Effectiveness and Efficiency
by: Liu, Xiaoyun, et al.
Published: (2023) -
AdaptCL: Adaptive Continual Learning for Tackling Heterogeneity in Sequential Datasets
by: Zhao, Yuqing, et al.
Published: (2022) -
FedDistill: Global Model Distillation for Local Model De-Biasing in Non-IID Federated Learning
by: Song, Changlin, et al.
Published: (2024) -
Overcoming Growth-Induced Forgetting in Task-Agnostic Continual Learning
by: Zhao, Yuqing, et al.
Published: (2024) -
Inductive Spatial Temporal Prediction Under Data Drift with Informative Graph Neural Network
by: Zheng, Jialun, et al.
Published: (2024)