Relative Kinetic Utility for Reasoning-Aware Structural Pruning in Large Language Models
Fuente:
arXiv
Guardado en:
| Autor principal: | Qian, Tianhao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Adaptive Pruning for Large Language Models with Structural Importance Awareness
por: Zheng, Haotian, et al.
Publicado: (2024)
por: Zheng, Haotian, et al.
Publicado: (2024)
Deterministic Differentiable Structured Pruning for Large Language Models
por: Huang, Weiyu, et al.
Publicado: (2026)
por: Huang, Weiyu, et al.
Publicado: (2026)
DarwinLM: Evolutionary Structured Pruning of Large Language Models
por: Tang, Shengkun, et al.
Publicado: (2025)
por: Tang, Shengkun, et al.
Publicado: (2025)
PAT: Pruning-Aware Tuning for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2024)
por: Liu, Yijiang, et al.
Publicado: (2024)
Olica: Efficient Structured Pruning of Large Language Models without Retraining
por: He, Jiujun, et al.
Publicado: (2025)
por: He, Jiujun, et al.
Publicado: (2025)
DISP-LLM: Dimension-Independent Structural Pruning for Large Language Models
por: Gao, Shangqian, et al.
Publicado: (2024)
por: Gao, Shangqian, et al.
Publicado: (2024)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
por: Wang, Ziyan, et al.
Publicado: (2025)
por: Wang, Ziyan, et al.
Publicado: (2025)
EfficientXpert: Efficient Domain Adaptation for Large Language Models via Propagation-Aware Pruning
por: Zhao, Songlin, et al.
Publicado: (2025)
por: Zhao, Songlin, et al.
Publicado: (2025)
ToMoE: Converting Dense Large Language Models to Mixture-of-Experts through Dynamic Structural Pruning
por: Gao, Shangqian, et al.
Publicado: (2025)
por: Gao, Shangqian, et al.
Publicado: (2025)
Sample-aware Adaptive Structured Pruning for Large Language Models
por: Kong, Jun, et al.
Publicado: (2025)
por: Kong, Jun, et al.
Publicado: (2025)
FERA: Uncertainty-Aware Federated Reasoning for Large Language Models
por: Wang, Ruhan, et al.
Publicado: (2026)
por: Wang, Ruhan, et al.
Publicado: (2026)
Large Language Model Pruning
por: Huang, Hanjuan, et al.
Publicado: (2024)
por: Huang, Hanjuan, et al.
Publicado: (2024)
Structured Pruning for Diverse Best-of-N Reasoning Optimization
por: Nguyen, Hieu Trung, et al.
Publicado: (2025)
por: Nguyen, Hieu Trung, et al.
Publicado: (2025)
Sink-Aware Pruning for Diffusion Language Models
por: Myrzakhan, Aidar, et al.
Publicado: (2026)
por: Myrzakhan, Aidar, et al.
Publicado: (2026)
Bypass Back-propagation: Optimization-based Structural Pruning for Large Language Models via Policy Gradient
por: Gao, Yuan, et al.
Publicado: (2024)
por: Gao, Yuan, et al.
Publicado: (2024)
Harnessing the Power of Large Language Model for Uncertainty Aware Graph Processing
por: Qian, Zhenyu, et al.
Publicado: (2024)
por: Qian, Zhenyu, et al.
Publicado: (2024)
Frustratingly Easy Task-aware Pruning for Large Language Models
por: Tian, Yuanhe, et al.
Publicado: (2025)
por: Tian, Yuanhe, et al.
Publicado: (2025)
Fast and Effective Weight Update for Pruned Large Language Models
por: Boža, Vladimír
Publicado: (2024)
por: Boža, Vladimír
Publicado: (2024)
Detecting and Pruning Prominent but Detrimental Neurons in Large Language Models
por: Ali, Ameen, et al.
Publicado: (2025)
por: Ali, Ameen, et al.
Publicado: (2025)
PIP: Perturbation-based Iterative Pruning for Large Language Models
por: Cao, Yi, et al.
Publicado: (2025)
por: Cao, Yi, et al.
Publicado: (2025)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
por: Wang, Ziyan, et al.
Publicado: (2025)
por: Wang, Ziyan, et al.
Publicado: (2025)
Efficient Post-Training Pruning of Large Language Models with Statistical Correction
por: Yu, Peiqi, et al.
Publicado: (2026)
por: Yu, Peiqi, et al.
Publicado: (2026)
Self-Data Distillation for Recovering Quality in Pruned Large Language Models
por: Thangarasa, Vithursan, et al.
Publicado: (2024)
por: Thangarasa, Vithursan, et al.
Publicado: (2024)
Mostly Text, Smart Visuals: Asymmetric Text-Visual Pruning for Large Vision-Language Models
por: Li, Sijie, et al.
Publicado: (2026)
por: Li, Sijie, et al.
Publicado: (2026)
Structural Pruning of Pre-trained Language Models via Neural Architecture Search
por: Klein, Aaron, et al.
Publicado: (2024)
por: Klein, Aaron, et al.
Publicado: (2024)
Rethinking Pruning Large Language Models: Benefits and Pitfalls of Reconstruction Error Minimization
por: Shin, Sungbin, et al.
Publicado: (2024)
por: Shin, Sungbin, et al.
Publicado: (2024)
MoreauPruner: Robust Pruning of Large Language Models against Weight Perturbations
por: Wang, Zixiao, et al.
Publicado: (2024)
por: Wang, Zixiao, et al.
Publicado: (2024)
Beware of Calibration Data for Pruning Large Language Models
por: Ji, Yixin, et al.
Publicado: (2024)
por: Ji, Yixin, et al.
Publicado: (2024)
COPAL: Continual Pruning in Large Language Generative Models
por: Malla, Srikanth, et al.
Publicado: (2024)
por: Malla, Srikanth, et al.
Publicado: (2024)
Confidence in the Reasoning of Large Language Models
por: Pawitan, Yudi, et al.
Publicado: (2024)
por: Pawitan, Yudi, et al.
Publicado: (2024)
CAST: Continuous and Differentiable Semi-Structured Sparsity-Aware Training for Large Language Models
por: Huang, Weiyu, et al.
Publicado: (2025)
por: Huang, Weiyu, et al.
Publicado: (2025)
Z-Pruner: Post-Training Pruning of Large Language Models for Efficiency without Retraining
por: Bhuiyan, Samiul Basir, et al.
Publicado: (2025)
por: Bhuiyan, Samiul Basir, et al.
Publicado: (2025)
Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods
por: Kim, Bo-Kyeong, et al.
Publicado: (2024)
por: Kim, Bo-Kyeong, et al.
Publicado: (2024)
FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing
por: Smith, James Seale, et al.
Publicado: (2025)
por: Smith, James Seale, et al.
Publicado: (2025)
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
por: Liu, Jun, et al.
Publicado: (2024)
por: Liu, Jun, et al.
Publicado: (2024)
STUN: Structured-Then-Unstructured Pruning for Scalable MoE Pruning
por: Lee, Jaeseong, et al.
Publicado: (2024)
por: Lee, Jaeseong, et al.
Publicado: (2024)
The Structure of Relation Decoding Linear Operators in Large Language Models
por: Christ, Miranda Anna, et al.
Publicado: (2025)
por: Christ, Miranda Anna, et al.
Publicado: (2025)
ROSE: Reordered SparseGPT for More Accurate One-Shot Large Language Models Pruning
por: Su, Mingluo, et al.
Publicado: (2026)
por: Su, Mingluo, et al.
Publicado: (2026)
NeuroPrune: A Neuro-inspired Topological Sparse Training Algorithm for Large Language Models
por: Dhurandhar, Amit, et al.
Publicado: (2024)
por: Dhurandhar, Amit, et al.
Publicado: (2024)
Less is KEN: a Universal and Simple Non-Parametric Pruning Algorithm for Large Language Models
por: Mastromattei, Michele, et al.
Publicado: (2024)
por: Mastromattei, Michele, et al.
Publicado: (2024)
Ejemplares similares
-
Adaptive Pruning for Large Language Models with Structural Importance Awareness
por: Zheng, Haotian, et al.
Publicado: (2024) -
Deterministic Differentiable Structured Pruning for Large Language Models
por: Huang, Weiyu, et al.
Publicado: (2026) -
DarwinLM: Evolutionary Structured Pruning of Large Language Models
por: Tang, Shengkun, et al.
Publicado: (2025) -
PAT: Pruning-Aware Tuning for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2024) -
Olica: Efficient Structured Pruning of Large Language Models without Retraining
por: He, Jiujun, et al.
Publicado: (2025)