Maximum Redundancy Pruning: A Principle-Driven Layerwise Sparsity Allocation for LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gao, Chang, Zhao, Kang, Wang, Runqi, Chen, Jianfei, Jing, Liping |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
par: Xu, Peng, et autres
Publié: (2024)
par: Xu, Peng, et autres
Publié: (2024)
Beyond 2:4: exploring V:N:M sparsity for efficient transformer inference on GPUs
par: Zhao, Kang, et autres
Publié: (2024)
par: Zhao, Kang, et autres
Publié: (2024)
Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity
par: Yin, Lu, et autres
Publié: (2023)
par: Yin, Lu, et autres
Publié: (2023)
Layerwise Recall and the Geometry of Interwoven Knowledge in LLMs
par: Lei, Ge, et autres
Publié: (2025)
par: Lei, Ge, et autres
Publié: (2025)
Locality-Aware Redundancy Pruning for LLM Depth Compression
par: Yun, Vincent-Daniel, et autres
Publié: (2026)
par: Yun, Vincent-Daniel, et autres
Publié: (2026)
Beyond One-Way Pruning: Bidirectional Pruning-Regrowth for Extreme Accuracy-Sparsity Tradeoff
par: Liu, Junchen, et autres
Publié: (2025)
par: Liu, Junchen, et autres
Publié: (2025)
One LR Doesn't Fit All: Heavy-Tail Guided Layerwise Learning Rates for LLMs
par: He, Di, et autres
Publié: (2026)
par: He, Di, et autres
Publié: (2026)
Adaptive Layerwise Perturbation: Unifying Off-Policy Corrections for LLM RL
par: Ye, Chenlu, et autres
Publié: (2026)
par: Ye, Chenlu, et autres
Publié: (2026)
Graph Pruning for Enumeration of Minimal Unsatisfiable Subsets
par: Lymperopoulos, Panagiotis, et autres
Publié: (2024)
par: Lymperopoulos, Panagiotis, et autres
Publié: (2024)
SparK: Query-Aware Unstructured Sparsity with Recoverable KV Cache Channel Pruning
par: Liao, Huanxuan, et autres
Publié: (2025)
par: Liao, Huanxuan, et autres
Publié: (2025)
A Sparsity Principle for Partially Observable Causal Representation Learning
par: Xu, Danru, et autres
Publié: (2024)
par: Xu, Danru, et autres
Publié: (2024)
Robust Layerwise Scaling Rules by Proper Weight Decay Tuning
par: Fan, Zhiyuan, et autres
Publié: (2025)
par: Fan, Zhiyuan, et autres
Publié: (2025)
Weight Concentration Regularization for Improving Pruning Robustness Under High Sparsity
par: Yun, Vincent-Daniel, et autres
Publié: (2025)
par: Yun, Vincent-Daniel, et autres
Publié: (2025)
Improving MLLM Training Efficiency via Stage-Aware Sparsity
par: Shi, Kean, et autres
Publié: (2025)
par: Shi, Kean, et autres
Publié: (2025)
FedPaI: Achieving Extreme Sparsity in Federated Learning via Pruning at Initialization
par: Wang, Haonan, et autres
Publié: (2025)
par: Wang, Haonan, et autres
Publié: (2025)
Outlier-weighed Layerwise Sampling for LLM Fine-tuning
par: Li, Pengxiang, et autres
Publié: (2024)
par: Li, Pengxiang, et autres
Publié: (2024)
Zeroth-Order Fine-Tuning of LLMs with Extreme Sparsity
par: Guo, Wentao, et autres
Publié: (2024)
par: Guo, Wentao, et autres
Publié: (2024)
Think Clearly: Improving Reasoning via Redundant Token Pruning
par: Choi, Daewon, et autres
Publié: (2025)
par: Choi, Daewon, et autres
Publié: (2025)
Layerwise LQR for Geometry-Aware Optimization of Deep Networks
par: Dufort-Labbé, Simon, et autres
Publié: (2026)
par: Dufort-Labbé, Simon, et autres
Publié: (2026)
Beyond Frequency: The Role of Redundancy in Large Language Model Memorization
par: Zhang, Jie, et autres
Publié: (2025)
par: Zhang, Jie, et autres
Publié: (2025)
SwiftPrune: Hessian-Free Weight Pruning for Large Language Models
par: Kang, Yuhan, et autres
Publié: (2025)
par: Kang, Yuhan, et autres
Publié: (2025)
Redundancy as a Structural Information Principle for Learning and Generalization
par: Bi, Yuda, et autres
Publié: (2025)
par: Bi, Yuda, et autres
Publié: (2025)
When Maximum Entropy Misleads Policy Optimization
par: Zhang, Ruipeng, et autres
Publié: (2025)
par: Zhang, Ruipeng, et autres
Publié: (2025)
EVGeoQA: Benchmarking LLMs on Dynamic, Multi-Objective Geo-Spatial Exploration
par: Wu, Jianfei, et autres
Publié: (2026)
par: Wu, Jianfei, et autres
Publié: (2026)
Sparsity-Driven Plasticity in Multi-Task Reinforcement Learning
par: Todorov, Aleksandar, et autres
Publié: (2025)
par: Todorov, Aleksandar, et autres
Publié: (2025)
Learning Neural Operators from Partial Observations via Latent Autoregressive Modeling
par: Hou, Jingren, et autres
Publié: (2026)
par: Hou, Jingren, et autres
Publié: (2026)
Beyond Redundancy: Information-aware Unsupervised Multiplex Graph Structure Learning
par: Shen, Zhixiang, et autres
Publié: (2024)
par: Shen, Zhixiang, et autres
Publié: (2024)
PrunePEFT: Iterative Hybrid Pruning for Parameter-Efficient Fine-tuning of LLMs
par: Yu, Tongzhou, et autres
Publié: (2025)
par: Yu, Tongzhou, et autres
Publié: (2025)
Symmetry Reveals Layerwise Dynamics: How Transformers Perform In-Context Classification
par: Lutz, Patrick, et autres
Publié: (2026)
par: Lutz, Patrick, et autres
Publié: (2026)
Numerical Pruning for Efficient Autoregressive Models
par: Shen, Xuan, et autres
Publié: (2024)
par: Shen, Xuan, et autres
Publié: (2024)
PATCH: Learnable Tile-level Hybrid Sparsity for LLMs
par: Hourri, Younes, et autres
Publié: (2025)
par: Hourri, Younes, et autres
Publié: (2025)
Rethinking Layer Redundancy: Calibration Matters More Than Search in LLM Depth Pruning
par: Kim, Minkyu, et autres
Publié: (2026)
par: Kim, Minkyu, et autres
Publié: (2026)
Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts Models
par: Hu, Wentao, et autres
Publié: (2025)
par: Hu, Wentao, et autres
Publié: (2025)
Balanced Edge Pruning for Graph Anomaly Detection with Noisy Labels
par: Wang, Zhu, et autres
Publié: (2024)
par: Wang, Zhu, et autres
Publié: (2024)
Safe Pruning LoRA: Robust Distance-Guided Pruning for Safety Alignment in Adaptation of LLMs
par: Ao, Shuang, et autres
Publié: (2025)
par: Ao, Shuang, et autres
Publié: (2025)
Improving Decision Sparsity
par: Sun, Yiyang, et autres
Publié: (2024)
par: Sun, Yiyang, et autres
Publié: (2024)
From Compression to Expression: A Layerwise Analysis of In-Context Learning
par: Jiang, Jiachen, et autres
Publié: (2025)
par: Jiang, Jiachen, et autres
Publié: (2025)
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
par: Le, Qi, et autres
Publié: (2025)
par: Le, Qi, et autres
Publié: (2025)
PETS: A Principled Framework Towards Optimal Trajectory Allocation for Efficient Test-Time Self-Consistency
par: Liu, Zhangyi, et autres
Publié: (2026)
par: Liu, Zhangyi, et autres
Publié: (2026)
Employing Layerwised Unsupervised Learning to Lessen Data and Loss Requirements in Forward-Forward Algorithms
par: Hwang, Taewook, et autres
Publié: (2024)
par: Hwang, Taewook, et autres
Publié: (2024)
Documents similaires
-
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
par: Xu, Peng, et autres
Publié: (2024) -
Beyond 2:4: exploring V:N:M sparsity for efficient transformer inference on GPUs
par: Zhao, Kang, et autres
Publié: (2024) -
Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity
par: Yin, Lu, et autres
Publié: (2023) -
Layerwise Recall and the Geometry of Interwoven Knowledge in LLMs
par: Lei, Ge, et autres
Publié: (2025) -
Locality-Aware Redundancy Pruning for LLM Depth Compression
par: Yun, Vincent-Daniel, et autres
Publié: (2026)