DLP: Dynamic Layerwise Pruning in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Yuli, Cheng, Bo, Han, Jiale, Zhang, Yingying, Li, Yingting, Zhang, Shuhao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Beyond A Fixed Seal: Adaptive Stealing Watermark in Large Language Models
por: Zhang, Shuhao, et al.
Publicado: (2026)
por: Zhang, Shuhao, et al.
Publicado: (2026)
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
por: Zhang, Yuxuan, et al.
Publicado: (2024)
por: Zhang, Yuxuan, et al.
Publicado: (2024)
SimDiff: Depth Pruning via Similarity and Difference
por: Chen, Yuli, et al.
Publicado: (2026)
por: Chen, Yuli, et al.
Publicado: (2026)
CEFW: A Comprehensive Evaluation Framework for Watermark in Large Language Models
por: Zhang, Shuhao, et al.
Publicado: (2025)
por: Zhang, Shuhao, et al.
Publicado: (2025)
Exploring Narrative Clustering in Large Language Models: A Layerwise Analysis of BERT
por: Banerjee, Awritrojit, et al.
Publicado: (2025)
por: Banerjee, Awritrojit, et al.
Publicado: (2025)
LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning
por: Pan, Rui, et al.
Publicado: (2024)
por: Pan, Rui, et al.
Publicado: (2024)
Making Pre-trained Language Models Better Continual Few-Shot Relation Extractors
por: Ma, Shengkun, et al.
Publicado: (2024)
por: Ma, Shengkun, et al.
Publicado: (2024)
Pruning General Large Language Models into Customized Expert Models
por: Zhao, Yirao, et al.
Publicado: (2025)
por: Zhao, Yirao, et al.
Publicado: (2025)
PruneTIR: Inference-Time Tool Call Pruning for Effective yet Efficient Tool-Integrated Reasoning
por: Zhang, Luan, et al.
Publicado: (2026)
por: Zhang, Luan, et al.
Publicado: (2026)
Sparsity Induction for Accurate Post-Training Pruning of Large Language Models
por: Jiang, Minhao, et al.
Publicado: (2026)
por: Jiang, Minhao, et al.
Publicado: (2026)
Layerwise Change of Knowledge in Neural Networks
por: Cheng, Xu, et al.
Publicado: (2024)
por: Cheng, Xu, et al.
Publicado: (2024)
DPPA: Pruning Method for Large Language Model to Model Merging
por: Zhu, Yaochen, et al.
Publicado: (2024)
por: Zhu, Yaochen, et al.
Publicado: (2024)
Layerwise Convergence Fingerprints for Runtime Misbehavior Detection in Large Language Models
por: Min, Nay Myat, et al.
Publicado: (2026)
por: Min, Nay Myat, et al.
Publicado: (2026)
Saliency-driven Dynamic Token Pruning for Large Language Models
por: Tao, Yao, et al.
Publicado: (2025)
por: Tao, Yao, et al.
Publicado: (2025)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
por: Zheng, Haotian, et al.
Publicado: (2024)
por: Zheng, Haotian, et al.
Publicado: (2024)
Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models
por: Sun, Chuan, et al.
Publicado: (2025)
por: Sun, Chuan, et al.
Publicado: (2025)
PAT: Pruning-Aware Tuning for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2024)
por: Liu, Yijiang, et al.
Publicado: (2024)
ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models
por: Chen, Hao, et al.
Publicado: (2025)
por: Chen, Hao, et al.
Publicado: (2025)
Towards Robust Pruning: An Adaptive Knowledge-Retention Pruning Strategy for Language Models
por: Li, Jianwei, et al.
Publicado: (2023)
por: Li, Jianwei, et al.
Publicado: (2023)
One-Shot Sensitivity-Aware Mixed Sparsity Pruning for Large Language Models
por: Shao, Hang, et al.
Publicado: (2023)
por: Shao, Hang, et al.
Publicado: (2023)
Adaptive Large Language Models By Layerwise Attention Shortcuts
por: Verma, Prateek, et al.
Publicado: (2024)
por: Verma, Prateek, et al.
Publicado: (2024)
Beware of Calibration Data for Pruning Large Language Models
por: Ji, Yixin, et al.
Publicado: (2024)
por: Ji, Yixin, et al.
Publicado: (2024)
RouterDC: Query-Based Router by Dual Contrastive Learning for Assembling Large Language Models
por: Chen, Shuhao, et al.
Publicado: (2024)
por: Chen, Shuhao, et al.
Publicado: (2024)
Large Language Model Pruning
por: Huang, Hanjuan, et al.
Publicado: (2024)
por: Huang, Hanjuan, et al.
Publicado: (2024)
Pruning Large Language Models with Semi-Structural Adaptive Sparse Training
por: Huang, Weiyu, et al.
Publicado: (2024)
por: Huang, Weiyu, et al.
Publicado: (2024)
Prompt-based Depth Pruning of Large Language Models
por: Wee, Juyun, et al.
Publicado: (2025)
por: Wee, Juyun, et al.
Publicado: (2025)
Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models
por: Lu, Xudong, et al.
Publicado: (2024)
por: Lu, Xudong, et al.
Publicado: (2024)
MedGo: A Chinese Medical Large Language Model
por: Zhang, Haitao, et al.
Publicado: (2024)
por: Zhang, Haitao, et al.
Publicado: (2024)
A Comprehensive Evaluation of Large Language Models on Aspect-Based Sentiment Analysis
por: Zhou, Changzhi, et al.
Publicado: (2024)
por: Zhou, Changzhi, et al.
Publicado: (2024)
Sample-aware Adaptive Structured Pruning for Large Language Models
por: Kong, Jun, et al.
Publicado: (2025)
por: Kong, Jun, et al.
Publicado: (2025)
Copy-Paste to Mitigate Large Language Model Hallucinations
por: Long, Yongchao, et al.
Publicado: (2025)
por: Long, Yongchao, et al.
Publicado: (2025)
Entropy-Based Block Pruning for Efficient Large Language Models
por: Yang, Liangwei, et al.
Publicado: (2025)
por: Yang, Liangwei, et al.
Publicado: (2025)
Investigating Hallucinations in Pruned Large Language Models for Abstractive Summarization
por: Chrysostomou, George, et al.
Publicado: (2023)
por: Chrysostomou, George, et al.
Publicado: (2023)
Pruning as a Cooperative Game: Surrogate-Assisted Layer Contribution Estimation for Large Language Models
por: Ding, Xuan, et al.
Publicado: (2026)
por: Ding, Xuan, et al.
Publicado: (2026)
Decision-Level Ordinal Modeling for Multimodal Essay Scoring with Large Language Models
por: Zhang, Han, et al.
Publicado: (2026)
por: Zhang, Han, et al.
Publicado: (2026)
HSKBenchmark: Modeling and Benchmarking Chinese Second Language Acquisition in Large Language Models through Curriculum Tuning
por: Yang, Qihao, et al.
Publicado: (2025)
por: Yang, Qihao, et al.
Publicado: (2025)
K-ON: Stacking Knowledge On the Head Layer of Large Language Model
por: Guo, Lingbing, et al.
Publicado: (2025)
por: Guo, Lingbing, et al.
Publicado: (2025)
LongSafety: Evaluating Long-Context Safety of Large Language Models
por: Lu, Yida, et al.
Publicado: (2025)
por: Lu, Yida, et al.
Publicado: (2025)
Understanding the Dilemma of Unlearning for Large Language Models
por: Zhang, Qingjie, et al.
Publicado: (2025)
por: Zhang, Qingjie, et al.
Publicado: (2025)
GRATH: Gradual Self-Truthifying for Large Language Models
por: Chen, Weixin, et al.
Publicado: (2024)
por: Chen, Weixin, et al.
Publicado: (2024)
Ejemplares similares
-
Beyond A Fixed Seal: Adaptive Stealing Watermark in Large Language Models
por: Zhang, Shuhao, et al.
Publicado: (2026) -
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
por: Zhang, Yuxuan, et al.
Publicado: (2024) -
SimDiff: Depth Pruning via Similarity and Difference
por: Chen, Yuli, et al.
Publicado: (2026) -
CEFW: A Comprehensive Evaluation Framework for Watermark in Large Language Models
por: Zhang, Shuhao, et al.
Publicado: (2025) -
Exploring Narrative Clustering in Large Language Models: A Layerwise Analysis of BERT
por: Banerjee, Awritrojit, et al.
Publicado: (2025)