Sink-Aware Pruning for Diffusion Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Myrzakhan, Aidar, Li, Tianyi, Guo, Bowei, Tang, Shengkun, Shen, Zhiqiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Survey on Diffusion Language Models
por: Li, Tianyi, et al.
Publicado: (2025)
por: Li, Tianyi, et al.
Publicado: (2025)
Mobile-MMLU: A Mobile Intelligence Language Understanding Benchmark
por: Bsharat, Sondos Mahmoud, et al.
Publicado: (2025)
por: Bsharat, Sondos Mahmoud, et al.
Publicado: (2025)
DRAG: Distilling RAG for SLMs from LLMs to Transfer Knowledge and Mitigate Hallucination via Evidence and Graph-based Distillation
por: Chen, Jennifer, et al.
Publicado: (2025)
por: Chen, Jennifer, et al.
Publicado: (2025)
Open-LLM-Leaderboard: From Multi-choice to Open-style Questions for LLMs Evaluation, Benchmark, and Arena
por: Myrzakhan, Aidar, et al.
Publicado: (2024)
por: Myrzakhan, Aidar, et al.
Publicado: (2024)
Principled Instructions Are All You Need for Questioning LLaMA-1/2, GPT-3.5/4
por: Bsharat, Sondos Mahmoud, et al.
Publicado: (2023)
por: Bsharat, Sondos Mahmoud, et al.
Publicado: (2023)
SlimQwen: Exploring the Pruning and Distillation in Large MoE Model Pre-training
por: Tang, Shengkun, et al.
Publicado: (2026)
por: Tang, Shengkun, et al.
Publicado: (2026)
MosaicDiff: Training-free Structural Pruning for Diffusion Model Acceleration Reflecting Pretraining Dynamics
por: Guo, Bowei, et al.
Publicado: (2025)
por: Guo, Bowei, et al.
Publicado: (2025)
DarwinLM: Evolutionary Structured Pruning of Large Language Models
por: Tang, Shengkun, et al.
Publicado: (2025)
por: Tang, Shengkun, et al.
Publicado: (2025)
Beyond Size: How Gradients Shape Pruning Decisions in Large Language Models
por: Das, Rocktim Jyoti, et al.
Publicado: (2023)
por: Das, Rocktim Jyoti, et al.
Publicado: (2023)
PAT: Pruning-Aware Tuning for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2024)
por: Liu, Yijiang, et al.
Publicado: (2024)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
por: Zheng, Haotian, et al.
Publicado: (2024)
por: Zheng, Haotian, et al.
Publicado: (2024)
When Attention Sink Emerges in Language Models: An Empirical View
por: Gu, Xiangming, et al.
Publicado: (2024)
por: Gu, Xiangming, et al.
Publicado: (2024)
SDMPrune: Self-Distillation MLP Pruning for Efficient Large Language Models
por: Zhu, Hourun, et al.
Publicado: (2025)
por: Zhu, Hourun, et al.
Publicado: (2025)
IDEA Prune: An Integrated Enlarge-and-Prune Pipeline in Generative Language Model Pretraining
por: Li, Yixiao, et al.
Publicado: (2025)
por: Li, Yixiao, et al.
Publicado: (2025)
Large Language Model Pruning
por: Huang, Hanjuan, et al.
Publicado: (2024)
por: Huang, Hanjuan, et al.
Publicado: (2024)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
por: Wang, Ziyan, et al.
Publicado: (2025)
por: Wang, Ziyan, et al.
Publicado: (2025)
Beware of Calibration Data for Pruning Large Language Models
por: Ji, Yixin, et al.
Publicado: (2024)
por: Ji, Yixin, et al.
Publicado: (2024)
Attention Is All You Need for KV Cache in Diffusion LLMs
por: Nguyen-Tri, Quan, et al.
Publicado: (2025)
por: Nguyen-Tri, Quan, et al.
Publicado: (2025)
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
por: Liu, Jun, et al.
Publicado: (2024)
por: Liu, Jun, et al.
Publicado: (2024)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
por: Xu, Peng, et al.
Publicado: (2024)
por: Xu, Peng, et al.
Publicado: (2024)
Large Language Models to Diffusion Finetuning
por: Cetin, Edoardo, et al.
Publicado: (2025)
por: Cetin, Edoardo, et al.
Publicado: (2025)
Text Quality-Based Pruning for Efficient Training of Language Models
por: Sharma, Vasu, et al.
Publicado: (2024)
por: Sharma, Vasu, et al.
Publicado: (2024)
Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models
por: Chen, Pin-Yu, et al.
Publicado: (2025)
por: Chen, Pin-Yu, et al.
Publicado: (2025)
Entropy Aware Reward Guidance for Diffusion Language Model Alignment
por: Tejaswi, Atula, et al.
Publicado: (2026)
por: Tejaswi, Atula, et al.
Publicado: (2026)
Pruning and Distilling Mixture-of-Experts into Dense Language Models
por: Kim, Junhyuck, et al.
Publicado: (2026)
por: Kim, Junhyuck, et al.
Publicado: (2026)
COPAL: Continual Pruning in Large Language Generative Models
por: Malla, Srikanth, et al.
Publicado: (2024)
por: Malla, Srikanth, et al.
Publicado: (2024)
Compact Language Models via Pruning and Knowledge Distillation
por: Muralidharan, Saurav, et al.
Publicado: (2024)
por: Muralidharan, Saurav, et al.
Publicado: (2024)
Lightweight Safety Classification Using Pruned Language Models
por: Sawtell, Mason, et al.
Publicado: (2024)
por: Sawtell, Mason, et al.
Publicado: (2024)
On the Existence and Behavior of Secondary Attention Sinks
por: Wong, Jeffrey T. H., et al.
Publicado: (2025)
por: Wong, Jeffrey T. H., et al.
Publicado: (2025)
On the Limitations of Language Targeted Pruning: Investigating the Calibration Language Impact in Multilingual LLM Pruning
por: Kurz, Simon, et al.
Publicado: (2024)
por: Kurz, Simon, et al.
Publicado: (2024)
Bi-Mamba: Towards Accurate 1-Bit State Space Models
por: Tang, Shengkun, et al.
Publicado: (2024)
por: Tang, Shengkun, et al.
Publicado: (2024)
A Simple and Effective Pruning Approach for Large Language Models
por: Sun, Mingjie, et al.
Publicado: (2023)
por: Sun, Mingjie, et al.
Publicado: (2023)
Wanda++: Pruning Large Language Models via Regional Gradients
por: Yang, Yifan, et al.
Publicado: (2025)
por: Yang, Yifan, et al.
Publicado: (2025)
Pruning Large Language Models by Identifying and Preserving Functional Networks
por: Liu, Yiheng, et al.
Publicado: (2025)
por: Liu, Yiheng, et al.
Publicado: (2025)
Pruning as a Defense: Reducing Memorization in Large Language Models
por: Gupta, Mansi, et al.
Publicado: (2025)
por: Gupta, Mansi, et al.
Publicado: (2025)
Sample-aware Adaptive Structured Pruning for Large Language Models
por: Kong, Jun, et al.
Publicado: (2025)
por: Kong, Jun, et al.
Publicado: (2025)
Pruning Foundation Models for High Accuracy without Retraining
por: Zhao, Pu, et al.
Publicado: (2024)
por: Zhao, Pu, et al.
Publicado: (2024)
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
por: Le, Qi, et al.
Publicado: (2025)
por: Le, Qi, et al.
Publicado: (2025)
LLMSurgeon: Diagnosing Data Mixture of Large Language Models
por: Luo, Yaxin, et al.
Publicado: (2026)
por: Luo, Yaxin, et al.
Publicado: (2026)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
por: Wang, Ziyan, et al.
Publicado: (2025)
por: Wang, Ziyan, et al.
Publicado: (2025)
Ejemplares similares
-
A Survey on Diffusion Language Models
por: Li, Tianyi, et al.
Publicado: (2025) -
Mobile-MMLU: A Mobile Intelligence Language Understanding Benchmark
por: Bsharat, Sondos Mahmoud, et al.
Publicado: (2025) -
DRAG: Distilling RAG for SLMs from LLMs to Transfer Knowledge and Mitigate Hallucination via Evidence and Graph-based Distillation
por: Chen, Jennifer, et al.
Publicado: (2025) -
Open-LLM-Leaderboard: From Multi-choice to Open-style Questions for LLMs Evaluation, Benchmark, and Arena
por: Myrzakhan, Aidar, et al.
Publicado: (2024) -
Principled Instructions Are All You Need for Questioning LLaMA-1/2, GPT-3.5/4
por: Bsharat, Sondos Mahmoud, et al.
Publicado: (2023)