Gespeichert in:
| Hauptverfasser: | Xiao, Jinying, Li, Ping, Nie, Jie, Tang, Zhe |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2403.12688 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
LNPT: Label-free Network Pruning and Training
von: Xiao, Jinying, et al.
Veröffentlicht: (2024)
von: Xiao, Jinying, et al.
Veröffentlicht: (2024)
TED: Accelerate Model Training by Internal Generalization
von: Xiao, Jinying, et al.
Veröffentlicht: (2024)
von: Xiao, Jinying, et al.
Veröffentlicht: (2024)
EMP: Enhance Memory in Data Pruning
von: Xiao, Jinying, et al.
Veröffentlicht: (2024)
von: Xiao, Jinying, et al.
Veröffentlicht: (2024)
ResPrune: Text-Conditioned Subspace Reconstruction for Visual Token Pruning in Large Vision-Language Models
von: Li, Xu, et al.
Veröffentlicht: (2026)
von: Li, Xu, et al.
Veröffentlicht: (2026)
The Right to be Forgotten in Pruning: Unveil Machine Unlearning on Sparse Models
von: Xiao, Yang, et al.
Veröffentlicht: (2025)
von: Xiao, Yang, et al.
Veröffentlicht: (2025)
Reconstruct the Pruned Model without Any Retraining
von: Wang, Pingjie, et al.
Veröffentlicht: (2024)
von: Wang, Pingjie, et al.
Veröffentlicht: (2024)
FASP: Fast and Accurate Structured Pruning of Large Language Models
von: Hu, Hanyu, et al.
Veröffentlicht: (2025)
von: Hu, Hanyu, et al.
Veröffentlicht: (2025)
Outlier Smoothing with Closed-Form Rotations for W4A4 Large Language Model Quantization
von: Xiao, Jinying, et al.
Veröffentlicht: (2025)
von: Xiao, Jinying, et al.
Veröffentlicht: (2025)
Sentinel: Multi-Patch Transformer with Temporal and Channel Attention for Time Series Forecasting
von: Villaboni, Davide, et al.
Veröffentlicht: (2025)
von: Villaboni, Davide, et al.
Veröffentlicht: (2025)
ProxyKV: Cross-Model Proxy Pruning for Efficient Long-Context LLM Inference
von: Li, Junjie, et al.
Veröffentlicht: (2026)
von: Li, Junjie, et al.
Veröffentlicht: (2026)
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
von: Le, Qi, et al.
Veröffentlicht: (2025)
von: Le, Qi, et al.
Veröffentlicht: (2025)
Rethinking Pruning for Backdoor Mitigation: An Optimization Perspective
von: Li, Nan, et al.
Veröffentlicht: (2024)
von: Li, Nan, et al.
Veröffentlicht: (2024)
Magnitude-based Neuron Pruning for Backdoor Defens
von: Li, Nan, et al.
Veröffentlicht: (2024)
von: Li, Nan, et al.
Veröffentlicht: (2024)
The Need for Speed: Pruning Transformers with One Recipe
von: Khaki, Samir, et al.
Veröffentlicht: (2024)
von: Khaki, Samir, et al.
Veröffentlicht: (2024)
SlimLLM: Accurate Structured Pruning for Large Language Models
von: Guo, Jialong, et al.
Veröffentlicht: (2025)
von: Guo, Jialong, et al.
Veröffentlicht: (2025)
Toward a Graph Foundation Model: Pre-Training Transformers With Random Walks
von: Tang, Ziyuan, et al.
Veröffentlicht: (2025)
von: Tang, Ziyuan, et al.
Veröffentlicht: (2025)
Beware of Calibration Data for Pruning Large Language Models
von: Ji, Yixin, et al.
Veröffentlicht: (2024)
von: Ji, Yixin, et al.
Veröffentlicht: (2024)
Sink-Aware Pruning for Diffusion Language Models
von: Myrzakhan, Aidar, et al.
Veröffentlicht: (2026)
von: Myrzakhan, Aidar, et al.
Veröffentlicht: (2026)
SAP: Syntactic Attention Pruning for Transformer-based Language Models
von: Lee, Tzu-Yun, et al.
Veröffentlicht: (2025)
von: Lee, Tzu-Yun, et al.
Veröffentlicht: (2025)
DTMM: Deploying TinyML Models on Extremely Weak IoT Devices with Pruning
von: Han, Lixiang, et al.
Veröffentlicht: (2024)
von: Han, Lixiang, et al.
Veröffentlicht: (2024)
Magnitude Pruning of Large Pretrained Transformer Models with a Mixture Gaussian Prior
von: Zhang, Mingxuan, et al.
Veröffentlicht: (2024)
von: Zhang, Mingxuan, et al.
Veröffentlicht: (2024)
Pruning and Malicious Injection: A Retraining-Free Backdoor Attack on Transformer Models
von: Zhao, Taibiao, et al.
Veröffentlicht: (2025)
von: Zhao, Taibiao, et al.
Veröffentlicht: (2025)
Adaptive Pruning of Pretrained Transformer via Differential Inclusions
von: Ding, Yizhuo, et al.
Veröffentlicht: (2025)
von: Ding, Yizhuo, et al.
Veröffentlicht: (2025)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
von: Xu, Peng, et al.
Veröffentlicht: (2024)
von: Xu, Peng, et al.
Veröffentlicht: (2024)
Condense, Don't Just Prune: Enhancing Efficiency and Performance in MoE Layer Pruning
von: Cao, Mingyu, et al.
Veröffentlicht: (2024)
von: Cao, Mingyu, et al.
Veröffentlicht: (2024)
Automatic Pruning of Fine-tuning Datasets for Transformer-based Language Models
von: Tayaranian, Mohammadreza, et al.
Veröffentlicht: (2024)
von: Tayaranian, Mohammadreza, et al.
Veröffentlicht: (2024)
Prune, Update and Trim: Robust Structured Pruning for Large Language Models
von: Mecke, Diego Coello de Portugal, et al.
Veröffentlicht: (2026)
von: Mecke, Diego Coello de Portugal, et al.
Veröffentlicht: (2026)
Adaptive Computation Pruning for the Forgetting Transformer
von: Lin, Zhixuan, et al.
Veröffentlicht: (2025)
von: Lin, Zhixuan, et al.
Veröffentlicht: (2025)
Predicting Wave Reflection and Transmission in Heterogeneous Media via Fourier Operator-Based Transformer Modeling
von: Bai, Zhe, et al.
Veröffentlicht: (2026)
von: Bai, Zhe, et al.
Veröffentlicht: (2026)
Multi-Modal Landslide Detection from Sentinel-1 SAR and Sentinel-2 Optical Imagery Using Multi-Encoder Vision Transformers and Ensemble Learning
von: Nasios, Ioannis
Veröffentlicht: (2026)
von: Nasios, Ioannis
Veröffentlicht: (2026)
DarwinLM: Evolutionary Structured Pruning of Large Language Models
von: Tang, Shengkun, et al.
Veröffentlicht: (2025)
von: Tang, Shengkun, et al.
Veröffentlicht: (2025)
Toward Efficient Spiking Transformers: Synapse Pruning Meets Synergistic Learning-Based Compensation
von: Sun, Hongze, et al.
Veröffentlicht: (2025)
von: Sun, Hongze, et al.
Veröffentlicht: (2025)
EfficientLLM: Scalable Pruning-Aware Pretraining for Architecture-Agnostic Edge Language Models
von: Xing, Xingrun, et al.
Veröffentlicht: (2025)
von: Xing, Xingrun, et al.
Veröffentlicht: (2025)
Dispatch-Aware Ragged Attention for Pruned Vision Transformers
von: Abdellatif, Seifeldin, et al.
Veröffentlicht: (2026)
von: Abdellatif, Seifeldin, et al.
Veröffentlicht: (2026)
Dynamic Context Pruning for Efficient and Interpretable Autoregressive Transformers
von: Anagnostidis, Sotiris, et al.
Veröffentlicht: (2023)
von: Anagnostidis, Sotiris, et al.
Veröffentlicht: (2023)
CipherPrune: Efficient and Scalable Private Transformer Inference
von: Zhang, Yancheng, et al.
Veröffentlicht: (2025)
von: Zhang, Yancheng, et al.
Veröffentlicht: (2025)
VTrans: Accelerating Transformer Compression with Variational Information Bottleneck based Pruning
von: Dutta, Oshin, et al.
Veröffentlicht: (2024)
von: Dutta, Oshin, et al.
Veröffentlicht: (2024)
Pruning By Explaining Revisited: Optimizing Attribution Methods to Prune CNNs and Transformers
von: Hatefi, Sayed Mohammad Vakilzadeh, et al.
Veröffentlicht: (2024)
von: Hatefi, Sayed Mohammad Vakilzadeh, et al.
Veröffentlicht: (2024)
Sparsest Models Elude Pruning: An Exposé of Pruning's Current Capabilities
von: Zhang, Stephen, et al.
Veröffentlicht: (2024)
von: Zhang, Stephen, et al.
Veröffentlicht: (2024)
ToMoE: Converting Dense Large Language Models to Mixture-of-Experts through Dynamic Structural Pruning
von: Gao, Shangqian, et al.
Veröffentlicht: (2025)
von: Gao, Shangqian, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
LNPT: Label-free Network Pruning and Training
von: Xiao, Jinying, et al.
Veröffentlicht: (2024) -
TED: Accelerate Model Training by Internal Generalization
von: Xiao, Jinying, et al.
Veröffentlicht: (2024) -
EMP: Enhance Memory in Data Pruning
von: Xiao, Jinying, et al.
Veröffentlicht: (2024) -
ResPrune: Text-Conditioned Subspace Reconstruction for Visual Token Pruning in Large Vision-Language Models
von: Li, Xu, et al.
Veröffentlicht: (2026) -
The Right to be Forgotten in Pruning: Unveil Machine Unlearning on Sparse Models
von: Xiao, Yang, et al.
Veröffentlicht: (2025)