Pruning Self-attentions into Convolutional Layers in Single Path
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Haoyu, Cai, Jianfei, Liu, Jing, Pan, Zizheng, Zhang, Jing, Tao, Dacheng, Zhuang, Bohan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2021
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Efficient Stitchable Task Adaptation
di: He, Haoyu, et al.
Pubblicazione: (2023)
di: He, Haoyu, et al.
Pubblicazione: (2023)
T-Stitch: Accelerating Sampling in Pre-Trained Diffusion Models with Trajectory Stitching
di: Pan, Zizheng, et al.
Pubblicazione: (2024)
di: Pan, Zizheng, et al.
Pubblicazione: (2024)
PaRa: Personalizing Text-to-Image Diffusion via Parameter Rank Reduction
di: Chen, Shangyu, et al.
Pubblicazione: (2024)
di: Chen, Shangyu, et al.
Pubblicazione: (2024)
Combining Self-attention and Dilation Convolutional for Semantic Segmentation of Coal Maceral Groups
di: Xi, Zhenghao, et al.
Pubblicazione: (2025)
di: Xi, Zhenghao, et al.
Pubblicazione: (2025)
FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion
di: Chen, Zhuokun, et al.
Pubblicazione: (2026)
di: Chen, Zhuokun, et al.
Pubblicazione: (2026)
LoRAPrune: Structured Pruning Meets Low-Rank Parameter-Efficient Fine-Tuning
di: Zhang, Mingyang, et al.
Pubblicazione: (2023)
di: Zhang, Mingyang, et al.
Pubblicazione: (2023)
Analytic Convolutional Layer: A Step to Analytic Neural Network
di: Cui, Jingmao, et al.
Pubblicazione: (2024)
di: Cui, Jingmao, et al.
Pubblicazione: (2024)
FGP: Feature-Gradient-Prune for Efficient Convolutional Layer Pruning
di: Lv, Qingsong, et al.
Pubblicazione: (2024)
di: Lv, Qingsong, et al.
Pubblicazione: (2024)
An Empirical Study on How Video-LLMs Answer Video Questions
di: Gou, Chenhui, et al.
Pubblicazione: (2025)
di: Gou, Chenhui, et al.
Pubblicazione: (2025)
On Robust Cross-View Consistency in Self-Supervised Monocular Depth Estimation
di: Zhao, Haimei, et al.
Pubblicazione: (2022)
di: Zhao, Haimei, et al.
Pubblicazione: (2022)
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
di: He, Yefei, et al.
Pubblicazione: (2023)
di: He, Yefei, et al.
Pubblicazione: (2023)
UniFormer: Unifying Convolution and Self-attention for Visual Recognition
di: Li, Kunchang, et al.
Pubblicazione: (2022)
di: Li, Kunchang, et al.
Pubblicazione: (2022)
Reducing Bias and Variance: Generative Semantic Guidance and Bi-Layer Ensemble for Image Clustering
di: Li, Feijiang, et al.
Pubblicazione: (2026)
di: Li, Feijiang, et al.
Pubblicazione: (2026)
Translution: Unifying Self-attention and Convolution for Adaptive and Relative Modeling
di: Fan, Hehe, et al.
Pubblicazione: (2025)
di: Fan, Hehe, et al.
Pubblicazione: (2025)
Reasoning-OCR: Can Large Multimodal Models Solve Complex Logical Reasoning Problems from OCR Cues?
di: He, Haibin, et al.
Pubblicazione: (2025)
di: He, Haibin, et al.
Pubblicazione: (2025)
Multimodal Machine Translation with Visual Scene Graph Pruning
di: Lu, Chenyu, et al.
Pubblicazione: (2025)
di: Lu, Chenyu, et al.
Pubblicazione: (2025)
LAB-Det: Language as a Domain-Invariant Bridge for Training-Free One-Shot Domain Generalization in Object Detection
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
Heuristic-inspired Reasoning Priors Facilitate Data-Efficient Referring Object Detection
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
LongVLM: Efficient Long Video Understanding via Large Language Models
di: Weng, Yuetian, et al.
Pubblicazione: (2024)
di: Weng, Yuetian, et al.
Pubblicazione: (2024)
GoMatching++: Parameter- and Data-Efficient Arbitrary-Shaped Video Text Spotting and Benchmarking
di: He, Haibin, et al.
Pubblicazione: (2025)
di: He, Haibin, et al.
Pubblicazione: (2025)
GoMatching: A Simple Baseline for Video Text Spotting via Long and Short Term Matching
di: He, Haibin, et al.
Pubblicazione: (2024)
di: He, Haibin, et al.
Pubblicazione: (2024)
LayerMerge: Neural Network Depth Compression through Layer Pruning and Merging
di: Kim, Jinuk, et al.
Pubblicazione: (2024)
di: Kim, Jinuk, et al.
Pubblicazione: (2024)
Decay Pruning Method: Smooth Pruning With a Self-Rectifying Procedure
di: Yang, Minghao, et al.
Pubblicazione: (2024)
di: Yang, Minghao, et al.
Pubblicazione: (2024)
Layer Pruning with Consensus: A Triple-Win Solution
di: Mugnaini, Leandro Giusti, et al.
Pubblicazione: (2024)
di: Mugnaini, Leandro Giusti, et al.
Pubblicazione: (2024)
Reassessing Layer Pruning in LLMs: New Insights and Methods
di: Lu, Yao, et al.
Pubblicazione: (2024)
di: Lu, Yao, et al.
Pubblicazione: (2024)
SAM-Med3D-MoE: Towards a Non-Forgetting Segment Anything Model via Mixture of Experts for 3D Medical Image Segmentation
di: Wang, Guoan, et al.
Pubblicazione: (2024)
di: Wang, Guoan, et al.
Pubblicazione: (2024)
Emulating Self-attention with Convolution for Efficient Image Super-Resolution
di: Lee, Dongheon, et al.
Pubblicazione: (2025)
di: Lee, Dongheon, et al.
Pubblicazione: (2025)
CAS-ViT: Convolutional Additive Self-attention Vision Transformers for Efficient Mobile Applications
di: Zhang, Tianfang, et al.
Pubblicazione: (2024)
di: Zhang, Tianfang, et al.
Pubblicazione: (2024)
1-Bit FQT: Pushing the Limit of Fully Quantized Training to 1-bit
di: Gao, Chang, et al.
Pubblicazione: (2024)
di: Gao, Chang, et al.
Pubblicazione: (2024)
Understanding Adversarial Robustness from Feature Maps of Convolutional Layers
di: Xu, Cong, et al.
Pubblicazione: (2022)
di: Xu, Cong, et al.
Pubblicazione: (2022)
Deconstructing Denoising Diffusion Models for Self-Supervised Learning
di: Chen, Xinlei, et al.
Pubblicazione: (2024)
di: Chen, Xinlei, et al.
Pubblicazione: (2024)
Event-based Simultaneous Localization and Mapping: A Comprehensive Survey
di: Huang, Kunping, et al.
Pubblicazione: (2023)
di: Huang, Kunping, et al.
Pubblicazione: (2023)
Rethink Sparse Signals for Pose-guided Text-to-image Generation
di: Xuan, Wenjie, et al.
Pubblicazione: (2025)
di: Xuan, Wenjie, et al.
Pubblicazione: (2025)
PSE-Net: Channel Pruning for Convolutional Neural Networks with Parallel-subnets Estimator
di: Wang, Shiguang, et al.
Pubblicazione: (2024)
di: Wang, Shiguang, et al.
Pubblicazione: (2024)
AQD: Towards Accurate Fully-Quantized Object Detection
di: Chen, Peng, et al.
Pubblicazione: (2020)
di: Chen, Peng, et al.
Pubblicazione: (2020)
Is Oracle Pruning the True Oracle?
di: Feng, Sicheng, et al.
Pubblicazione: (2024)
di: Feng, Sicheng, et al.
Pubblicazione: (2024)
A Self-attention Residual Convolutional Neural Network for Health Condition Classification of Cow Teat Images
di: Wang, Minghao
Pubblicazione: (2024)
di: Wang, Minghao
Pubblicazione: (2024)
Spectral Norm of Convolutional Layers with Circular and Zero Paddings
di: Delattre, Blaise, et al.
Pubblicazione: (2024)
di: Delattre, Blaise, et al.
Pubblicazione: (2024)
Multi-Dimensional Pruning: Joint Channel, Layer and Block Pruning with Latency Constraint
di: Sun, Xinglong, et al.
Pubblicazione: (2024)
di: Sun, Xinglong, et al.
Pubblicazione: (2024)
Training Noise Token Pruning
di: Rao, Mingxing, et al.
Pubblicazione: (2024)
di: Rao, Mingxing, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Efficient Stitchable Task Adaptation
di: He, Haoyu, et al.
Pubblicazione: (2023) -
T-Stitch: Accelerating Sampling in Pre-Trained Diffusion Models with Trajectory Stitching
di: Pan, Zizheng, et al.
Pubblicazione: (2024) -
PaRa: Personalizing Text-to-Image Diffusion via Parameter Rank Reduction
di: Chen, Shangyu, et al.
Pubblicazione: (2024) -
Combining Self-attention and Dilation Convolutional for Semantic Segmentation of Coal Maceral Groups
di: Xi, Zhenghao, et al.
Pubblicazione: (2025) -
FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion
di: Chen, Zhuokun, et al.
Pubblicazione: (2026)