LRP-QViT: Mixed-Precision Vision Transformer Quantization via Layer-wise Relevance Propagation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ranjan, Navin, Savakis, Andreas |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Mix-QViT: Mixed-Precision Vision Transformer Quantization Driven by Layer Importance and Quantization Sensitivity
von: Ranjan, Navin, et al.
Veröffentlicht: (2025)
von: Ranjan, Navin, et al.
Veröffentlicht: (2025)
Mix-QSAM: Mixed-Precision Quantization of the Segment Anything Model
von: Ranjan, Navin, et al.
Veröffentlicht: (2025)
von: Ranjan, Navin, et al.
Veröffentlicht: (2025)
Waterfall Transformer for Multi-person Pose Estimation
von: Ranjan, Navin, et al.
Veröffentlicht: (2024)
von: Ranjan, Navin, et al.
Veröffentlicht: (2024)
LampQ: Towards Accurate Layer-wise Mixed Precision Quantization for Vision Transformers
von: Kim, Minjun, et al.
Veröffentlicht: (2025)
von: Kim, Minjun, et al.
Veröffentlicht: (2025)
AttnLRP: Attention-Aware Layer-Wise Relevance Propagation for Transformers
von: Achtibat, Reduan, et al.
Veröffentlicht: (2024)
von: Achtibat, Reduan, et al.
Veröffentlicht: (2024)
MPTQ-ViT: Mixed-Precision Post-Training Quantization for Vision Transformer
von: Tai, Yu-Shan, et al.
Veröffentlicht: (2024)
von: Tai, Yu-Shan, et al.
Veröffentlicht: (2024)
MoPEFT: A Mixture-of-PEFTs for the Segment Anything Model
von: Sahay, Rajat, et al.
Veröffentlicht: (2024)
von: Sahay, Rajat, et al.
Veröffentlicht: (2024)
MixA-Q: Revisiting Activation Sparsity for Vision Transformers from a Mixed-Precision Quantization Perspective
von: Wang, Weitian, et al.
Veröffentlicht: (2025)
von: Wang, Weitian, et al.
Veröffentlicht: (2025)
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
von: Yang, Kaicheng, et al.
Veröffentlicht: (2025)
von: Yang, Kaicheng, et al.
Veröffentlicht: (2025)
Layer-Wise Relevance Propagation with Conservation Property for ResNet
von: Otsuki, Seitaro, et al.
Veröffentlicht: (2024)
von: Otsuki, Seitaro, et al.
Veröffentlicht: (2024)
Mixed Non-linear Quantization for Vision Transformers
von: Kim, Gihwan, et al.
Veröffentlicht: (2024)
von: Kim, Gihwan, et al.
Veröffentlicht: (2024)
MGRQ: Post-Training Quantization For Vision Transformer With Mixed Granularity Reconstruction
von: Yang, Lianwei, et al.
Veröffentlicht: (2024)
von: Yang, Lianwei, et al.
Veröffentlicht: (2024)
Amortized-Precision Quantization for Early-Exit Vision Transformers
von: Fang, Rui, et al.
Veröffentlicht: (2026)
von: Fang, Rui, et al.
Veröffentlicht: (2026)
MoQAE: Mixed-Precision Quantization for Long-Context LLM Inference via Mixture of Quantization-Aware Experts
von: Tao, Wei, et al.
Veröffentlicht: (2025)
von: Tao, Wei, et al.
Veröffentlicht: (2025)
ELSA: Exploiting Layer-wise N:M Sparsity for Vision Transformer Acceleration
von: Huang, Ning-Chi, et al.
Veröffentlicht: (2024)
von: Huang, Ning-Chi, et al.
Veröffentlicht: (2024)
Adaptive Distribution-aware Quantization for Mixed-Precision Neural Networks
von: Jia, Shaohang, et al.
Veröffentlicht: (2025)
von: Jia, Shaohang, et al.
Veröffentlicht: (2025)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
von: Feng, Weilun, et al.
Veröffentlicht: (2024)
von: Feng, Weilun, et al.
Veröffentlicht: (2024)
GeminiFusion: Efficient Pixel-wise Multimodal Fusion for Vision Transformer
von: Jia, Ding, et al.
Veröffentlicht: (2024)
von: Jia, Ding, et al.
Veröffentlicht: (2024)
Data-Free Quantization via Mixed-Precision Compensation without Fine-Tuning
von: Chen, Jun, et al.
Veröffentlicht: (2023)
von: Chen, Jun, et al.
Veröffentlicht: (2023)
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
von: Maruzzelli, Rocco Manz, et al.
Veröffentlicht: (2024)
von: Maruzzelli, Rocco Manz, et al.
Veröffentlicht: (2024)
Decision-Aware Attention Propagation for Vision Transformer Explainability
von: Jo, Sehyeong, et al.
Veröffentlicht: (2026)
von: Jo, Sehyeong, et al.
Veröffentlicht: (2026)
SoLA-Vision: Fine-grained Layer-wise Linear Softmax Hybrid Attention
von: Li, Ruibang, et al.
Veröffentlicht: (2026)
von: Li, Ruibang, et al.
Veröffentlicht: (2026)
RAZOR: Ratio-Aware Layer Editing for Targeted Unlearning in Vision Transformers and Diffusion Models
von: Ranjan, Ravi, et al.
Veröffentlicht: (2026)
von: Ranjan, Ravi, et al.
Veröffentlicht: (2026)
Towards Accurate Post-Training Quantization of Vision Transformers via Error Reduction
von: Zhong, Yunshan, et al.
Veröffentlicht: (2024)
von: Zhong, Yunshan, et al.
Veröffentlicht: (2024)
AdaLog: Post-Training Quantization for Vision Transformers with Adaptive Logarithm Quantizer
von: Wu, Zhuguanyu, et al.
Veröffentlicht: (2024)
von: Wu, Zhuguanyu, et al.
Veröffentlicht: (2024)
Channel-wise Vector Quantization
von: Song, Wei, et al.
Veröffentlicht: (2026)
von: Song, Wei, et al.
Veröffentlicht: (2026)
Layer-wise Instance Binding for Regional and Occlusion Control in Text-to-Image Diffusion Transformers
von: Chen, Ruidong, et al.
Veröffentlicht: (2026)
von: Chen, Ruidong, et al.
Veröffentlicht: (2026)
MetaMix: Meta-state Precision Searcher for Mixed-precision Activation Quantization
von: Kim, Han-Byul, et al.
Veröffentlicht: (2023)
von: Kim, Han-Byul, et al.
Veröffentlicht: (2023)
6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
von: Su, Rundong, et al.
Veröffentlicht: (2026)
von: Su, Rundong, et al.
Veröffentlicht: (2026)
EVO-LRP: Evolutionary Optimization of LRP for Interpretable Model Explanations
von: Zhang, Emerald, et al.
Veröffentlicht: (2025)
von: Zhang, Emerald, et al.
Veröffentlicht: (2025)
Layer-wise Alignment: Examining Safety Alignment Across Image Encoder Layers in Vision Language Models
von: Bachu, Saketh, et al.
Veröffentlicht: (2024)
von: Bachu, Saketh, et al.
Veröffentlicht: (2024)
BiggerGait: Unlocking Gait Recognition with Layer-wise Representations from Large Vision Models
von: Ye, Dingqiang, et al.
Veröffentlicht: (2025)
von: Ye, Dingqiang, et al.
Veröffentlicht: (2025)
Semantic Alignment and Reinforcement for Data-Free Quantization of Vision Transformers
von: Zhong, Yunshan, et al.
Veröffentlicht: (2024)
von: Zhong, Yunshan, et al.
Veröffentlicht: (2024)
AIQViT: Architecture-Informed Post-Training Quantization for Vision Transformers
von: Jiang, Runqing, et al.
Veröffentlicht: (2025)
von: Jiang, Runqing, et al.
Veröffentlicht: (2025)
Improving Adversarial Transferability on Vision Transformers via Forward Propagation Refinement
von: Ren, Yuchen, et al.
Veröffentlicht: (2025)
von: Ren, Yuchen, et al.
Veröffentlicht: (2025)
EventRPG: Event Data Augmentation with Relevance Propagation Guidance
von: Sun, Mingyuan, et al.
Veröffentlicht: (2024)
von: Sun, Mingyuan, et al.
Veröffentlicht: (2024)
Value-Driven Mixed-Precision Quantization for Patch-Based Inference on Microcontrollers
von: Tao, Wei, et al.
Veröffentlicht: (2024)
von: Tao, Wei, et al.
Veröffentlicht: (2024)
SemanticDialect: Semantic-Aware Mixed-Format Quantization for Video Diffusion Transformers
von: Jang, Wonsuk, et al.
Veröffentlicht: (2026)
von: Jang, Wonsuk, et al.
Veröffentlicht: (2026)
GranQ: Efficient Channel-wise Quantization via Vectorized Pre-Scaling for Zero-Shot QAT
von: Hong, Inpyo, et al.
Veröffentlicht: (2025)
von: Hong, Inpyo, et al.
Veröffentlicht: (2025)
Weight Group-wise Post-Training Quantization for Medical Foundation Model
von: Chen, Yineng, et al.
Veröffentlicht: (2026)
von: Chen, Yineng, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Mix-QViT: Mixed-Precision Vision Transformer Quantization Driven by Layer Importance and Quantization Sensitivity
von: Ranjan, Navin, et al.
Veröffentlicht: (2025) -
Mix-QSAM: Mixed-Precision Quantization of the Segment Anything Model
von: Ranjan, Navin, et al.
Veröffentlicht: (2025) -
Waterfall Transformer for Multi-person Pose Estimation
von: Ranjan, Navin, et al.
Veröffentlicht: (2024) -
LampQ: Towards Accurate Layer-wise Mixed Precision Quantization for Vision Transformers
von: Kim, Minjun, et al.
Veröffentlicht: (2025) -
AttnLRP: Attention-Aware Layer-Wise Relevance Propagation for Transformers
von: Achtibat, Reduan, et al.
Veröffentlicht: (2024)