MGRQ: Post-Training Quantization For Vision Transformer With Mixed Granularity Reconstruction
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Lianwei, Li, Zhikai, Xiao, Junrui, Gong, Haisong, Gu, Qingyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DopQ-ViT: Towards Distribution-Friendly and Outlier-Aware Post-Training Quantization for Vision Transformers
di: Yang, Lianwei, et al.
Pubblicazione: (2024)
di: Yang, Lianwei, et al.
Pubblicazione: (2024)
EDA-DM: Enhanced Distribution Alignment for Post-Training Quantization of Diffusion Models
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
LRQ-DiT: Log-Rotation Post-Training Quantization of Diffusion Transformers for Image and Video Generation
di: Yang, Lianwei, et al.
Pubblicazione: (2025)
di: Yang, Lianwei, et al.
Pubblicazione: (2025)
PTQ4ARVG: Post-Training Quantization for AutoRegressive Visual Generation Models
di: Liu, Xuewen, et al.
Pubblicazione: (2026)
di: Liu, Xuewen, et al.
Pubblicazione: (2026)
Privacy-Preserving SAM Quantization for Efficient Edge Intelligence in Healthcare
di: Li, Zhikai, et al.
Pubblicazione: (2024)
di: Li, Zhikai, et al.
Pubblicazione: (2024)
MPTQ-ViT: Mixed-Precision Post-Training Quantization for Vision Transformer
di: Tai, Yu-Shan, et al.
Pubblicazione: (2024)
di: Tai, Yu-Shan, et al.
Pubblicazione: (2024)
SAQ-SAM: Semantically-Aligned Quantization for Segment Anything Model
di: Zhang, Jing, et al.
Pubblicazione: (2025)
di: Zhang, Jing, et al.
Pubblicazione: (2025)
TTAQ: Towards Stable Post-training Quantization in Continuous Domain Adaptation
di: Xiao, Junrui, et al.
Pubblicazione: (2024)
di: Xiao, Junrui, et al.
Pubblicazione: (2024)
ADFQ-ViT: Activation-Distribution-Friendly Post-Training Quantization for Vision Transformers
di: Jiang, Yanfeng, et al.
Pubblicazione: (2024)
di: Jiang, Yanfeng, et al.
Pubblicazione: (2024)
APHQ-ViT: Post-Training Quantization with Average Perturbation Hessian Based Reconstruction for Vision Transformers
di: Wu, Zhuguanyu, et al.
Pubblicazione: (2025)
di: Wu, Zhuguanyu, et al.
Pubblicazione: (2025)
CacheQuant: Comprehensively Accelerated Diffusion Models
di: Liu, Xuewen, et al.
Pubblicazione: (2025)
di: Liu, Xuewen, et al.
Pubblicazione: (2025)
AdaLog: Post-Training Quantization for Vision Transformers with Adaptive Logarithm Quantizer
di: Wu, Zhuguanyu, et al.
Pubblicazione: (2024)
di: Wu, Zhuguanyu, et al.
Pubblicazione: (2024)
DilateQuant: Accurate and Efficient Diffusion Quantization via Weight Dilation
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
AIQViT: Architecture-Informed Post-Training Quantization for Vision Transformers
di: Jiang, Runqing, et al.
Pubblicazione: (2025)
di: Jiang, Runqing, et al.
Pubblicazione: (2025)
Efficient-SAM2: Accelerating SAM2 with Object-Aware Visual Encoding and Memory Retrieval
di: Zhang, Jing, et al.
Pubblicazione: (2026)
di: Zhang, Jing, et al.
Pubblicazione: (2026)
Joint Post-Training Quantization of Vision Transformers with Learned Prompt-Guided Data Generation
di: Li, Shile, et al.
Pubblicazione: (2026)
di: Li, Shile, et al.
Pubblicazione: (2026)
Progressive Fine-to-Coarse Reconstruction for Accurate Low-Bit Post-Training Quantization in Vision Transformers
di: Ding, Rui, et al.
Pubblicazione: (2024)
di: Ding, Rui, et al.
Pubblicazione: (2024)
Towards Accurate Post-Training Quantization of Vision Transformers via Error Reduction
di: Zhong, Yunshan, et al.
Pubblicazione: (2024)
di: Zhong, Yunshan, et al.
Pubblicazione: (2024)
QMamba: Post-Training Quantization for Vision State Space Models
di: Li, Yinglong, et al.
Pubblicazione: (2025)
di: Li, Yinglong, et al.
Pubblicazione: (2025)
CAR-SAM: Cross-Attention Reconstruction for Post-Training Quantization of the Segment Anything Model
di: Wen, Houji, et al.
Pubblicazione: (2026)
di: Wen, Houji, et al.
Pubblicazione: (2026)
Mix-QViT: Mixed-Precision Vision Transformer Quantization Driven by Layer Importance and Quantization Sensitivity
di: Ranjan, Navin, et al.
Pubblicazione: (2025)
di: Ranjan, Navin, et al.
Pubblicazione: (2025)
Q-HyViT: Post-Training Quantization of Hybrid Vision Transformers with Bridge Block Reconstruction for IoT Systems
di: Lee, Jemin, et al.
Pubblicazione: (2023)
di: Lee, Jemin, et al.
Pubblicazione: (2023)
QVGGT: Post-Training Quantized Visual Geometry Grounded Transformer
di: Pan, Zhizhen, et al.
Pubblicazione: (2026)
di: Pan, Zhizhen, et al.
Pubblicazione: (2026)
Mixed Non-linear Quantization for Vision Transformers
di: Kim, Gihwan, et al.
Pubblicazione: (2024)
di: Kim, Gihwan, et al.
Pubblicazione: (2024)
Rectified SpaAttn: Revisiting Attention Sparsity for Efficient Video Generation
di: Liu, Xuewen, et al.
Pubblicazione: (2025)
di: Liu, Xuewen, et al.
Pubblicazione: (2025)
Trio-ViT: Post-Training Quantization and Acceleration for Softmax-Free Efficient Vision Transformer
di: Shi, Huihong, et al.
Pubblicazione: (2024)
di: Shi, Huihong, et al.
Pubblicazione: (2024)
Post-Training Quantization for Video Matting
di: Zhu, Tianrui, et al.
Pubblicazione: (2025)
di: Zhu, Tianrui, et al.
Pubblicazione: (2025)
Post-Training Quantization for Diffusion Transformer via Hierarchical Timestep Grouping
di: Ding, Ning, et al.
Pubblicazione: (2025)
di: Ding, Ning, et al.
Pubblicazione: (2025)
ViM-VQ: Efficient Post-Training Vector Quantization for Visual Mamba
di: Deng, Juncan, et al.
Pubblicazione: (2025)
di: Deng, Juncan, et al.
Pubblicazione: (2025)
IPTQ-ViT: Post-Training Quantization of Non-linear Functions for Integer-only Vision Transformers
di: Kim, Gihwan, et al.
Pubblicazione: (2025)
di: Kim, Gihwan, et al.
Pubblicazione: (2025)
LampQ: Towards Accurate Layer-wise Mixed Precision Quantization for Vision Transformers
di: Kim, Minjun, et al.
Pubblicazione: (2025)
di: Kim, Minjun, et al.
Pubblicazione: (2025)
MixA-Q: Revisiting Activation Sparsity for Vision Transformers from a Mixed-Precision Quantization Perspective
di: Wang, Weitian, et al.
Pubblicazione: (2025)
di: Wang, Weitian, et al.
Pubblicazione: (2025)
Cat: Post-Training Quantization Error Reduction via Cluster-based Affine Transformation
di: Zoljodi, Ali, et al.
Pubblicazione: (2025)
di: Zoljodi, Ali, et al.
Pubblicazione: (2025)
Fine-Grained Post-Training Quantization for Large Vision Language Models with Quantization-Aware Integrated Gradients
di: Xiang, Ziwei, et al.
Pubblicazione: (2026)
di: Xiang, Ziwei, et al.
Pubblicazione: (2026)
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
di: Chen, Lei, et al.
Pubblicazione: (2024)
di: Chen, Lei, et al.
Pubblicazione: (2024)
Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models
di: Li, Zhikai, et al.
Pubblicazione: (2026)
di: Li, Zhikai, et al.
Pubblicazione: (2026)
FIMA-Q: Post-Training Quantization for Vision Transformers by Fisher Information Matrix Approximation
di: Wu, Zhuguanyu, et al.
Pubblicazione: (2025)
di: Wu, Zhuguanyu, et al.
Pubblicazione: (2025)
Tail-Aware Post-Training Quantization for 3D Geometry Models
di: Pan, Sicheng, et al.
Pubblicazione: (2026)
di: Pan, Sicheng, et al.
Pubblicazione: (2026)
LRP-QViT: Mixed-Precision Vision Transformer Quantization via Layer-wise Relevance Propagation
di: Ranjan, Navin, et al.
Pubblicazione: (2024)
di: Ranjan, Navin, et al.
Pubblicazione: (2024)
Sensitivity-Aware Post-Training Quantization for Deep Neural Networks
di: Zheng, Zekang, et al.
Pubblicazione: (2025)
di: Zheng, Zekang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DopQ-ViT: Towards Distribution-Friendly and Outlier-Aware Post-Training Quantization for Vision Transformers
di: Yang, Lianwei, et al.
Pubblicazione: (2024) -
EDA-DM: Enhanced Distribution Alignment for Post-Training Quantization of Diffusion Models
di: Liu, Xuewen, et al.
Pubblicazione: (2024) -
LRQ-DiT: Log-Rotation Post-Training Quantization of Diffusion Transformers for Image and Video Generation
di: Yang, Lianwei, et al.
Pubblicazione: (2025) -
PTQ4ARVG: Post-Training Quantization for AutoRegressive Visual Generation Models
di: Liu, Xuewen, et al.
Pubblicazione: (2026) -
Privacy-Preserving SAM Quantization for Efficient Edge Intelligence in Healthcare
di: Li, Zhikai, et al.
Pubblicazione: (2024)