P$^2$-ViT: Power-of-Two Post-Training Quantization and Acceleration for Fully Quantized Vision Transformer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shi, Huihong, Cheng, Xin, Mao, Wendong, Wang, Zhongfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Trio-ViT: Post-Training Quantization and Acceleration for Softmax-Free Efficient Vision Transformer
par: Shi, Huihong, et autres
Publié: (2024)
par: Shi, Huihong, et autres
Publié: (2024)
M$^2$-ViT: Accelerating Hybrid Vision Transformers with Two-Level Mixed Quantization
par: Liang, Yanbiao, et autres
Publié: (2024)
par: Liang, Yanbiao, et autres
Publié: (2024)
CDM-QTA: Quantized Training Acceleration for Efficient LoRA Fine-Tuning of Diffusion Model
par: Lu, Jinming, et autres
Publié: (2025)
par: Lu, Jinming, et autres
Publié: (2025)
IPTQ-ViT: Post-Training Quantization of Non-linear Functions for Integer-only Vision Transformers
par: Kim, Gihwan, et autres
Publié: (2025)
par: Kim, Gihwan, et autres
Publié: (2025)
An FPGA-Based Reconfigurable Accelerator for Convolution-Transformer Hybrid EfficientViT
par: Shao, Haikuo, et autres
Publié: (2024)
par: Shao, Haikuo, et autres
Publié: (2024)
CLAMP-ViT: Contrastive Data-Free Learning for Adaptive Post-Training Quantization of ViTs
par: Ramachandran, Akshat, et autres
Publié: (2024)
par: Ramachandran, Akshat, et autres
Publié: (2024)
DFQ-ViT: Data-Free Quantization for Vision Transformers without Fine-tuning
par: Tong, Yujia, et autres
Publié: (2025)
par: Tong, Yujia, et autres
Publié: (2025)
NASH: Neural Architecture and Accelerator Search for Multiplication-Reduced Hybrid Models
par: Xu, Yang, et autres
Publié: (2024)
par: Xu, Yang, et autres
Publié: (2024)
Quasar-ViT: Hardware-Oriented Quantization-Aware Architecture Search for Vision Transformers
par: Li, Zhengang, et autres
Publié: (2024)
par: Li, Zhengang, et autres
Publié: (2024)
MPTQ-ViT: Mixed-Precision Post-Training Quantization for Vision Transformer
par: Tai, Yu-Shan, et autres
Publié: (2024)
par: Tai, Yu-Shan, et autres
Publié: (2024)
AccLLM: Accelerating Long-Context LLM Inference Via Algorithm-Hardware Co-Design
par: Liang, Yanbiao, et autres
Publié: (2025)
par: Liang, Yanbiao, et autres
Publié: (2025)
Q-HyViT: Post-Training Quantization of Hybrid Vision Transformers with Bridge Block Reconstruction for IoT Systems
par: Lee, Jemin, et autres
Publié: (2023)
par: Lee, Jemin, et autres
Publié: (2023)
ShiftAddViT: Mixture of Multiplication Primitives Towards Efficient Vision Transformer
par: You, Haoran, et autres
Publié: (2023)
par: You, Haoran, et autres
Publié: (2023)
ADFQ-ViT: Activation-Distribution-Friendly Post-Training Quantization for Vision Transformers
par: Jiang, Yanfeng, et autres
Publié: (2024)
par: Jiang, Yanfeng, et autres
Publié: (2024)
FastMamba: A High-Speed and Efficient Mamba Accelerator on FPGA with Accurate Quantization
par: Wang, Aotao, et autres
Publié: (2025)
par: Wang, Aotao, et autres
Publié: (2025)
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
par: Chen, Lei, et autres
Publié: (2024)
par: Chen, Lei, et autres
Publié: (2024)
PEANO-ViT: Power-Efficient Approximations of Non-Linearities in Vision Transformers
par: Sadeghi, Mohammad Erfan, et autres
Publié: (2024)
par: Sadeghi, Mohammad Erfan, et autres
Publié: (2024)
TaQ-DiT: Time-aware Quantization for Diffusion Transformers
par: Liu, Xinyan, et autres
Publié: (2024)
par: Liu, Xinyan, et autres
Publié: (2024)
PTQTP: Post-Training Quantization to Trit-Planes for Large Language Models
par: Xiao, He, et autres
Publié: (2025)
par: Xiao, He, et autres
Publié: (2025)
SAC-ViT: Semantic-Aware Clustering Vision Transformer with Early Exit
par: Hu, Youbing, et autres
Publié: (2025)
par: Hu, Youbing, et autres
Publié: (2025)
APHQ-ViT: Post-Training Quantization with Average Perturbation Hessian Based Reconstruction for Vision Transformers
par: Wu, Zhuguanyu, et autres
Publié: (2025)
par: Wu, Zhuguanyu, et autres
Publié: (2025)
FIMA-Q: Post-Training Quantization for Vision Transformers by Fisher Information Matrix Approximation
par: Wu, Zhuguanyu, et autres
Publié: (2025)
par: Wu, Zhuguanyu, et autres
Publié: (2025)
VPTQ: Extreme Low-bit Vector Post-Training Quantization for Large Language Models
par: Liu, Yifei, et autres
Publié: (2024)
par: Liu, Yifei, et autres
Publié: (2024)
A Memory-Efficient Framework for Deformable Transformer with Neural Architecture Search
par: Mao, Wendong, et autres
Publié: (2025)
par: Mao, Wendong, et autres
Publié: (2025)
Training-Free Acceleration of ViTs with Delayed Spatial Merging
par: Heo, Jung Hwan, et autres
Publié: (2023)
par: Heo, Jung Hwan, et autres
Publié: (2023)
LF-ViT: Reducing Spatial Redundancy in Vision Transformer for Efficient Image Recognition
par: Hu, Youbing, et autres
Publié: (2024)
par: Hu, Youbing, et autres
Publié: (2024)
Post-Disaster Affected Area Segmentation with a Vision Transformer (ViT)-based EVAP Model using Sentinel-2 and Formosat-5 Imagery
par: Chu, Yi-Shan, et autres
Publié: (2025)
par: Chu, Yi-Shan, et autres
Publié: (2025)
Fine-Grained Post-Training Quantization for Large Vision Language Models with Quantization-Aware Integrated Gradients
par: Xiang, Ziwei, et autres
Publié: (2026)
par: Xiang, Ziwei, et autres
Publié: (2026)
Exploring Layer-wise Information Effectiveness for Post-Training Quantization in Small Language Models
par: Xiao, He, et autres
Publié: (2025)
par: Xiao, He, et autres
Publié: (2025)
Post Training Quantization of Large Language Models with Microscaling Formats
par: Sharify, Sayeh, et autres
Publié: (2024)
par: Sharify, Sayeh, et autres
Publié: (2024)
SliderQuant: Accurate Post-Training Quantization for LLMs
par: Wang, Shigeng, et autres
Publié: (2026)
par: Wang, Shigeng, et autres
Publié: (2026)
I&S-ViT: An Inclusive & Stable Method for Pushing the Limit of Post-Training ViTs Quantization
par: Zhong, Yunshan, et autres
Publié: (2023)
par: Zhong, Yunshan, et autres
Publié: (2023)
Octic Vision Transformers: Quicker ViTs Through Equivariance
par: Nordström, David, et autres
Publié: (2025)
par: Nordström, David, et autres
Publié: (2025)
Towards Next-Level Post-Training Quantization of Hyper-Scale Transformers
par: Kim, Junhan, et autres
Publié: (2024)
par: Kim, Junhan, et autres
Publié: (2024)
GTP-ViT: Efficient Vision Transformers via Graph-based Token Propagation
par: Xu, Xuwei, et autres
Publié: (2023)
par: Xu, Xuwei, et autres
Publié: (2023)
Progressive Fine-to-Coarse Reconstruction for Accurate Low-Bit Post-Training Quantization in Vision Transformers
par: Ding, Rui, et autres
Publié: (2024)
par: Ding, Rui, et autres
Publié: (2024)
MagR: Weight Magnitude Reduction for Enhancing Post-Training Quantization
par: Zhang, Aozhong, et autres
Publié: (2024)
par: Zhang, Aozhong, et autres
Publié: (2024)
DopQ-ViT: Towards Distribution-Friendly and Outlier-Aware Post-Training Quantization for Vision Transformers
par: Yang, Lianwei, et autres
Publié: (2024)
par: Yang, Lianwei, et autres
Publié: (2024)
A Quantized VAE-MLP Botnet Detection Model: A Systematic Evaluation of Quantization-Aware Training and Post-Training Quantization Strategies
par: Wasswa, Hassan, et autres
Publié: (2025)
par: Wasswa, Hassan, et autres
Publié: (2025)
Post-Training Quantization for Video Matting
par: Zhu, Tianrui, et autres
Publié: (2025)
par: Zhu, Tianrui, et autres
Publié: (2025)
Documents similaires
-
Trio-ViT: Post-Training Quantization and Acceleration for Softmax-Free Efficient Vision Transformer
par: Shi, Huihong, et autres
Publié: (2024) -
M$^2$-ViT: Accelerating Hybrid Vision Transformers with Two-Level Mixed Quantization
par: Liang, Yanbiao, et autres
Publié: (2024) -
CDM-QTA: Quantized Training Acceleration for Efficient LoRA Fine-Tuning of Diffusion Model
par: Lu, Jinming, et autres
Publié: (2025) -
IPTQ-ViT: Post-Training Quantization of Non-linear Functions for Integer-only Vision Transformers
par: Kim, Gihwan, et autres
Publié: (2025) -
An FPGA-Based Reconfigurable Accelerator for Convolution-Transformer Hybrid EfficientViT
par: Shao, Haikuo, et autres
Publié: (2024)