Mix-QViT: Mixed-Precision Vision Transformer Quantization Driven by Layer Importance and Quantization Sensitivity
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ranjan, Navin, Savakis, Andreas |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
LRP-QViT: Mixed-Precision Vision Transformer Quantization via Layer-wise Relevance Propagation
von: Ranjan, Navin, et al.
Veröffentlicht: (2024)
von: Ranjan, Navin, et al.
Veröffentlicht: (2024)
Mix-QSAM: Mixed-Precision Quantization of the Segment Anything Model
von: Ranjan, Navin, et al.
Veröffentlicht: (2025)
von: Ranjan, Navin, et al.
Veröffentlicht: (2025)
Waterfall Transformer for Multi-person Pose Estimation
von: Ranjan, Navin, et al.
Veröffentlicht: (2024)
von: Ranjan, Navin, et al.
Veröffentlicht: (2024)
LampQ: Towards Accurate Layer-wise Mixed Precision Quantization for Vision Transformers
von: Kim, Minjun, et al.
Veröffentlicht: (2025)
von: Kim, Minjun, et al.
Veröffentlicht: (2025)
MPTQ-ViT: Mixed-Precision Post-Training Quantization for Vision Transformer
von: Tai, Yu-Shan, et al.
Veröffentlicht: (2024)
von: Tai, Yu-Shan, et al.
Veröffentlicht: (2024)
MixA-Q: Revisiting Activation Sparsity for Vision Transformers from a Mixed-Precision Quantization Perspective
von: Wang, Weitian, et al.
Veröffentlicht: (2025)
von: Wang, Weitian, et al.
Veröffentlicht: (2025)
Mixed Non-linear Quantization for Vision Transformers
von: Kim, Gihwan, et al.
Veröffentlicht: (2024)
von: Kim, Gihwan, et al.
Veröffentlicht: (2024)
MGRQ: Post-Training Quantization For Vision Transformer With Mixed Granularity Reconstruction
von: Yang, Lianwei, et al.
Veröffentlicht: (2024)
von: Yang, Lianwei, et al.
Veröffentlicht: (2024)
Value-Driven Mixed-Precision Quantization for Patch-Based Inference on Microcontrollers
von: Tao, Wei, et al.
Veröffentlicht: (2024)
von: Tao, Wei, et al.
Veröffentlicht: (2024)
Adaptive Distribution-aware Quantization for Mixed-Precision Neural Networks
von: Jia, Shaohang, et al.
Veröffentlicht: (2025)
von: Jia, Shaohang, et al.
Veröffentlicht: (2025)
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
von: Maruzzelli, Rocco Manz, et al.
Veröffentlicht: (2024)
von: Maruzzelli, Rocco Manz, et al.
Veröffentlicht: (2024)
MetaMix: Meta-state Precision Searcher for Mixed-precision Activation Quantization
von: Kim, Han-Byul, et al.
Veröffentlicht: (2023)
von: Kim, Han-Byul, et al.
Veröffentlicht: (2023)
MoQAE: Mixed-Precision Quantization for Long-Context LLM Inference via Mixture of Quantization-Aware Experts
von: Tao, Wei, et al.
Veröffentlicht: (2025)
von: Tao, Wei, et al.
Veröffentlicht: (2025)
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
von: Yang, Kaicheng, et al.
Veröffentlicht: (2025)
von: Yang, Kaicheng, et al.
Veröffentlicht: (2025)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
von: Feng, Weilun, et al.
Veröffentlicht: (2024)
von: Feng, Weilun, et al.
Veröffentlicht: (2024)
6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
von: Su, Rundong, et al.
Veröffentlicht: (2026)
von: Su, Rundong, et al.
Veröffentlicht: (2026)
Amortized-Precision Quantization for Early-Exit Vision Transformers
von: Fang, Rui, et al.
Veröffentlicht: (2026)
von: Fang, Rui, et al.
Veröffentlicht: (2026)
SemanticDialect: Semantic-Aware Mixed-Format Quantization for Video Diffusion Transformers
von: Jang, Wonsuk, et al.
Veröffentlicht: (2026)
von: Jang, Wonsuk, et al.
Veröffentlicht: (2026)
DynaQuant: Dynamic Mixed-Precision Quantization for Learned Image Compression
von: Bao, Youneng, et al.
Veröffentlicht: (2025)
von: Bao, Youneng, et al.
Veröffentlicht: (2025)
Data-Free Quantization via Mixed-Precision Compensation without Fine-Tuning
von: Chen, Jun, et al.
Veröffentlicht: (2023)
von: Chen, Jun, et al.
Veröffentlicht: (2023)
FLIQS: One-Shot Mixed-Precision Floating-Point and Integer Quantization Search
von: Dotzel, Jordan, et al.
Veröffentlicht: (2023)
von: Dotzel, Jordan, et al.
Veröffentlicht: (2023)
FairQuant: Fairness-Aware Mixed-Precision Quantization for Medical Image Classification
von: Woergaard, Thomas, et al.
Veröffentlicht: (2026)
von: Woergaard, Thomas, et al.
Veröffentlicht: (2026)
MoPEFT: A Mixture-of-PEFTs for the Segment Anything Model
von: Sahay, Rajat, et al.
Veröffentlicht: (2024)
von: Sahay, Rajat, et al.
Veröffentlicht: (2024)
Vision Transformer-based Semantic Communications With Importance-Aware Quantization
von: Park, Joohyuk, et al.
Veröffentlicht: (2024)
von: Park, Joohyuk, et al.
Veröffentlicht: (2024)
MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
von: Zhao, Tianchen, et al.
Veröffentlicht: (2024)
von: Zhao, Tianchen, et al.
Veröffentlicht: (2024)
AdaLog: Post-Training Quantization for Vision Transformers with Adaptive Logarithm Quantizer
von: Wu, Zhuguanyu, et al.
Veröffentlicht: (2024)
von: Wu, Zhuguanyu, et al.
Veröffentlicht: (2024)
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
von: Feng, Weilun, et al.
Veröffentlicht: (2025)
von: Feng, Weilun, et al.
Veröffentlicht: (2025)
Efficient and Effective Methods for Mixed Precision Neural Network Quantization for Faster, Energy-efficient Inference
von: Bablani, Deepika, et al.
Veröffentlicht: (2023)
von: Bablani, Deepika, et al.
Veröffentlicht: (2023)
ARQ: A Mixed-Precision Quantization Framework for Accurate and Certifiably Robust DNNs
von: Yang, Yuchen, et al.
Veröffentlicht: (2024)
von: Yang, Yuchen, et al.
Veröffentlicht: (2024)
WindowQuant: Mixed-Precision KV Cache Quantization based on Window-Level Similarity for VLMs Inference Optimization
von: Tao, Wei, et al.
Veröffentlicht: (2026)
von: Tao, Wei, et al.
Veröffentlicht: (2026)
QuantCache: Adaptive Importance-Guided Quantization with Hierarchical Latent and Layer Caching for Video Generation
von: Wu, Junyi, et al.
Veröffentlicht: (2025)
von: Wu, Junyi, et al.
Veröffentlicht: (2025)
AIQViT: Architecture-Informed Post-Training Quantization for Vision Transformers
von: Jiang, Runqing, et al.
Veröffentlicht: (2025)
von: Jiang, Runqing, et al.
Veröffentlicht: (2025)
Semantic Alignment and Reinforcement for Data-Free Quantization of Vision Transformers
von: Zhong, Yunshan, et al.
Veröffentlicht: (2024)
von: Zhong, Yunshan, et al.
Veröffentlicht: (2024)
Learning from Loss Landscape: Generalizable Mixed-Precision Quantization via Adaptive Sharpness-Aware Gradient Aligning
von: Ma, Lianbo, et al.
Veröffentlicht: (2025)
von: Ma, Lianbo, et al.
Veröffentlicht: (2025)
Revolutionizing Mixed Precision Quantization: Towards Training-free Automatic Proxy Discovery via Large Language Models
von: Kang, Haidong, et al.
Veröffentlicht: (2025)
von: Kang, Haidong, et al.
Veröffentlicht: (2025)
Instance-Aware Group Quantization for Vision Transformers
von: Moon, Jaehyeon, et al.
Veröffentlicht: (2024)
von: Moon, Jaehyeon, et al.
Veröffentlicht: (2024)
Jumping through Local Minima: Quantization in the Loss Landscape of Vision Transformers
von: Frumkin, Natalia, et al.
Veröffentlicht: (2023)
von: Frumkin, Natalia, et al.
Veröffentlicht: (2023)
Quantized Spike-driven Transformer
von: Qiu, Xuerui, et al.
Veröffentlicht: (2025)
von: Qiu, Xuerui, et al.
Veröffentlicht: (2025)
An Analysis on Quantizing Diffusion Transformers
von: Yang, Yuewei, et al.
Veröffentlicht: (2024)
von: Yang, Yuewei, et al.
Veröffentlicht: (2024)
AdaTSQ: Pushing the Pareto Frontier of Diffusion Transformers via Temporal-Sensitivity Quantization
von: Zhang, Shaoqiu, et al.
Veröffentlicht: (2026)
von: Zhang, Shaoqiu, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
LRP-QViT: Mixed-Precision Vision Transformer Quantization via Layer-wise Relevance Propagation
von: Ranjan, Navin, et al.
Veröffentlicht: (2024) -
Mix-QSAM: Mixed-Precision Quantization of the Segment Anything Model
von: Ranjan, Navin, et al.
Veröffentlicht: (2025) -
Waterfall Transformer for Multi-person Pose Estimation
von: Ranjan, Navin, et al.
Veröffentlicht: (2024) -
LampQ: Towards Accurate Layer-wise Mixed Precision Quantization for Vision Transformers
von: Kim, Minjun, et al.
Veröffentlicht: (2025) -
MPTQ-ViT: Mixed-Precision Post-Training Quantization for Vision Transformer
von: Tai, Yu-Shan, et al.
Veröffentlicht: (2024)