Data-Free Quantization via Mixed-Precision Compensation without Fine-Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Jun, Bai, Shipeng, Huang, Tianxin, Wang, Mengmeng, Tian, Guanzhong, Liu, Yong |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DFQ-ViT: Data-Free Quantization for Vision Transformers without Fine-tuning
par: Tong, Yujia, et autres
Publié: (2025)
par: Tong, Yujia, et autres
Publié: (2025)
FreeFix: Boosting 3D Gaussian Splatting via Fine-Tuning-Free Diffusion Models
par: Zhou, Hongyu, et autres
Publié: (2026)
par: Zhou, Hongyu, et autres
Publié: (2026)
Adaptive Distribution-aware Quantization for Mixed-Precision Neural Networks
par: Jia, Shaohang, et autres
Publié: (2025)
par: Jia, Shaohang, et autres
Publié: (2025)
Mix-QSAM: Mixed-Precision Quantization of the Segment Anything Model
par: Ranjan, Navin, et autres
Publié: (2025)
par: Ranjan, Navin, et autres
Publié: (2025)
6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
par: Su, Rundong, et autres
Publié: (2026)
par: Su, Rundong, et autres
Publié: (2026)
Mix-QViT: Mixed-Precision Vision Transformer Quantization Driven by Layer Importance and Quantization Sensitivity
par: Ranjan, Navin, et autres
Publié: (2025)
par: Ranjan, Navin, et autres
Publié: (2025)
Robustness-Guided Image Synthesis for Data-Free Quantization
par: Bai, Jianhong, et autres
Publié: (2023)
par: Bai, Jianhong, et autres
Publié: (2023)
Self-NPO: Data-Free Diffusion Model Enhancement via Truncated Diffusion Fine-Tuning
par: Wang, Fu-Yun, et autres
Publié: (2025)
par: Wang, Fu-Yun, et autres
Publié: (2025)
FreeSplat: Generalizable 3D Gaussian Splatting Towards Free-View Synthesis of Indoor Scenes
par: Wang, Yunsong, et autres
Publié: (2024)
par: Wang, Yunsong, et autres
Publié: (2024)
MoQAE: Mixed-Precision Quantization for Long-Context LLM Inference via Mixture of Quantization-Aware Experts
par: Tao, Wei, et autres
Publié: (2025)
par: Tao, Wei, et autres
Publié: (2025)
Token Compensator: Altering Inference Cost of Vision Transformer without Re-Tuning
par: Jie, Shibo, et autres
Publié: (2024)
par: Jie, Shibo, et autres
Publié: (2024)
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
par: Maruzzelli, Rocco Manz, et autres
Publié: (2024)
par: Maruzzelli, Rocco Manz, et autres
Publié: (2024)
Error Propagation Mechanisms and Compensation Strategies for Quantized Diffusion
par: Liu, Songwei, et autres
Publié: (2025)
par: Liu, Songwei, et autres
Publié: (2025)
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
par: Feng, Weilun, et autres
Publié: (2025)
par: Feng, Weilun, et autres
Publié: (2025)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
par: Feng, Weilun, et autres
Publié: (2024)
par: Feng, Weilun, et autres
Publié: (2024)
Hyperbolic Binary Neural Network
par: Chen, Jun, et autres
Publié: (2025)
par: Chen, Jun, et autres
Publié: (2025)
QuantTune: Optimizing Model Quantization with Adaptive Outlier-Driven Fine Tuning
par: Chen, Jiun-Man, et autres
Publié: (2024)
par: Chen, Jiun-Man, et autres
Publié: (2024)
Revolutionizing Mixed Precision Quantization: Towards Training-free Automatic Proxy Discovery via Large Language Models
par: Kang, Haidong, et autres
Publié: (2025)
par: Kang, Haidong, et autres
Publié: (2025)
LRP-QViT: Mixed-Precision Vision Transformer Quantization via Layer-wise Relevance Propagation
par: Ranjan, Navin, et autres
Publié: (2024)
par: Ranjan, Navin, et autres
Publié: (2024)
Fine Tuning without Catastrophic Forgetting via Selective Low Rank Adaptation
par: Bafghi, Reza Akbarian, et autres
Publié: (2025)
par: Bafghi, Reza Akbarian, et autres
Publié: (2025)
FreeSplat++: Generalizable 3D Gaussian Splatting for Efficient Indoor Scene Reconstruction
par: Wang, Yunsong, et autres
Publié: (2025)
par: Wang, Yunsong, et autres
Publié: (2025)
MPTQ-ViT: Mixed-Precision Post-Training Quantization for Vision Transformer
par: Tai, Yu-Shan, et autres
Publié: (2024)
par: Tai, Yu-Shan, et autres
Publié: (2024)
Unified Geometry and Color Compression Framework for Point Clouds via Generative Diffusion Priors
par: Huang, Tianxin, et autres
Publié: (2025)
par: Huang, Tianxin, et autres
Publié: (2025)
Dual-path Frequency Discriminators for Few-shot Anomaly Detection
par: Bai, Yuhu, et autres
Publié: (2024)
par: Bai, Yuhu, et autres
Publié: (2024)
Training-Free Tunnel Defect Inspection and Engineering Interpretation via Visual Recalibration and Entity Reconstruction
par: Liu, Shipeng, et autres
Publié: (2026)
par: Liu, Shipeng, et autres
Publié: (2026)
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
par: Yang, Kaicheng, et autres
Publié: (2025)
par: Yang, Kaicheng, et autres
Publié: (2025)
Timestep-Aware Correction for Quantized Diffusion Models
par: Yao, Yuzhe, et autres
Publié: (2024)
par: Yao, Yuzhe, et autres
Publié: (2024)
CLICv2: Image Complexity Representation via Content Invariance Contrastive Learning
par: Liu, Shipeng, et autres
Publié: (2025)
par: Liu, Shipeng, et autres
Publié: (2025)
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
par: He, Yefei, et autres
Publié: (2023)
par: He, Yefei, et autres
Publié: (2023)
Minimize Quantization Output Error with Bias Compensation
par: Gong, Cheng, et autres
Publié: (2024)
par: Gong, Cheng, et autres
Publié: (2024)
Autoregressive Image Generation without Vector Quantization
par: Li, Tianhong, et autres
Publié: (2024)
par: Li, Tianhong, et autres
Publié: (2024)
FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling
par: Qiu, Haonan, et autres
Publié: (2023)
par: Qiu, Haonan, et autres
Publié: (2023)
Semantic Alignment and Reinforcement for Data-Free Quantization of Vision Transformers
par: Zhong, Yunshan, et autres
Publié: (2024)
par: Zhong, Yunshan, et autres
Publié: (2024)
Attention-driven GUI Grounding: Leveraging Pretrained Multimodal Large Language Models without Fine-Tuning
par: Xu, Hai-Ming, et autres
Publié: (2024)
par: Xu, Hai-Ming, et autres
Publié: (2024)
MetaMix: Meta-state Precision Searcher for Mixed-precision Activation Quantization
par: Kim, Han-Byul, et autres
Publié: (2023)
par: Kim, Han-Byul, et autres
Publié: (2023)
MixA-Q: Revisiting Activation Sparsity for Vision Transformers from a Mixed-Precision Quantization Perspective
par: Wang, Weitian, et autres
Publié: (2025)
par: Wang, Weitian, et autres
Publié: (2025)
MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
par: Zhao, Tianchen, et autres
Publié: (2024)
par: Zhao, Tianchen, et autres
Publié: (2024)
Memory-Efficient Fine-Tuning for Quantized Diffusion Model
par: Ryu, Hyogon, et autres
Publié: (2024)
par: Ryu, Hyogon, et autres
Publié: (2024)
FreeScene: Mixed Graph Diffusion for 3D Scene Synthesis from Free Prompts
par: Bai, Tongyuan, et autres
Publié: (2025)
par: Bai, Tongyuan, et autres
Publié: (2025)
Mixed Text Recognition with Efficient Parameter Fine-Tuning and Transformer
par: Chang, Da, et autres
Publié: (2024)
par: Chang, Da, et autres
Publié: (2024)
Documents similaires
-
DFQ-ViT: Data-Free Quantization for Vision Transformers without Fine-tuning
par: Tong, Yujia, et autres
Publié: (2025) -
FreeFix: Boosting 3D Gaussian Splatting via Fine-Tuning-Free Diffusion Models
par: Zhou, Hongyu, et autres
Publié: (2026) -
Adaptive Distribution-aware Quantization for Mixed-Precision Neural Networks
par: Jia, Shaohang, et autres
Publié: (2025) -
Mix-QSAM: Mixed-Precision Quantization of the Segment Anything Model
par: Ranjan, Navin, et autres
Publié: (2025) -
6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
par: Su, Rundong, et autres
Publié: (2026)