6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Su, Rundong, Zhang, Jintao, Yuan, Zhihang, Duanmu, Haojie, Chen, Jianfei, Zhu, Jun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
par: Feng, Weilun, et autres
Publié: (2024)
par: Feng, Weilun, et autres
Publié: (2024)
TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times
par: Zhang, Jintao, et autres
Publié: (2025)
par: Zhang, Jintao, et autres
Publié: (2025)
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
par: Feng, Weilun, et autres
Publié: (2025)
par: Feng, Weilun, et autres
Publié: (2025)
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
par: Maruzzelli, Rocco Manz, et autres
Publié: (2024)
par: Maruzzelli, Rocco Manz, et autres
Publié: (2024)
BitsFusion: 1.99 bits Weight Quantization of Diffusion Model
par: Sui, Yang, et autres
Publié: (2024)
par: Sui, Yang, et autres
Publié: (2024)
QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning
par: Wang, Haoxuan, et autres
Publié: (2024)
par: Wang, Haoxuan, et autres
Publié: (2024)
Large Scale Diffusion Distillation via Score-Regularized Continuous-Time Consistency
par: Zheng, Kaiwen, et autres
Publié: (2025)
par: Zheng, Kaiwen, et autres
Publié: (2025)
DiTFastAttnV2: Head-wise Attention Compression for Multi-Modality Diffusion Transformers
par: Zhang, Hanling, et autres
Publié: (2025)
par: Zhang, Hanling, et autres
Publié: (2025)
Consistency Diffusion Bridge Models
par: He, Guande, et autres
Publié: (2024)
par: He, Guande, et autres
Publié: (2024)
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
par: Yang, Kaicheng, et autres
Publié: (2025)
par: Yang, Kaicheng, et autres
Publié: (2025)
TMPQ-DM: Joint Timestep Reduction and Quantization Precision Selection for Efficient Diffusion Models
par: Sun, Haojun, et autres
Publié: (2024)
par: Sun, Haojun, et autres
Publié: (2024)
TMPDiff: Temporal Mixed-Precision for Diffusion Models
par: Lewandowski, Basile, et autres
Publié: (2026)
par: Lewandowski, Basile, et autres
Publié: (2026)
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
par: He, Yefei, et autres
Publié: (2023)
par: He, Yefei, et autres
Publié: (2023)
HQ-DM: Single Hadamard Transformation-Based Quantization-Aware Training for Low-Bit Diffusion Models
par: Mao, Shizhuo, et autres
Publié: (2025)
par: Mao, Shizhuo, et autres
Publié: (2025)
SemanticDialect: Semantic-Aware Mixed-Format Quantization for Video Diffusion Transformers
par: Jang, Wonsuk, et autres
Publié: (2026)
par: Jang, Wonsuk, et autres
Publié: (2026)
SageAttention3: Microscaling FP4 Attention for Inference and An Exploration of 8-Bit Training
par: Zhang, Jintao, et autres
Publié: (2025)
par: Zhang, Jintao, et autres
Publié: (2025)
UltraViCo: Breaking Extrapolation Limits in Video Diffusion Transformers
par: Zhao, Min, et autres
Publié: (2025)
par: Zhao, Min, et autres
Publié: (2025)
Q-ARVD: Quantizing Autoregressive Video Diffusion Models
par: Tang, Siao, et autres
Publié: (2026)
par: Tang, Siao, et autres
Publié: (2026)
MoQAE: Mixed-Precision Quantization for Long-Context LLM Inference via Mixture of Quantization-Aware Experts
par: Tao, Wei, et autres
Publié: (2025)
par: Tao, Wei, et autres
Publié: (2025)
Mix-QSAM: Mixed-Precision Quantization of the Segment Anything Model
par: Ranjan, Navin, et autres
Publié: (2025)
par: Ranjan, Navin, et autres
Publié: (2025)
MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
par: Zhao, Tianchen, et autres
Publié: (2024)
par: Zhao, Tianchen, et autres
Publié: (2024)
Timestep-Aware Correction for Quantized Diffusion Models
par: Yao, Yuzhe, et autres
Publié: (2024)
par: Yao, Yuzhe, et autres
Publié: (2024)
QuantVSR: Low-Bit Post-Training Quantization for Real-World Video Super-Resolution
par: Chai, Bowen, et autres
Publié: (2025)
par: Chai, Bowen, et autres
Publié: (2025)
1-Bit FQT: Pushing the Limit of Fully Quantized Training to 1-bit
par: Gao, Chang, et autres
Publié: (2024)
par: Gao, Chang, et autres
Publié: (2024)
Gradient-Aligned Calibration for Post-Training Quantization of Diffusion Models
par: Hoang, Dung Anh, et autres
Publié: (2026)
par: Hoang, Dung Anh, et autres
Publié: (2026)
Collaborative Few-Step Distillation and Low-Bit Quantization for Wan2.2 Dual-Expert Video Diffusion Models
par: Du, Jinyang, et autres
Publié: (2026)
par: Du, Jinyang, et autres
Publié: (2026)
TR-DQ: Time-Rotation Diffusion Quantization
par: Shao, Yihua, et autres
Publié: (2025)
par: Shao, Yihua, et autres
Publié: (2025)
VGDFR: Diffusion-based Video Generation with Dynamic Latent Frame Rate
par: Yuan, Zhihang, et autres
Publié: (2025)
par: Yuan, Zhihang, et autres
Publié: (2025)
Mimir: Improving Video Diffusion Models for Precise Text Understanding
par: Tan, Shuai, et autres
Publié: (2024)
par: Tan, Shuai, et autres
Publié: (2024)
Real-Time Motion-Controllable Autoregressive Video Diffusion
par: Zhao, Kesen, et autres
Publié: (2025)
par: Zhao, Kesen, et autres
Publié: (2025)
DVD-Quant: Data-free Video Diffusion Transformers Quantization
par: Li, Zhiteng, et autres
Publié: (2025)
par: Li, Zhiteng, et autres
Publié: (2025)
QVD: Post-training Quantization for Video Diffusion Models
par: Tian, Shilong, et autres
Publié: (2024)
par: Tian, Shilong, et autres
Publié: (2024)
Understanding Attention Mechanism in Video Diffusion Models
par: Liu, Bingyan, et autres
Publié: (2025)
par: Liu, Bingyan, et autres
Publié: (2025)
Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps
par: Ma, Nanye, et autres
Publié: (2025)
par: Ma, Nanye, et autres
Publié: (2025)
Value-Driven Mixed-Precision Quantization for Patch-Based Inference on Microcontrollers
par: Tao, Wei, et autres
Publié: (2024)
par: Tao, Wei, et autres
Publié: (2024)
DOVE: Efficient One-Step Diffusion Model for Real-World Video Super-Resolution
par: Chen, Zheng, et autres
Publié: (2025)
par: Chen, Zheng, et autres
Publié: (2025)
DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models
par: Lu, Cheng, et autres
Publié: (2022)
par: Lu, Cheng, et autres
Publié: (2022)
Diffusion Product Quantization
par: Shao, Jie, et autres
Publié: (2024)
par: Shao, Jie, et autres
Publié: (2024)
SpargeAttention: Accurate and Training-free Sparse Attention Accelerating Any Model Inference
par: Zhang, Jintao, et autres
Publié: (2025)
par: Zhang, Jintao, et autres
Publié: (2025)
Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
par: Xi, Haocheng, et autres
Publié: (2025)
par: Xi, Haocheng, et autres
Publié: (2025)
Documents similaires
-
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
par: Feng, Weilun, et autres
Publié: (2024) -
TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times
par: Zhang, Jintao, et autres
Publié: (2025) -
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
par: Feng, Weilun, et autres
Publié: (2025) -
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
par: Maruzzelli, Rocco Manz, et autres
Publié: (2024) -
BitsFusion: 1.99 bits Weight Quantization of Diffusion Model
par: Sui, Yang, et autres
Publié: (2024)