6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Su, Rundong, Zhang, Jintao, Yuan, Zhihang, Duanmu, Haojie, Chen, Jianfei, Zhu, Jun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
di: Feng, Weilun, et al.
Pubblicazione: (2024)
di: Feng, Weilun, et al.
Pubblicazione: (2024)
TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
di: Maruzzelli, Rocco Manz, et al.
Pubblicazione: (2024)
di: Maruzzelli, Rocco Manz, et al.
Pubblicazione: (2024)
BitsFusion: 1.99 bits Weight Quantization of Diffusion Model
di: Sui, Yang, et al.
Pubblicazione: (2024)
di: Sui, Yang, et al.
Pubblicazione: (2024)
QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning
di: Wang, Haoxuan, et al.
Pubblicazione: (2024)
di: Wang, Haoxuan, et al.
Pubblicazione: (2024)
Large Scale Diffusion Distillation via Score-Regularized Continuous-Time Consistency
di: Zheng, Kaiwen, et al.
Pubblicazione: (2025)
di: Zheng, Kaiwen, et al.
Pubblicazione: (2025)
DiTFastAttnV2: Head-wise Attention Compression for Multi-Modality Diffusion Transformers
di: Zhang, Hanling, et al.
Pubblicazione: (2025)
di: Zhang, Hanling, et al.
Pubblicazione: (2025)
Consistency Diffusion Bridge Models
di: He, Guande, et al.
Pubblicazione: (2024)
di: He, Guande, et al.
Pubblicazione: (2024)
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
di: Yang, Kaicheng, et al.
Pubblicazione: (2025)
di: Yang, Kaicheng, et al.
Pubblicazione: (2025)
TMPQ-DM: Joint Timestep Reduction and Quantization Precision Selection for Efficient Diffusion Models
di: Sun, Haojun, et al.
Pubblicazione: (2024)
di: Sun, Haojun, et al.
Pubblicazione: (2024)
TMPDiff: Temporal Mixed-Precision for Diffusion Models
di: Lewandowski, Basile, et al.
Pubblicazione: (2026)
di: Lewandowski, Basile, et al.
Pubblicazione: (2026)
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
di: He, Yefei, et al.
Pubblicazione: (2023)
di: He, Yefei, et al.
Pubblicazione: (2023)
HQ-DM: Single Hadamard Transformation-Based Quantization-Aware Training for Low-Bit Diffusion Models
di: Mao, Shizhuo, et al.
Pubblicazione: (2025)
di: Mao, Shizhuo, et al.
Pubblicazione: (2025)
SemanticDialect: Semantic-Aware Mixed-Format Quantization for Video Diffusion Transformers
di: Jang, Wonsuk, et al.
Pubblicazione: (2026)
di: Jang, Wonsuk, et al.
Pubblicazione: (2026)
SageAttention3: Microscaling FP4 Attention for Inference and An Exploration of 8-Bit Training
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
UltraViCo: Breaking Extrapolation Limits in Video Diffusion Transformers
di: Zhao, Min, et al.
Pubblicazione: (2025)
di: Zhao, Min, et al.
Pubblicazione: (2025)
Q-ARVD: Quantizing Autoregressive Video Diffusion Models
di: Tang, Siao, et al.
Pubblicazione: (2026)
di: Tang, Siao, et al.
Pubblicazione: (2026)
MoQAE: Mixed-Precision Quantization for Long-Context LLM Inference via Mixture of Quantization-Aware Experts
di: Tao, Wei, et al.
Pubblicazione: (2025)
di: Tao, Wei, et al.
Pubblicazione: (2025)
Mix-QSAM: Mixed-Precision Quantization of the Segment Anything Model
di: Ranjan, Navin, et al.
Pubblicazione: (2025)
di: Ranjan, Navin, et al.
Pubblicazione: (2025)
MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
Timestep-Aware Correction for Quantized Diffusion Models
di: Yao, Yuzhe, et al.
Pubblicazione: (2024)
di: Yao, Yuzhe, et al.
Pubblicazione: (2024)
QuantVSR: Low-Bit Post-Training Quantization for Real-World Video Super-Resolution
di: Chai, Bowen, et al.
Pubblicazione: (2025)
di: Chai, Bowen, et al.
Pubblicazione: (2025)
1-Bit FQT: Pushing the Limit of Fully Quantized Training to 1-bit
di: Gao, Chang, et al.
Pubblicazione: (2024)
di: Gao, Chang, et al.
Pubblicazione: (2024)
Gradient-Aligned Calibration for Post-Training Quantization of Diffusion Models
di: Hoang, Dung Anh, et al.
Pubblicazione: (2026)
di: Hoang, Dung Anh, et al.
Pubblicazione: (2026)
Collaborative Few-Step Distillation and Low-Bit Quantization for Wan2.2 Dual-Expert Video Diffusion Models
di: Du, Jinyang, et al.
Pubblicazione: (2026)
di: Du, Jinyang, et al.
Pubblicazione: (2026)
TR-DQ: Time-Rotation Diffusion Quantization
di: Shao, Yihua, et al.
Pubblicazione: (2025)
di: Shao, Yihua, et al.
Pubblicazione: (2025)
VGDFR: Diffusion-based Video Generation with Dynamic Latent Frame Rate
di: Yuan, Zhihang, et al.
Pubblicazione: (2025)
di: Yuan, Zhihang, et al.
Pubblicazione: (2025)
Mimir: Improving Video Diffusion Models for Precise Text Understanding
di: Tan, Shuai, et al.
Pubblicazione: (2024)
di: Tan, Shuai, et al.
Pubblicazione: (2024)
Real-Time Motion-Controllable Autoregressive Video Diffusion
di: Zhao, Kesen, et al.
Pubblicazione: (2025)
di: Zhao, Kesen, et al.
Pubblicazione: (2025)
DVD-Quant: Data-free Video Diffusion Transformers Quantization
di: Li, Zhiteng, et al.
Pubblicazione: (2025)
di: Li, Zhiteng, et al.
Pubblicazione: (2025)
QVD: Post-training Quantization for Video Diffusion Models
di: Tian, Shilong, et al.
Pubblicazione: (2024)
di: Tian, Shilong, et al.
Pubblicazione: (2024)
Understanding Attention Mechanism in Video Diffusion Models
di: Liu, Bingyan, et al.
Pubblicazione: (2025)
di: Liu, Bingyan, et al.
Pubblicazione: (2025)
Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps
di: Ma, Nanye, et al.
Pubblicazione: (2025)
di: Ma, Nanye, et al.
Pubblicazione: (2025)
Value-Driven Mixed-Precision Quantization for Patch-Based Inference on Microcontrollers
di: Tao, Wei, et al.
Pubblicazione: (2024)
di: Tao, Wei, et al.
Pubblicazione: (2024)
DOVE: Efficient One-Step Diffusion Model for Real-World Video Super-Resolution
di: Chen, Zheng, et al.
Pubblicazione: (2025)
di: Chen, Zheng, et al.
Pubblicazione: (2025)
DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models
di: Lu, Cheng, et al.
Pubblicazione: (2022)
di: Lu, Cheng, et al.
Pubblicazione: (2022)
Diffusion Product Quantization
di: Shao, Jie, et al.
Pubblicazione: (2024)
di: Shao, Jie, et al.
Pubblicazione: (2024)
SpargeAttention: Accurate and Training-free Sparse Attention Accelerating Any Model Inference
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
di: Xi, Haocheng, et al.
Pubblicazione: (2025)
di: Xi, Haocheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
di: Feng, Weilun, et al.
Pubblicazione: (2024) -
TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times
di: Zhang, Jintao, et al.
Pubblicazione: (2025) -
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
di: Feng, Weilun, et al.
Pubblicazione: (2025) -
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
di: Maruzzelli, Rocco Manz, et al.
Pubblicazione: (2024) -
BitsFusion: 1.99 bits Weight Quantization of Diffusion Model
di: Sui, Yang, et al.
Pubblicazione: (2024)