MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
Fuente:
arXiv
Salvato in:
| Autori principali: | Feng, Weilun, Yang, Chuanguang, Qin, Haotong, Li, Yuqi, Li, Xiangqi, An, Zhulin, Huang, Libo, Diao, Boyu, Zhuang, Fuzhen, Magno, Michele, Xu, Yongjun, Tian, Yingli, Huang, Tingwen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
di: Feng, Weilun, et al.
Pubblicazione: (2024)
di: Feng, Weilun, et al.
Pubblicazione: (2024)
Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
Quantized Visual Geometry Grounded Transformer
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
Relational Diffusion Distillation for Efficient Image Generation
di: Feng, Weilun, et al.
Pubblicazione: (2024)
di: Feng, Weilun, et al.
Pubblicazione: (2024)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
Teacher-Guided Student Self-Knowledge Distillation Using Diffusion Model
di: Wang, Yu, et al.
Pubblicazione: (2026)
di: Wang, Yu, et al.
Pubblicazione: (2026)
WorldCache: Accelerating World Models for Free via Heterogeneous Token Caching
di: Feng, Weilun, et al.
Pubblicazione: (2026)
di: Feng, Weilun, et al.
Pubblicazione: (2026)
CLIP-KD: An Empirical Study of CLIP Model Distillation
di: Yang, Chuanguang, et al.
Pubblicazione: (2023)
di: Yang, Chuanguang, et al.
Pubblicazione: (2023)
Efficient Continual Learning through Frequency Decomposition and Integration
di: Liu, Ruiqi, et al.
Pubblicazione: (2025)
di: Liu, Ruiqi, et al.
Pubblicazione: (2025)
Online Policy Distillation with Decision-Attention
di: Yu, Xinqiang, et al.
Pubblicazione: (2024)
di: Yu, Xinqiang, et al.
Pubblicazione: (2024)
Parameterized Prompt for Incremental Object Detection
di: An, Zijia, et al.
Pubblicazione: (2025)
di: An, Zijia, et al.
Pubblicazione: (2025)
Echo-Forcing: A Scene Memory Framework for Interactive Long Video Generation
di: Wu, Mingqiang, et al.
Pubblicazione: (2026)
di: Wu, Mingqiang, et al.
Pubblicazione: (2026)
Multi-party Collaborative Attention Control for Image Customization
di: Yang, Han, et al.
Pubblicazione: (2025)
di: Yang, Han, et al.
Pubblicazione: (2025)
Low-redundancy Distillation for Continual Learning
di: Liu, RuiQi, et al.
Pubblicazione: (2023)
di: Liu, RuiQi, et al.
Pubblicazione: (2023)
Frequency-Aligned Knowledge Distillation for Lightweight Spatiotemporal Forecasting
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
PrePrompt: Predictive prompting for class incremental learning
di: Huang, Libo, et al.
Pubblicazione: (2025)
di: Huang, Libo, et al.
Pubblicazione: (2025)
Continual Learning in the Frequency Domain
di: Liu, Ruiqi, et al.
Pubblicazione: (2024)
di: Liu, Ruiqi, et al.
Pubblicazione: (2024)
IOR: Inversed Objects Replay for Incremental Object Detection
di: An, Zijia, et al.
Pubblicazione: (2024)
di: An, Zijia, et al.
Pubblicazione: (2024)
Multi-Teacher Knowledge Distillation with Reinforcement Learning for Visual Recognition
di: Yang, Chuanguang, et al.
Pubblicazione: (2025)
di: Yang, Chuanguang, et al.
Pubblicazione: (2025)
SRKD: Towards Efficient 3D Point Cloud Segmentation via Structure- and Relation-aware Knowledge Distillation
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
Exemplar-Free Class Incremental Learning via Incremental Representation
di: Huang, Libo, et al.
Pubblicazione: (2024)
di: Huang, Libo, et al.
Pubblicazione: (2024)
Federated Knowledge Distillation for Multi-Model Architectures Lithography Hotspot Detection
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
MMT-ARD: Multimodal Multi-Teacher Adversarial Distillation for Robust Vision-Language Models
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
Distilling Time Series Foundation Models for Efficient Forecasting
di: Li, Yuqi, et al.
Pubblicazione: (2026)
di: Li, Yuqi, et al.
Pubblicazione: (2026)
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
di: Maruzzelli, Rocco Manz, et al.
Pubblicazione: (2024)
di: Maruzzelli, Rocco Manz, et al.
Pubblicazione: (2024)
A Nonlinear Hash-based Optimization Method for SpMV on GPUs
di: Yan, Chen, et al.
Pubblicazione: (2025)
di: Yan, Chen, et al.
Pubblicazione: (2025)
Dynamical Adapter Fusion: Constructing A Global Adapter for Pre-Trained Model-based Class-Incremental Learning
di: Liu, Ruiqi, et al.
Pubblicazione: (2026)
di: Liu, Ruiqi, et al.
Pubblicazione: (2026)
From Isolation to Integration: Building an Adaptive Expert Forest for Pre-Trained Model-based Class-Incremental Learning
di: Liu, Ruiqi, et al.
Pubblicazione: (2026)
di: Liu, Ruiqi, et al.
Pubblicazione: (2026)
SGLP: A Similarity Guided Fast Layer Partition Pruning for Compressing Large Deep Models
di: Li, Yuqi, et al.
Pubblicazione: (2024)
di: Li, Yuqi, et al.
Pubblicazione: (2024)
Semantic-Guided Dynamic Sparsification for Pre-Trained Model-based Class-Incremental Learning
di: Liu, Ruiqi, et al.
Pubblicazione: (2026)
di: Liu, Ruiqi, et al.
Pubblicazione: (2026)
A Survey on Causal Inference for Recommendation
di: Luo, Huishi, et al.
Pubblicazione: (2023)
di: Luo, Huishi, et al.
Pubblicazione: (2023)
MultiAnimate: Pose-Guided Image Animation Made Extensible
di: Hu, Yingcheng, et al.
Pubblicazione: (2026)
di: Hu, Yingcheng, et al.
Pubblicazione: (2026)
DDTime: Dataset Distillation with Spectral Alignment and Information Bottleneck for Time-Series Forecasting
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
GaitKD: A Universal Decoupled Distillation Framework for Efficient Gait Recognition
di: Li, Yuqi, et al.
Pubblicazione: (2026)
di: Li, Yuqi, et al.
Pubblicazione: (2026)
DyBit: Dynamic Bit-Precision Numbers for Efficient Quantized Neural Network Inference
di: Zhou, Jiajun, et al.
Pubblicazione: (2023)
di: Zhou, Jiajun, et al.
Pubblicazione: (2023)
SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language Models
di: Huang, Wei, et al.
Pubblicazione: (2024)
di: Huang, Wei, et al.
Pubblicazione: (2024)
FlexiBit: Fully Flexible Precision Bit-parallel Accelerator Architecture for Arbitrary Mixed Precision AI
di: Tahmasebi, Faraz, et al.
Pubblicazione: (2024)
di: Tahmasebi, Faraz, et al.
Pubblicazione: (2024)
On-Chip Hardware-Aware Quantization for Mixed Precision Neural Networks
di: Huang, Wei, et al.
Pubblicazione: (2023)
di: Huang, Wei, et al.
Pubblicazione: (2023)
Documenti analoghi
-
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
di: Feng, Weilun, et al.
Pubblicazione: (2024) -
Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers
di: Feng, Weilun, et al.
Pubblicazione: (2025) -
S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
di: Feng, Weilun, et al.
Pubblicazione: (2025) -
Quantized Visual Geometry Grounded Transformer
di: Feng, Weilun, et al.
Pubblicazione: (2025) -
Relational Diffusion Distillation for Efficient Image Generation
di: Feng, Weilun, et al.
Pubblicazione: (2024)