EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Yefei, Liu, Jing, Wu, Weijia, Zhou, Hong, Zhuang, Bohan |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ZipVL: Efficient Large Vision-Language Models with Dynamic Token Sparsification
par: He, Yefei, et autres
Publié: (2024)
par: He, Yefei, et autres
Publié: (2024)
FlashAR: Efficient Post-Training Acceleration for Autoregressive Image Generation
par: Zhou, Junkang, et autres
Publié: (2026)
par: Zhou, Junkang, et autres
Publié: (2026)
Neighboring Autoregressive Modeling for Efficient Visual Generation
par: He, Yefei, et autres
Publié: (2025)
par: He, Yefei, et autres
Publié: (2025)
HQ-DM: Single Hadamard Transformation-Based Quantization-Aware Training for Low-Bit Diffusion Models
par: Mao, Shizhuo, et autres
Publié: (2025)
par: Mao, Shizhuo, et autres
Publié: (2025)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
par: Feng, Weilun, et autres
Publié: (2024)
par: Feng, Weilun, et autres
Publié: (2024)
Memory-Efficient Fine-Tuning for Quantized Diffusion Model
par: Ryu, Hyogon, et autres
Publié: (2024)
par: Ryu, Hyogon, et autres
Publié: (2024)
Towards Accurate Post-training Quantization for Reparameterized Models
par: Zhang, Luoming, et autres
Publié: (2024)
par: Zhang, Luoming, et autres
Publié: (2024)
OmniSparse: Training-Aware Fine-Grained Sparse Attention for Long-Video MLLMs
par: Chen, Feng, et autres
Publié: (2025)
par: Chen, Feng, et autres
Publié: (2025)
LoRAPrune: Structured Pruning Meets Low-Rank Parameter-Efficient Fine-Tuning
par: Zhang, Mingyang, et autres
Publié: (2023)
par: Zhang, Mingyang, et autres
Publié: (2023)
Spectrum-Aware Parameter Efficient Fine-Tuning for Diffusion Models
par: Zhang, Xinxi, et autres
Publié: (2024)
par: Zhang, Xinxi, et autres
Publié: (2024)
Paragraph-to-Image Generation with Information-Enriched Diffusion Model
par: Wu, Weijia, et autres
Publié: (2023)
par: Wu, Weijia, et autres
Publié: (2023)
EasyTune: Efficient Step-Aware Fine-Tuning for Diffusion-Based Motion Generation
par: Tan, Xiaofeng, et autres
Publié: (2026)
par: Tan, Xiaofeng, et autres
Publié: (2026)
Progressive Fine-to-Coarse Reconstruction for Accurate Low-Bit Post-Training Quantization in Vision Transformers
par: Ding, Rui, et autres
Publié: (2024)
par: Ding, Rui, et autres
Publié: (2024)
ZipAR: Parallel Auto-regressive Image Generation through Spatial Locality
par: He, Yefei, et autres
Publié: (2024)
par: He, Yefei, et autres
Publié: (2024)
ModaVerse: Efficiently Transforming Modalities with LLMs
par: Wang, Xinyu, et autres
Publié: (2024)
par: Wang, Xinyu, et autres
Publié: (2024)
BiDM: Pushing the Limit of Quantization for Diffusion Models
par: Zheng, Xingyu, et autres
Publié: (2024)
par: Zheng, Xingyu, et autres
Publié: (2024)
PQCAD-DM: Progressive Quantization and Calibration-Assisted Distillation for Extremely Efficient Diffusion Model
par: Ko, Beomseok, et autres
Publié: (2025)
par: Ko, Beomseok, et autres
Publié: (2025)
TMPQ-DM: Joint Timestep Reduction and Quantization Precision Selection for Efficient Diffusion Models
par: Sun, Haojun, et autres
Publié: (2024)
par: Sun, Haojun, et autres
Publié: (2024)
VARD: Efficient and Dense Fine-Tuning for Diffusion Models with Value-based RL
par: Dai, Fengyuan, et autres
Publié: (2025)
par: Dai, Fengyuan, et autres
Publié: (2025)
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
par: Feng, Weilun, et autres
Publié: (2025)
par: Feng, Weilun, et autres
Publié: (2025)
TFMQ-DM: Temporal Feature Maintenance Quantization for Diffusion Models
par: Huang, Yushi, et autres
Publié: (2023)
par: Huang, Yushi, et autres
Publié: (2023)
DAPE: Dual-Stage Parameter-Efficient Fine-Tuning for Consistent Video Editing with Diffusion Models
par: Xia, Junhao, et autres
Publié: (2025)
par: Xia, Junhao, et autres
Publié: (2025)
Less Detail, Better Answers: Degradation-Driven Prompting for VQA
par: Han, Haoxuan, et autres
Publié: (2026)
par: Han, Haoxuan, et autres
Publié: (2026)
BinaryDM: Accurate Weight Binarization for Efficient Diffusion Models
par: Zheng, Xingyu, et autres
Publié: (2024)
par: Zheng, Xingyu, et autres
Publié: (2024)
JAQ: Joint Efficient Architecture Design and Low-Bit Quantization with Hardware-Software Co-Exploration
par: Wang, Mingzi, et autres
Publié: (2025)
par: Wang, Mingzi, et autres
Publié: (2025)
ZipCache: Accurate and Efficient KV Cache Quantization with Salient Token Identification
par: He, Yefei, et autres
Publié: (2024)
par: He, Yefei, et autres
Publié: (2024)
AQD: Towards Accurate Fully-Quantized Object Detection
par: Chen, Peng, et autres
Publié: (2020)
par: Chen, Peng, et autres
Publié: (2020)
QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning
par: Wang, Haoxuan, et autres
Publié: (2024)
par: Wang, Haoxuan, et autres
Publié: (2024)
Efficient Stitchable Task Adaptation
par: He, Haoyu, et autres
Publié: (2023)
par: He, Haoyu, et autres
Publié: (2023)
Low-rank Attention Side-Tuning for Parameter-Efficient Fine-Tuning
par: Tang, Ningyuan, et autres
Publié: (2024)
par: Tang, Ningyuan, et autres
Publié: (2024)
Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis
par: Chen, Zhuokun, et autres
Publié: (2025)
par: Chen, Zhuokun, et autres
Publié: (2025)
Streaming Video Diffusion: Online Video Editing with Diffusion Models
par: Chen, Feng, et autres
Publié: (2024)
par: Chen, Feng, et autres
Publié: (2024)
LongVLM: Efficient Long Video Understanding via Large Language Models
par: Weng, Yuetian, et autres
Publié: (2024)
par: Weng, Yuetian, et autres
Publié: (2024)
Distribution-Aware Hadamard Quantization for Hardware-Efficient Implicit Neural Representations
par: Zhou, Wenyong, et autres
Publié: (2025)
par: Zhou, Wenyong, et autres
Publié: (2025)
Low-Bitwidth Floating Point Quantization for Efficient High-Quality Diffusion Models
par: Chen, Cheng, et autres
Publié: (2024)
par: Chen, Cheng, et autres
Publié: (2024)
TCAQ-DM: Timestep-Channel Adaptive Quantization for Diffusion Models
par: Huang, Haocheng, et autres
Publié: (2024)
par: Huang, Haocheng, et autres
Publié: (2024)
Q$^2$: Quantization-Aware Gradient Balancing and Attention Alignment for Low-Bit Quantization
par: Wang, Zhaoyang, et autres
Publié: (2025)
par: Wang, Zhaoyang, et autres
Publié: (2025)
Efficient Fine-Tuning and Concept Suppression for Pruned Diffusion Models
par: Shirkavand, Reza, et autres
Publié: (2024)
par: Shirkavand, Reza, et autres
Publié: (2024)
CDM-QTA: Quantized Training Acceleration for Efficient LoRA Fine-Tuning of Diffusion Model
par: Lu, Jinming, et autres
Publié: (2025)
par: Lu, Jinming, et autres
Publié: (2025)
MEC-Quant: Maximum Entropy Coding for Extremely Low Bit Quantization-Aware Training
par: Pang, Junbiao, et autres
Publié: (2025)
par: Pang, Junbiao, et autres
Publié: (2025)
Documents similaires
-
ZipVL: Efficient Large Vision-Language Models with Dynamic Token Sparsification
par: He, Yefei, et autres
Publié: (2024) -
FlashAR: Efficient Post-Training Acceleration for Autoregressive Image Generation
par: Zhou, Junkang, et autres
Publié: (2026) -
Neighboring Autoregressive Modeling for Efficient Visual Generation
par: He, Yefei, et autres
Publié: (2025) -
HQ-DM: Single Hadamard Transformation-Based Quantization-Aware Training for Low-Bit Diffusion Models
par: Mao, Shizhuo, et autres
Publié: (2025) -
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
par: Feng, Weilun, et autres
Publié: (2024)