Low-Bitwidth Floating Point Quantization for Efficient High-Quality Diffusion Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Cheng, Giannoula, Christina, Moshovos, Andreas |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
FP4DiT: Towards Effective Floating Point Quantization for Diffusion Transformers
von: Chen, Ruichen, et al.
Veröffentlicht: (2025)
von: Chen, Ruichen, et al.
Veröffentlicht: (2025)
Content-Aware Radiance Fields: Aligning Model Complexity with Scene Intricacy Through Learned Bitwidth Quantization
von: Liu, Weihang, et al.
Veröffentlicht: (2024)
von: Liu, Weihang, et al.
Veröffentlicht: (2024)
FLIQS: One-Shot Mixed-Precision Floating-Point and Integer Quantization Search
von: Dotzel, Jordan, et al.
Veröffentlicht: (2023)
von: Dotzel, Jordan, et al.
Veröffentlicht: (2023)
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
von: He, Yefei, et al.
Veröffentlicht: (2023)
von: He, Yefei, et al.
Veröffentlicht: (2023)
FPQVAR: Floating Point Quantization for Visual Autoregressive Model with FPGA Hardware Co-design
von: Wei, Renjie, et al.
Veröffentlicht: (2025)
von: Wei, Renjie, et al.
Veröffentlicht: (2025)
LLM-FP4: 4-Bit Floating-Point Quantized Transformers
von: Liu, Shih-yang, et al.
Veröffentlicht: (2023)
von: Liu, Shih-yang, et al.
Veröffentlicht: (2023)
QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning
von: Wang, Haoxuan, et al.
Veröffentlicht: (2024)
von: Wang, Haoxuan, et al.
Veröffentlicht: (2024)
Accelerate High-Quality Diffusion Models with Inner Loop Feedback
von: Gwilliam, Matthew, et al.
Veröffentlicht: (2025)
von: Gwilliam, Matthew, et al.
Veröffentlicht: (2025)
Joint Architecture-Token-Bitwidth Multi-Axis Optimization of Vision Transformers for Semiconductor IC Packaging
von: Nguyen, Phat, et al.
Veröffentlicht: (2026)
von: Nguyen, Phat, et al.
Veröffentlicht: (2026)
IntLoRA: Integral Low-rank Adaptation of Quantized Diffusion Models
von: Guo, Hang, et al.
Veröffentlicht: (2024)
von: Guo, Hang, et al.
Veröffentlicht: (2024)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
von: Feng, Weilun, et al.
Veröffentlicht: (2024)
von: Feng, Weilun, et al.
Veröffentlicht: (2024)
OSP-Next: Efficient High-Quality Video Generation with Sparse Sequence Parallelism, HiF8 Quantization, and Reinforcement Learning
von: Ge, Yunyang, et al.
Veröffentlicht: (2026)
von: Ge, Yunyang, et al.
Veröffentlicht: (2026)
HQ-DM: Single Hadamard Transformation-Based Quantization-Aware Training for Low-Bit Diffusion Models
von: Mao, Shizhuo, et al.
Veröffentlicht: (2025)
von: Mao, Shizhuo, et al.
Veröffentlicht: (2025)
DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
von: Wang, Zhendong, et al.
Veröffentlicht: (2025)
von: Wang, Zhendong, et al.
Veröffentlicht: (2025)
VividFace: High-Quality and Efficient One-Step Diffusion For Video Face Enhancement
von: Zhang, Shulian, et al.
Veröffentlicht: (2025)
von: Zhang, Shulian, et al.
Veröffentlicht: (2025)
Efficient and Scalable Point Cloud Generation with Sparse Point-Voxel Diffusion Models
von: Romanelis, Ioannis, et al.
Veröffentlicht: (2024)
von: Romanelis, Ioannis, et al.
Veröffentlicht: (2024)
Timestep-Aware Correction for Quantized Diffusion Models
von: Yao, Yuzhe, et al.
Veröffentlicht: (2024)
von: Yao, Yuzhe, et al.
Veröffentlicht: (2024)
Learning Quantized Adaptive Conditions for Diffusion Models
von: Liang, Yuchen, et al.
Veröffentlicht: (2024)
von: Liang, Yuchen, et al.
Veröffentlicht: (2024)
TAFG-MAN: Timestep-Adaptive Frequency-Gated Latent Diffusion for Efficient and High-Quality Low-Dose CT Image Denoising
von: Fang, Tangtangfang, et al.
Veröffentlicht: (2026)
von: Fang, Tangtangfang, et al.
Veröffentlicht: (2026)
MAN: Latent Diffusion Enhanced Multistage Anti-Noise Network for Efficient and High-Quality Low-Dose CT Image Denoising
von: Fang, Tangtangfang, et al.
Veröffentlicht: (2025)
von: Fang, Tangtangfang, et al.
Veröffentlicht: (2025)
Sampling-Aware Quantization for Diffusion Models
von: Zeng, Qian, et al.
Veröffentlicht: (2025)
von: Zeng, Qian, et al.
Veröffentlicht: (2025)
Diffusion Model Quantization: A Review
von: Zeng, Qian, et al.
Veröffentlicht: (2025)
von: Zeng, Qian, et al.
Veröffentlicht: (2025)
Memory-Efficient Fine-Tuning for Quantized Diffusion Model
von: Ryu, Hyogon, et al.
Veröffentlicht: (2024)
von: Ryu, Hyogon, et al.
Veröffentlicht: (2024)
PQD: Post-training Quantization for Efficient Diffusion Models
von: Ye, Jiaojiao, et al.
Veröffentlicht: (2024)
von: Ye, Jiaojiao, et al.
Veröffentlicht: (2024)
Efficient Personalization of Quantized Diffusion Model without Backpropagation
von: Seo, Hoigi, et al.
Veröffentlicht: (2025)
von: Seo, Hoigi, et al.
Veröffentlicht: (2025)
LowDiff: Efficient Diffusion Sampling with Low-Resolution Condition
von: Xu, Jiuyi, et al.
Veröffentlicht: (2025)
von: Xu, Jiuyi, et al.
Veröffentlicht: (2025)
BitQ: Tailoring Block Floating Point Precision for Improved DNN Efficiency on Resource-Constrained Devices
von: Xu, Yongqi, et al.
Veröffentlicht: (2024)
von: Xu, Yongqi, et al.
Veröffentlicht: (2024)
TCAQ-DM: Timestep-Channel Adaptive Quantization for Diffusion Models
von: Huang, Haocheng, et al.
Veröffentlicht: (2024)
von: Huang, Haocheng, et al.
Veröffentlicht: (2024)
6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
von: Su, Rundong, et al.
Veröffentlicht: (2026)
von: Su, Rundong, et al.
Veröffentlicht: (2026)
Quantized Prompt for Efficient Generalization of Vision-Language Models
von: Hao, Tianxiang, et al.
Veröffentlicht: (2024)
von: Hao, Tianxiang, et al.
Veröffentlicht: (2024)
SaRA: High-Efficient Diffusion Model Fine-tuning with Progressive Sparse Low-Rank Adaptation
von: Hu, Teng, et al.
Veröffentlicht: (2024)
von: Hu, Teng, et al.
Veröffentlicht: (2024)
QuantU-Net: Efficient Wearable Medical Imaging Using Bitwidth as a Trainable Parameter
von: Boerkamp, Christiaan, et al.
Veröffentlicht: (2025)
von: Boerkamp, Christiaan, et al.
Veröffentlicht: (2025)
HighSync: High-Quality Lip Synchronization via Latent Diffusion Models
von: Daghigh, Saeed Firouzi, et al.
Veröffentlicht: (2026)
von: Daghigh, Saeed Firouzi, et al.
Veröffentlicht: (2026)
Dual-Expert Consistency Model for Efficient and High-Quality Video Generation
von: Lv, Zhengyao, et al.
Veröffentlicht: (2025)
von: Lv, Zhengyao, et al.
Veröffentlicht: (2025)
PointQ-Bench: Benchmarking Diagnostic and Interpretable Point Cloud Quality Assessment
von: Wang, Duanchu, et al.
Veröffentlicht: (2026)
von: Wang, Duanchu, et al.
Veröffentlicht: (2026)
Diffusion Product Quantization
von: Shao, Jie, et al.
Veröffentlicht: (2024)
von: Shao, Jie, et al.
Veröffentlicht: (2024)
PDT: Point Distribution Transformation with Diffusion Models
von: Wang, Jionghao, et al.
Veröffentlicht: (2025)
von: Wang, Jionghao, et al.
Veröffentlicht: (2025)
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
von: Feng, Weilun, et al.
Veröffentlicht: (2025)
von: Feng, Weilun, et al.
Veröffentlicht: (2025)
PointDiffuse: A Dual-Conditional Diffusion Model for Enhanced Point Cloud Semantic Segmentation
von: He, Yong, et al.
Veröffentlicht: (2025)
von: He, Yong, et al.
Veröffentlicht: (2025)
VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models
von: Chen, Haoxin, et al.
Veröffentlicht: (2024)
von: Chen, Haoxin, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
FP4DiT: Towards Effective Floating Point Quantization for Diffusion Transformers
von: Chen, Ruichen, et al.
Veröffentlicht: (2025) -
Content-Aware Radiance Fields: Aligning Model Complexity with Scene Intricacy Through Learned Bitwidth Quantization
von: Liu, Weihang, et al.
Veröffentlicht: (2024) -
FLIQS: One-Shot Mixed-Precision Floating-Point and Integer Quantization Search
von: Dotzel, Jordan, et al.
Veröffentlicht: (2023) -
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
von: He, Yefei, et al.
Veröffentlicht: (2023) -
FPQVAR: Floating Point Quantization for Visual Autoregressive Model with FPGA Hardware Co-design
von: Wei, Renjie, et al.
Veröffentlicht: (2025)