Temporal Feature Matters: A Framework for Diffusion Model Quantization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Yushi, Gong, Ruihao, Liu, Xianglong, Liu, Jing, Li, Yuhang, Lu, Jiwen, Tao, Dacheng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TFMQ-DM: Temporal Feature Maintenance Quantization for Diffusion Models
par: Huang, Yushi, et autres
Publié: (2023)
par: Huang, Yushi, et autres
Publié: (2023)
HarmoniCa: Harmonizing Training and Inference for Better Feature Caching in Diffusion Transformer Acceleration
par: Huang, Yushi, et autres
Publié: (2024)
par: Huang, Yushi, et autres
Publié: (2024)
QVGen: Pushing the Limit of Quantized Video Generative Models
par: Huang, Yushi, et autres
Publié: (2025)
par: Huang, Yushi, et autres
Publié: (2025)
SGMD: Score Gradient Matching Distillation for Few-Step Video Diffusion Distillation
par: Wu, Zhuguanyu, et autres
Publié: (2026)
par: Wu, Zhuguanyu, et autres
Publié: (2026)
MoDES: Accelerating Mixture-of-Experts Multimodal Large Language Models via Dynamic Expert Skipping
par: Huang, Yushi, et autres
Publié: (2025)
par: Huang, Yushi, et autres
Publié: (2025)
LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation
par: Huang, Yushi, et autres
Publié: (2025)
par: Huang, Yushi, et autres
Publié: (2025)
Selective Focus: Investigating Semantics Sensitivity in Post-training Quantization for Lane Detection
par: Fan, Yunqian, et autres
Publié: (2024)
par: Fan, Yunqian, et autres
Publié: (2024)
Collaborative Few-Step Distillation and Low-Bit Quantization for Wan2.2 Dual-Expert Video Diffusion Models
par: Du, Jinyang, et autres
Publié: (2026)
par: Du, Jinyang, et autres
Publié: (2026)
Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention
par: Lv, Chengtao, et autres
Publié: (2026)
par: Lv, Chengtao, et autres
Publié: (2026)
CogMorph: Cognitive Morphing Attacks for Text-to-Image Models
par: Jing, Zonglei, et autres
Publié: (2025)
par: Jing, Zonglei, et autres
Publié: (2025)
Towards Accurate Post-training Quantization for Diffusion Models
par: Wang, Changyuan, et autres
Publié: (2023)
par: Wang, Changyuan, et autres
Publié: (2023)
QVD: Post-training Quantization for Video Diffusion Models
par: Tian, Shilong, et autres
Publié: (2024)
par: Tian, Shilong, et autres
Publié: (2024)
Unveiling the Safety of GPT-4o: An Empirical Study using Jailbreak Attacks
par: Ying, Zonghao, et autres
Publié: (2024)
par: Ying, Zonghao, et autres
Publié: (2024)
BiDM: Pushing the Limit of Quantization for Diffusion Models
par: Zheng, Xingyu, et autres
Publié: (2024)
par: Zheng, Xingyu, et autres
Publié: (2024)
AdaTSQ: Pushing the Pareto Frontier of Diffusion Transformers via Temporal-Sensitivity Quantization
par: Zhang, Shaoqiu, et autres
Publié: (2026)
par: Zhang, Shaoqiu, et autres
Publié: (2026)
LanEvil: Benchmarking the Robustness of Lane Detection to Environmental Illusions
par: Zhang, Tianyuan, et autres
Publié: (2024)
par: Zhang, Tianyuan, et autres
Publié: (2024)
Fast and Controllable Post-training Sparsity: Learning Optimal Sparsity Allocation with Global Constraint in Minutes
par: Gong, Ruihao, et autres
Publié: (2024)
par: Gong, Ruihao, et autres
Publié: (2024)
HandRefiner: Refining Malformed Hands in Generated Images by Diffusion-based Conditional Inpainting
par: Lu, Wenquan, et autres
Publié: (2023)
par: Lu, Wenquan, et autres
Publié: (2023)
Black-Box Adversarial Attack on Vision Language Models for Autonomous Driving
par: Wang, Lu, et autres
Publié: (2025)
par: Wang, Lu, et autres
Publié: (2025)
Oryx MLLM: On-Demand Spatial-Temporal Understanding at Arbitrary Resolution
par: Liu, Zuyan, et autres
Publié: (2024)
par: Liu, Zuyan, et autres
Publié: (2024)
Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt
par: Ying, Zonghao, et autres
Publié: (2024)
par: Ying, Zonghao, et autres
Publié: (2024)
Q-VLM: Post-training Quantization for Large Vision-Language Models
par: Wang, Changyuan, et autres
Publié: (2024)
par: Wang, Changyuan, et autres
Publié: (2024)
GenderBias-\emph{VL}: Benchmarking Gender Bias in Vision Language Models via Counterfactual Probing
par: Xiao, Yisong, et autres
Publié: (2024)
par: Xiao, Yisong, et autres
Publié: (2024)
First-Order Error Matters: Accurate Compensation for Quantized Large Language Models
par: Zheng, Xingyu, et autres
Publié: (2025)
par: Zheng, Xingyu, et autres
Publié: (2025)
NanoControl: A Lightweight Framework for Precise and Efficient Control in Diffusion Transformer
par: Liu, Shanyuan, et autres
Publié: (2025)
par: Liu, Shanyuan, et autres
Publié: (2025)
LLMC+: Benchmarking Vision-Language Model Compression with a Plug-and-play Toolkit
par: Lv, Chengtao, et autres
Publié: (2025)
par: Lv, Chengtao, et autres
Publié: (2025)
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
par: Feng, Weilun, et autres
Publié: (2025)
par: Feng, Weilun, et autres
Publié: (2025)
Post-Training Quantization for Video Matting
par: Zhu, Tianrui, et autres
Publié: (2025)
par: Zhu, Tianrui, et autres
Publié: (2025)
Moaw: Unleashing Motion Awareness for Video Diffusion Models
par: Zhang, Tianqi, et autres
Publié: (2026)
par: Zhang, Tianqi, et autres
Publié: (2026)
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
par: He, Yefei, et autres
Publié: (2023)
par: He, Yefei, et autres
Publié: (2023)
Simultaneous Image-to-Zero and Zero-to-Noise: Diffusion Models with Analytical Image Attenuation
par: Huang, Yuhang, et autres
Publié: (2023)
par: Huang, Yuhang, et autres
Publié: (2023)
IntLoRA: Integral Low-rank Adaptation of Quantized Diffusion Models
par: Guo, Hang, et autres
Publié: (2024)
par: Guo, Hang, et autres
Publié: (2024)
Efficiency Meets Fidelity: A Novel Quantization Framework for Stable Diffusion
par: Li, Shuaiting, et autres
Publié: (2024)
par: Li, Shuaiting, et autres
Publié: (2024)
Temporal Sampling Frequency Matters: A Capacity-Aware Study of End-to-End Driving Trajectory Prediction
par: Liu, Yumao, et autres
Publié: (2026)
par: Liu, Yumao, et autres
Publié: (2026)
Event-based Simultaneous Localization and Mapping: A Comprehensive Survey
par: Huang, Kunping, et autres
Publié: (2023)
par: Huang, Kunping, et autres
Publié: (2023)
Preventing Local Pitfalls in Vector Quantization via Optimal Transport
par: Zhang, Borui, et autres
Publié: (2024)
par: Zhang, Borui, et autres
Publié: (2024)
Unsupervised Modality Adaptation with Text-to-Image Diffusion Models for Semantic Segmentation
par: Xia, Ruihao, et autres
Publié: (2024)
par: Xia, Ruihao, et autres
Publié: (2024)
CrossDiff: Diffusion Probabilistic Model With Cross-conditional Encoder-Decoder for Crack Segmentation
par: Shi, Xianglong, et autres
Publié: (2025)
par: Shi, Xianglong, et autres
Publié: (2025)
Temporal-Guided Visual Foundation Models for Event-Based Vision
par: Xia, Ruihao, et autres
Publié: (2025)
par: Xia, Ruihao, et autres
Publié: (2025)
GraphThinker: Reinforcing Temporally Grounded Video Reasoning with Event Graph Thinking
par: Cheng, Zixu, et autres
Publié: (2026)
par: Cheng, Zixu, et autres
Publié: (2026)
Documents similaires
-
TFMQ-DM: Temporal Feature Maintenance Quantization for Diffusion Models
par: Huang, Yushi, et autres
Publié: (2023) -
HarmoniCa: Harmonizing Training and Inference for Better Feature Caching in Diffusion Transformer Acceleration
par: Huang, Yushi, et autres
Publié: (2024) -
QVGen: Pushing the Limit of Quantized Video Generative Models
par: Huang, Yushi, et autres
Publié: (2025) -
SGMD: Score Gradient Matching Distillation for Few-Step Video Diffusion Distillation
par: Wu, Zhuguanyu, et autres
Publié: (2026) -
MoDES: Accelerating Mixture-of-Experts Multimodal Large Language Models via Dynamic Expert Skipping
par: Huang, Yushi, et autres
Publié: (2025)