QVGen: Pushing the Limit of Quantized Video Generative Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Yushi, Gong, Ruihao, Liu, Jing, Ding, Yifu, Lv, Chengtao, Qin, Haotong, Zhang, Jun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation
di: Huang, Yushi, et al.
Pubblicazione: (2025)
di: Huang, Yushi, et al.
Pubblicazione: (2025)
Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention
di: Lv, Chengtao, et al.
Pubblicazione: (2026)
di: Lv, Chengtao, et al.
Pubblicazione: (2026)
BiDM: Pushing the Limit of Quantization for Diffusion Models
di: Zheng, Xingyu, et al.
Pubblicazione: (2024)
di: Zheng, Xingyu, et al.
Pubblicazione: (2024)
Post-Training Quantization for Video Matting
di: Zhu, Tianrui, et al.
Pubblicazione: (2025)
di: Zhu, Tianrui, et al.
Pubblicazione: (2025)
QuantSR+: Pushing the Limit of Quantized Image Super-Resolution Networks
di: Qin, Haotong, et al.
Pubblicazione: (2026)
di: Qin, Haotong, et al.
Pubblicazione: (2026)
TFMQ-DM: Temporal Feature Maintenance Quantization for Diffusion Models
di: Huang, Yushi, et al.
Pubblicazione: (2023)
di: Huang, Yushi, et al.
Pubblicazione: (2023)
Temporal Feature Matters: A Framework for Diffusion Model Quantization
di: Huang, Yushi, et al.
Pubblicazione: (2024)
di: Huang, Yushi, et al.
Pubblicazione: (2024)
PTQ4SAM: Post-Training Quantization for Segment Anything
di: Lv, Chengtao, et al.
Pubblicazione: (2024)
di: Lv, Chengtao, et al.
Pubblicazione: (2024)
MoDES: Accelerating Mixture-of-Experts Multimodal Large Language Models via Dynamic Expert Skipping
di: Huang, Yushi, et al.
Pubblicazione: (2025)
di: Huang, Yushi, et al.
Pubblicazione: (2025)
LLMC+: Benchmarking Vision-Language Model Compression with a Plug-and-play Toolkit
di: Lv, Chengtao, et al.
Pubblicazione: (2025)
di: Lv, Chengtao, et al.
Pubblicazione: (2025)
HarmoniCa: Harmonizing Training and Inference for Better Feature Caching in Diffusion Transformer Acceleration
di: Huang, Yushi, et al.
Pubblicazione: (2024)
di: Huang, Yushi, et al.
Pubblicazione: (2024)
RobuQ: Pushing DiTs to W1.58A2 via Robust Activation Quantization
di: Yang, Kaicheng, et al.
Pubblicazione: (2025)
di: Yang, Kaicheng, et al.
Pubblicazione: (2025)
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
di: Yang, Kaicheng, et al.
Pubblicazione: (2025)
di: Yang, Kaicheng, et al.
Pubblicazione: (2025)
QVD: Post-training Quantization for Video Diffusion Models
di: Tian, Shilong, et al.
Pubblicazione: (2024)
di: Tian, Shilong, et al.
Pubblicazione: (2024)
Q&C: When Quantization Meets Cache in Efficient Image Generation
di: Ding, Xin, et al.
Pubblicazione: (2025)
di: Ding, Xin, et al.
Pubblicazione: (2025)
Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
DVD-Quant: Data-free Video Diffusion Transformers Quantization
di: Li, Zhiteng, et al.
Pubblicazione: (2025)
di: Li, Zhiteng, et al.
Pubblicazione: (2025)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
SGMD: Score Gradient Matching Distillation for Few-Step Video Diffusion Distillation
di: Wu, Zhuguanyu, et al.
Pubblicazione: (2026)
di: Wu, Zhuguanyu, et al.
Pubblicazione: (2026)
1-Bit FQT: Pushing the Limit of Fully Quantized Training to 1-bit
di: Gao, Chang, et al.
Pubblicazione: (2024)
di: Gao, Chang, et al.
Pubblicazione: (2024)
Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models
di: Zhong, Yi, et al.
Pubblicazione: (2026)
di: Zhong, Yi, et al.
Pubblicazione: (2026)
Selective Focus: Investigating Semantics Sensitivity in Post-training Quantization for Lane Detection
di: Fan, Yunqian, et al.
Pubblicazione: (2024)
di: Fan, Yunqian, et al.
Pubblicazione: (2024)
Q-MambaIR: Accurate Quantized Mamba for Efficient Image Restoration
di: Chen, Yujie, et al.
Pubblicazione: (2025)
di: Chen, Yujie, et al.
Pubblicazione: (2025)
S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
Flash-VAED: Plug-and-Play VAE Decoders for Efficient Video Generation
di: Zhu, Lunjie, et al.
Pubblicazione: (2026)
di: Zhu, Lunjie, et al.
Pubblicazione: (2026)
Collaborative Few-Step Distillation and Low-Bit Quantization for Wan2.2 Dual-Expert Video Diffusion Models
di: Du, Jinyang, et al.
Pubblicazione: (2026)
di: Du, Jinyang, et al.
Pubblicazione: (2026)
I&S-ViT: An Inclusive & Stable Method for Pushing the Limit of Post-Training ViTs Quantization
di: Zhong, Yunshan, et al.
Pubblicazione: (2023)
di: Zhong, Yunshan, et al.
Pubblicazione: (2023)
Q-DiT4SR: Exploration of Detail-Preserving Diffusion Transformer Quantization for Real-World Image Super-Resolution
di: Zhang, Xun, et al.
Pubblicazione: (2026)
di: Zhang, Xun, et al.
Pubblicazione: (2026)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
di: Feng, Weilun, et al.
Pubblicazione: (2024)
di: Feng, Weilun, et al.
Pubblicazione: (2024)
AdaTSQ: Pushing the Pareto Frontier of Diffusion Transformers via Temporal-Sensitivity Quantization
di: Zhang, Shaoqiu, et al.
Pubblicazione: (2026)
di: Zhang, Shaoqiu, et al.
Pubblicazione: (2026)
QuantFace: Efficient Quantization for Face Restoration
di: Li, Jiatong, et al.
Pubblicazione: (2025)
di: Li, Jiatong, et al.
Pubblicazione: (2025)
Bi-VLM: Pushing Ultra-Low Precision Post-Training Quantization Boundaries in Vision-Language Models
di: Wang, Xijun, et al.
Pubblicazione: (2025)
di: Wang, Xijun, et al.
Pubblicazione: (2025)
Quantized Visual Geometry Grounded Transformer
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
Reinforced Diffusion: Learning to Push the Limits of Anisotropic Diffusion for Image Denoising
di: Qin, Xinran, et al.
Pubblicazione: (2025)
di: Qin, Xinran, et al.
Pubblicazione: (2025)
Echo-Forcing: A Scene Memory Framework for Interactive Long Video Generation
di: Wu, Mingqiang, et al.
Pubblicazione: (2026)
di: Wu, Mingqiang, et al.
Pubblicazione: (2026)
Event-Priori-Based Vision-Language Model for Efficient Visual Understanding
di: Qin, Haotong, et al.
Pubblicazione: (2025)
di: Qin, Haotong, et al.
Pubblicazione: (2025)
Pushing the Boundaries of State Space Models for Image and Video Generation
di: Hong, Yicong, et al.
Pubblicazione: (2025)
di: Hong, Yicong, et al.
Pubblicazione: (2025)
Q-SAM2: Accurate Quantization for Segment Anything Model 2
di: Farronato, Nicola, et al.
Pubblicazione: (2025)
di: Farronato, Nicola, et al.
Pubblicazione: (2025)
VLMQ: Token Saliency-Driven Post-Training Quantization for Vision-language Models
di: Xue, Yufei, et al.
Pubblicazione: (2025)
di: Xue, Yufei, et al.
Pubblicazione: (2025)
PassionSR: Post-Training Quantization with Adaptive Scale in One-Step Diffusion based Image Super-Resolution
di: Zhu, Libo, et al.
Pubblicazione: (2024)
di: Zhu, Libo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation
di: Huang, Yushi, et al.
Pubblicazione: (2025) -
Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention
di: Lv, Chengtao, et al.
Pubblicazione: (2026) -
BiDM: Pushing the Limit of Quantization for Diffusion Models
di: Zheng, Xingyu, et al.
Pubblicazione: (2024) -
Post-Training Quantization for Video Matting
di: Zhu, Tianrui, et al.
Pubblicazione: (2025) -
QuantSR+: Pushing the Limit of Quantized Image Super-Resolution Networks
di: Qin, Haotong, et al.
Pubblicazione: (2026)