CacheQuant: Comprehensively Accelerated Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Xuewen, Li, Zhikai, Gu, Qingyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DilateQuant: Accurate and Efficient Diffusion Quantization via Weight Dilation
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
PTQ4ARVG: Post-Training Quantization for AutoRegressive Visual Generation Models
di: Liu, Xuewen, et al.
Pubblicazione: (2026)
di: Liu, Xuewen, et al.
Pubblicazione: (2026)
Rectified SpaAttn: Revisiting Attention Sparsity for Efficient Video Generation
di: Liu, Xuewen, et al.
Pubblicazione: (2025)
di: Liu, Xuewen, et al.
Pubblicazione: (2025)
Privacy-Preserving SAM Quantization for Efficient Edge Intelligence in Healthcare
di: Li, Zhikai, et al.
Pubblicazione: (2024)
di: Li, Zhikai, et al.
Pubblicazione: (2024)
Efficient-SAM2: Accelerating SAM2 with Object-Aware Visual Encoding and Memory Retrieval
di: Zhang, Jing, et al.
Pubblicazione: (2026)
di: Zhang, Jing, et al.
Pubblicazione: (2026)
K-Sort Arena: Efficient and Reliable Benchmarking for Generative Models via K-wise Human Preferences
di: Li, Zhikai, et al.
Pubblicazione: (2024)
di: Li, Zhikai, et al.
Pubblicazione: (2024)
SAQ-SAM: Semantically-Aligned Quantization for Segment Anything Model
di: Zhang, Jing, et al.
Pubblicazione: (2025)
di: Zhang, Jing, et al.
Pubblicazione: (2025)
EDA-DM: Enhanced Distribution Alignment for Post-Training Quantization of Diffusion Models
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
SegQuant: A Semantics-Aware and Generalizable Quantization Framework for Diffusion Models
di: Zhang, Jiaji, et al.
Pubblicazione: (2025)
di: Zhang, Jiaji, et al.
Pubblicazione: (2025)
DisCa: Accelerating Video Diffusion Transformers with Distillation-Compatible Learnable Feature Caching
di: Zou, Chang, et al.
Pubblicazione: (2026)
di: Zou, Chang, et al.
Pubblicazione: (2026)
H2-Cache: A Novel Hierarchical Dual-Stage Cache for High-Performance Acceleration of Generative Diffusion Models
di: Sung, Mingyu, et al.
Pubblicazione: (2025)
di: Sung, Mingyu, et al.
Pubblicazione: (2025)
Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models
di: Li, Zhikai, et al.
Pubblicazione: (2026)
di: Li, Zhikai, et al.
Pubblicazione: (2026)
Accelerating Diffusion Transformers with Token-wise Feature Caching
di: Zou, Chang, et al.
Pubblicazione: (2024)
di: Zou, Chang, et al.
Pubblicazione: (2024)
BWCache: Accelerating Video Diffusion Transformers through Block-Wise Caching
di: Cui, Hanshuai, et al.
Pubblicazione: (2025)
di: Cui, Hanshuai, et al.
Pubblicazione: (2025)
SpeCa: Accelerating Diffusion Transformers with Speculative Feature Caching
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
FreqCa: Accelerating Diffusion Models via Frequency-Aware Caching
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
A Survey on Cache Methods in Diffusion Models: Toward Efficient Multi-Modal Generation
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
Rethinking Token-wise Feature Caching: Accelerating Diffusion Transformers with Dual Feature Caching
di: Zou, Chang, et al.
Pubblicazione: (2024)
di: Zou, Chang, et al.
Pubblicazione: (2024)
Accelerating Diffusion-based Video Editing via Heterogeneous Caching: Beyond Full Computing at Sampled Denoising Timestep
di: Liu, Tianyi, et al.
Pubblicazione: (2026)
di: Liu, Tianyi, et al.
Pubblicazione: (2026)
AdaCorrection: Adaptive Offset Cache Correction for Accurate Diffusion Transformers
di: Liu, Dong, et al.
Pubblicazione: (2026)
di: Liu, Dong, et al.
Pubblicazione: (2026)
PhysQuantAgent: An Inference Pipeline of Mass Estimation for Vision-Language Models
di: Yokomizo, Hisayuki, et al.
Pubblicazione: (2026)
di: Yokomizo, Hisayuki, et al.
Pubblicazione: (2026)
WorldCache: Content-Aware Caching for Accelerated Video World Models
di: Nawaz, Umair, et al.
Pubblicazione: (2026)
di: Nawaz, Umair, et al.
Pubblicazione: (2026)
From Reusing to Forecasting: Accelerating Diffusion Models with TaylorSeers
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
di: Liu, Jiacheng, et al.
Pubblicazione: (2025)
Fast Autoregressive Video Diffusion and World Models with Temporal Cache Compression and Sparse Attention
di: Samuel, Dvir, et al.
Pubblicazione: (2026)
di: Samuel, Dvir, et al.
Pubblicazione: (2026)
Quant Experts: Token-aware Adaptive Error Reconstruction with Mixture of Experts for Large Vision-Language Models Quantization
di: Jia, Chenwei, et al.
Pubblicazione: (2026)
di: Jia, Chenwei, et al.
Pubblicazione: (2026)
HybridStitch: Pixel and Timestep Level Model Stitching for Diffusion Acceleration
di: Sun, Desen, et al.
Pubblicazione: (2026)
di: Sun, Desen, et al.
Pubblicazione: (2026)
3DTurboQuant: Training-Free Near-Optimal Quantization for 3D Reconstruction Models
di: Lee, Jae Joong
Pubblicazione: (2026)
di: Lee, Jae Joong
Pubblicazione: (2026)
SLTNet: Efficient Event-based Semantic Segmentation with Spike-driven Lightweight Transformer-based Networks
di: Long, Xianlei, et al.
Pubblicazione: (2024)
di: Long, Xianlei, et al.
Pubblicazione: (2024)
Forecasting When to Forecast: Accelerating Diffusion Models with Confidence-Gated Taylor
di: Guan, Xiaoliu, et al.
Pubblicazione: (2025)
di: Guan, Xiaoliu, et al.
Pubblicazione: (2025)
Accelerating Diffusion Models with One-to-Many Knowledge Distillation
di: Zhang, Linfeng, et al.
Pubblicazione: (2024)
di: Zhang, Linfeng, et al.
Pubblicazione: (2024)
Morse: Dual-Sampling for Lossless Acceleration of Diffusion Models
di: Li, Chao, et al.
Pubblicazione: (2025)
di: Li, Chao, et al.
Pubblicazione: (2025)
LeMiCa: Lexicographic Minimax Path Caching for Efficient Diffusion-Based Video Generation
di: Gao, Huanlin, et al.
Pubblicazione: (2025)
di: Gao, Huanlin, et al.
Pubblicazione: (2025)
ProtoQuant: Quantization of Prototypical Parts For General and Fine-Grained Image Classification
di: Janusz, Mikołaj, et al.
Pubblicazione: (2026)
di: Janusz, Mikołaj, et al.
Pubblicazione: (2026)
DC-Gen: Post-Training Diffusion Acceleration with Deeply Compressed Latent Space
di: He, Wenkun, et al.
Pubblicazione: (2025)
di: He, Wenkun, et al.
Pubblicazione: (2025)
OmniCache: A Trajectory-Oriented Global Perspective on Training-Free Cache Reuse for Diffusion Transformer Models
di: Chu, Huanpeng, et al.
Pubblicazione: (2025)
di: Chu, Huanpeng, et al.
Pubblicazione: (2025)
FRDiff : Feature Reuse for Universal Training-free Acceleration of Diffusion Models
di: So, Junhyuk, et al.
Pubblicazione: (2023)
di: So, Junhyuk, et al.
Pubblicazione: (2023)
A Comprehensive Survey on Concept Erasure in Text-to-Image Diffusion Models
di: Kim, Changhoon, et al.
Pubblicazione: (2025)
di: Kim, Changhoon, et al.
Pubblicazione: (2025)
MeanCache: From Instantaneous to Average Velocity for Accelerating Flow Matching Inference
di: Gao, Huanlin, et al.
Pubblicazione: (2026)
di: Gao, Huanlin, et al.
Pubblicazione: (2026)
AirCache: Activating Inter-modal Relevancy KV Cache Compression for Efficient Large Vision-Language Model Inference
di: Huang, Kai, et al.
Pubblicazione: (2025)
di: Huang, Kai, et al.
Pubblicazione: (2025)
VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2026)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2026)
Documenti analoghi
-
DilateQuant: Accurate and Efficient Diffusion Quantization via Weight Dilation
di: Liu, Xuewen, et al.
Pubblicazione: (2024) -
PTQ4ARVG: Post-Training Quantization for AutoRegressive Visual Generation Models
di: Liu, Xuewen, et al.
Pubblicazione: (2026) -
Rectified SpaAttn: Revisiting Attention Sparsity for Efficient Video Generation
di: Liu, Xuewen, et al.
Pubblicazione: (2025) -
Privacy-Preserving SAM Quantization for Efficient Edge Intelligence in Healthcare
di: Li, Zhikai, et al.
Pubblicazione: (2024) -
Efficient-SAM2: Accelerating SAM2 with Object-Aware Visual Encoding and Memory Retrieval
di: Zhang, Jing, et al.
Pubblicazione: (2026)