No Cache Left Idle: Accelerating diffusion model via Extreme-slimming Caching
Fuente:
arXiv
Salvato in:
| Autori principali: | Wen, Tingyan, Li, Haoyu, Chen, Yihuang, Zhou, Xing, Zhu, Lifei, Wang, Xueqian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
1.x-Distill: Breaking the Diversity, Quality, and Efficiency Barrier in Distribution Matching Distillation
di: Li, Haoyu, et al.
Pubblicazione: (2026)
di: Li, Haoyu, et al.
Pubblicazione: (2026)
ConvRot: Rotation-Based Plug-and-Play 4-bit Quantization for Diffusion Transformers
di: Huang, Feice, et al.
Pubblicazione: (2025)
di: Huang, Feice, et al.
Pubblicazione: (2025)
WorldCache: Accelerating World Models for Free via Heterogeneous Token Caching
di: Feng, Weilun, et al.
Pubblicazione: (2026)
di: Feng, Weilun, et al.
Pubblicazione: (2026)
Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
di: Ma, Xinyin, et al.
Pubblicazione: (2024)
di: Ma, Xinyin, et al.
Pubblicazione: (2024)
Accelerating Diffusion Transformer via Error-Optimized Cache
di: Qiu, Junxiang, et al.
Pubblicazione: (2025)
di: Qiu, Junxiang, et al.
Pubblicazione: (2025)
Accelerating Diffusion Transformer via Gradient-Optimized Cache
di: Qiu, Junxiang, et al.
Pubblicazione: (2025)
di: Qiu, Junxiang, et al.
Pubblicazione: (2025)
HiCache: A Plug-in Scaled-Hermite Upgrade for Taylor-Style Cache-then-Forecast Diffusion Acceleration
di: Feng, Liang, et al.
Pubblicazione: (2025)
di: Feng, Liang, et al.
Pubblicazione: (2025)
ProCache: Constraint-Aware Feature Caching with Selective Computation for Diffusion Transformer Acceleration
di: Cao, Fanpu, et al.
Pubblicazione: (2025)
di: Cao, Fanpu, et al.
Pubblicazione: (2025)
Accelerating Rectified Flow Models via Trajectory-Aware Caching
di: Liu, Xiao, et al.
Pubblicazione: (2026)
di: Liu, Xiao, et al.
Pubblicazione: (2026)
SeaCache: Spectral-Evolution-Aware Cache for Accelerating Diffusion Models
di: Chung, Jiwoo, et al.
Pubblicazione: (2026)
di: Chung, Jiwoo, et al.
Pubblicazione: (2026)
Cache Me if You Can: Accelerating Diffusion Models through Block Caching
di: Wimbauer, Felix, et al.
Pubblicazione: (2023)
di: Wimbauer, Felix, et al.
Pubblicazione: (2023)
PackCache: A Training-Free Acceleration Method for Unified Autoregressive Video Generation via Compact KV-Cache
di: Li, Kunyang, et al.
Pubblicazione: (2026)
di: Li, Kunyang, et al.
Pubblicazione: (2026)
LazyMAR: Accelerating Masked Autoregressive Models via Feature Caching
di: Yan, Feihong, et al.
Pubblicazione: (2025)
di: Yan, Feihong, et al.
Pubblicazione: (2025)
SenCache: Accelerating Diffusion Model Inference via Sensitivity-Aware Caching
di: Haghighi, Yasaman, et al.
Pubblicazione: (2026)
di: Haghighi, Yasaman, et al.
Pubblicazione: (2026)
Accelerating Controllable Generation via Hybrid-grained Cache
di: Liu, Lin, et al.
Pubblicazione: (2025)
di: Liu, Lin, et al.
Pubblicazione: (2025)
PreciseCache: Precise Feature Caching for Efficient and High-fidelity Video Generation
di: Wang, Jiangshan, et al.
Pubblicazione: (2026)
di: Wang, Jiangshan, et al.
Pubblicazione: (2026)
Less is Enough: Training-Free Video Diffusion Acceleration via Runtime-Adaptive Caching
di: Zhou, Xin, et al.
Pubblicazione: (2025)
di: Zhou, Xin, et al.
Pubblicazione: (2025)
DiCache: Let Diffusion Model Determine Its Own Cache
di: Bu, Jiazi, et al.
Pubblicazione: (2025)
di: Bu, Jiazi, et al.
Pubblicazione: (2025)
TaoCache: Structure-Maintained Video Generation Acceleration
di: Fan, Zhentao, et al.
Pubblicazione: (2025)
di: Fan, Zhentao, et al.
Pubblicazione: (2025)
FORA: Fast-Forward Caching in Diffusion Transformer Acceleration
di: Selvaraju, Pratheba, et al.
Pubblicazione: (2024)
di: Selvaraju, Pratheba, et al.
Pubblicazione: (2024)
StreamCacheVGGT: Streaming Visual Geometry Transformers with Robust Scoring and Hybrid Cache Compression
di: Liu, Xuanyi, et al.
Pubblicazione: (2026)
di: Liu, Xuanyi, et al.
Pubblicazione: (2026)
Token Caching for Diffusion Transformer Acceleration
di: Lou, Jinming, et al.
Pubblicazione: (2024)
di: Lou, Jinming, et al.
Pubblicazione: (2024)
Frequency-Aware Error-Bounded Caching for Accelerating Diffusion Transformers
di: Li, Guandong
Pubblicazione: (2026)
di: Li, Guandong
Pubblicazione: (2026)
Accelerating Text-to-Image Editing via Cache-Enabled Sparse Diffusion Inference
di: Yu, Zihao, et al.
Pubblicazione: (2023)
di: Yu, Zihao, et al.
Pubblicazione: (2023)
MagCache: Fast Video Generation with Magnitude-Aware Cache
di: Ma, Zehong, et al.
Pubblicazione: (2025)
di: Ma, Zehong, et al.
Pubblicazione: (2025)
CacheQuant: Comprehensively Accelerated Diffusion Models
di: Liu, Xuewen, et al.
Pubblicazione: (2025)
di: Liu, Xuewen, et al.
Pubblicazione: (2025)
Trajectory-Consistent Calibration for Cache-Accelerated Diffusion Models
di: Liang, Mingyu, et al.
Pubblicazione: (2026)
di: Liang, Mingyu, et al.
Pubblicazione: (2026)
VLA-Cache: Efficient Vision-Language-Action Manipulation via Adaptive Token Caching
di: Xu, Siyu, et al.
Pubblicazione: (2025)
di: Xu, Siyu, et al.
Pubblicazione: (2025)
Evolutionary Caching to Accelerate Your Off-the-Shelf Diffusion Model
di: Aggarwal, Anirud, et al.
Pubblicazione: (2025)
di: Aggarwal, Anirud, et al.
Pubblicazione: (2025)
OUSAC: Optimized Guidance Scheduling with Adaptive Caching for DiT Acceleration
di: Sun, Ruitong, et al.
Pubblicazione: (2025)
di: Sun, Ruitong, et al.
Pubblicazione: (2025)
Decouple and Cache: KV Cache Construction for Streaming Video Understanding
di: Pang, Zhanzhong, et al.
Pubblicazione: (2026)
di: Pang, Zhanzhong, et al.
Pubblicazione: (2026)
Point-Cache: Test-time Dynamic and Hierarchical Cache for Robust and Generalizable Point Cloud Analysis
di: Sun, Hongyu, et al.
Pubblicazione: (2025)
di: Sun, Hongyu, et al.
Pubblicazione: (2025)
GS-Cache: A GS-Cache Inference Framework for Large-scale Gaussian Splatting Models
di: Tao, Miao, et al.
Pubblicazione: (2025)
di: Tao, Miao, et al.
Pubblicazione: (2025)
WorldCache: Content-Aware Caching for Accelerated Video World Models
di: Nawaz, Umair, et al.
Pubblicazione: (2026)
di: Nawaz, Umair, et al.
Pubblicazione: (2026)
Relational Feature Caching for Accelerating Diffusion Transformers
di: Son, Byunggwan, et al.
Pubblicazione: (2026)
di: Son, Byunggwan, et al.
Pubblicazione: (2026)
CacheFlow: Fast Human Motion Prediction by Cached Normalizing Flow
di: Maeda, Takahiro, et al.
Pubblicazione: (2025)
di: Maeda, Takahiro, et al.
Pubblicazione: (2025)
X-Cache: Cross-Chunk Block Caching for Few-Step Autoregressive World Models Inference
di: Zeng, Yixiao, et al.
Pubblicazione: (2026)
di: Zeng, Yixiao, et al.
Pubblicazione: (2026)
TurboRAG: Accelerating Retrieval-Augmented Generation with Precomputed KV Caches for Chunked Text
di: Lu, Songshuo, et al.
Pubblicazione: (2024)
di: Lu, Songshuo, et al.
Pubblicazione: (2024)
QuantCache: Adaptive Importance-Guided Quantization with Hierarchical Latent and Layer Caching for Video Generation
di: Wu, Junyi, et al.
Pubblicazione: (2025)
di: Wu, Junyi, et al.
Pubblicazione: (2025)
LightCache: Memory-Efficient, Training-Free Acceleration for Video Generation
di: Xiao, Yang, et al.
Pubblicazione: (2025)
di: Xiao, Yang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
1.x-Distill: Breaking the Diversity, Quality, and Efficiency Barrier in Distribution Matching Distillation
di: Li, Haoyu, et al.
Pubblicazione: (2026) -
ConvRot: Rotation-Based Plug-and-Play 4-bit Quantization for Diffusion Transformers
di: Huang, Feice, et al.
Pubblicazione: (2025) -
WorldCache: Accelerating World Models for Free via Heterogeneous Token Caching
di: Feng, Weilun, et al.
Pubblicazione: (2026) -
Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
di: Ma, Xinyin, et al.
Pubblicazione: (2024) -
Accelerating Diffusion Transformer via Error-Optimized Cache
di: Qiu, Junxiang, et al.
Pubblicazione: (2025)