SenCache: Accelerating Diffusion Model Inference via Sensitivity-Aware Caching
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Haghighi, Yasaman, Alahi, Alexandre |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
LayerSync: Self-aligning Intermediate Layers
von: Haghighi, Yasaman, et al.
Veröffentlicht: (2025)
von: Haghighi, Yasaman, et al.
Veröffentlicht: (2025)
Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
von: Ma, Xinyin, et al.
Veröffentlicht: (2024)
von: Ma, Xinyin, et al.
Veröffentlicht: (2024)
FreqCa: Accelerating Diffusion Models via Frequency-Aware Caching
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025)
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025)
Token Caching for Diffusion Transformer Acceleration
von: Lou, Jinming, et al.
Veröffentlicht: (2024)
von: Lou, Jinming, et al.
Veröffentlicht: (2024)
Relational Feature Caching for Accelerating Diffusion Transformers
von: Son, Byunggwan, et al.
Veröffentlicht: (2026)
von: Son, Byunggwan, et al.
Veröffentlicht: (2026)
WorldCache: Content-Aware Caching for Accelerated Video World Models
von: Nawaz, Umair, et al.
Veröffentlicht: (2026)
von: Nawaz, Umair, et al.
Veröffentlicht: (2026)
Rethinking Token-wise Feature Caching: Accelerating Diffusion Transformers with Dual Feature Caching
von: Zou, Chang, et al.
Veröffentlicht: (2024)
von: Zou, Chang, et al.
Veröffentlicht: (2024)
Adaptive Hybrid Caching for Efficient Text-to-Video Diffusion Model Acceleration
von: Wei, Yuanxin, et al.
Veröffentlicht: (2025)
von: Wei, Yuanxin, et al.
Veröffentlicht: (2025)
Communication-Inspired Tokenization for Structured Image Representations
von: Davtyan, Aram, et al.
Veröffentlicht: (2026)
von: Davtyan, Aram, et al.
Veröffentlicht: (2026)
Token Pruning for Caching Better: 9 Times Acceleration on Stable Diffusion for Free
von: Zhang, Evelyn, et al.
Veröffentlicht: (2024)
von: Zhang, Evelyn, et al.
Veröffentlicht: (2024)
Accelerating Diffusion Transformers with Token-wise Feature Caching
von: Zou, Chang, et al.
Veröffentlicht: (2024)
von: Zou, Chang, et al.
Veröffentlicht: (2024)
FEB-Cache: Frequency-Guided Exposure Bias Reduction for Enhancing Diffusion Transformer Caching
von: Zou, Zhen, et al.
Veröffentlicht: (2025)
von: Zou, Zhen, et al.
Veröffentlicht: (2025)
Accelerating Diffusion Transformer via Increment-Calibrated Caching with Channel-Aware Singular Value Decomposition
von: Chen, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Chen, Zhiyuan, et al.
Veröffentlicht: (2025)
SeaCache: Spectral-Evolution-Aware Cache for Accelerating Diffusion Models
von: Chung, Jiwoo, et al.
Veröffentlicht: (2026)
von: Chung, Jiwoo, et al.
Veröffentlicht: (2026)
SpeCa: Accelerating Diffusion Transformers with Speculative Feature Caching
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025)
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025)
InvarDiff: Cross-Scale Invariance Caching for Accelerated Diffusion Models
von: Wu, Zihao
Veröffentlicht: (2025)
von: Wu, Zihao
Veröffentlicht: (2025)
MeanCache: From Instantaneous to Average Velocity for Accelerating Flow Matching Inference
von: Gao, Huanlin, et al.
Veröffentlicht: (2026)
von: Gao, Huanlin, et al.
Veröffentlicht: (2026)
LightCache: Memory-Efficient, Training-Free Acceleration for Video Generation
von: Xiao, Yang, et al.
Veröffentlicht: (2025)
von: Xiao, Yang, et al.
Veröffentlicht: (2025)
VLA-Cache: Efficient Vision-Language-Action Manipulation via Adaptive Token Caching
von: Xu, Siyu, et al.
Veröffentlicht: (2025)
von: Xu, Siyu, et al.
Veröffentlicht: (2025)
OmniCache: A Trajectory-Oriented Global Perspective on Training-Free Cache Reuse for Diffusion Transformer Models
von: Chu, Huanpeng, et al.
Veröffentlicht: (2025)
von: Chu, Huanpeng, et al.
Veröffentlicht: (2025)
ProCache: Constraint-Aware Feature Caching with Selective Computation for Diffusion Transformer Acceleration
von: Cao, Fanpu, et al.
Veröffentlicht: (2025)
von: Cao, Fanpu, et al.
Veröffentlicht: (2025)
DreamCache: Finetuning-Free Lightweight Personalized Image Generation via Feature Caching
von: Aiello, Emanuele, et al.
Veröffentlicht: (2024)
von: Aiello, Emanuele, et al.
Veröffentlicht: (2024)
TAROT: Targeted Data Selection via Optimal Transport
von: Feng, Lan, et al.
Veröffentlicht: (2024)
von: Feng, Lan, et al.
Veröffentlicht: (2024)
FastCache: Fast Caching for Diffusion Transformer Through Learnable Linear Approximation
von: Liu, Dong, et al.
Veröffentlicht: (2025)
von: Liu, Dong, et al.
Veröffentlicht: (2025)
Cache Me if You Can: Accelerating Diffusion Models through Block Caching
von: Wimbauer, Felix, et al.
Veröffentlicht: (2023)
von: Wimbauer, Felix, et al.
Veröffentlicht: (2023)
Accelerating Text-to-Image Editing via Cache-Enabled Sparse Diffusion Inference
von: Yu, Zihao, et al.
Veröffentlicht: (2023)
von: Yu, Zihao, et al.
Veröffentlicht: (2023)
CAMELTrack: Context-Aware Multi-cue ExpLoitation for Online Multi-Object Tracking
von: Somers, Vladimir, et al.
Veröffentlicht: (2025)
von: Somers, Vladimir, et al.
Veröffentlicht: (2025)
Co-Supervised Learning: Improving Weak-to-Strong Generalization with Hierarchical Mixture of Experts
von: Liu, Yuejiang, et al.
Veröffentlicht: (2024)
von: Liu, Yuejiang, et al.
Veröffentlicht: (2024)
Accelerating Rectified Flow Models via Trajectory-Aware Caching
von: Liu, Xiao, et al.
Veröffentlicht: (2026)
von: Liu, Xiao, et al.
Veröffentlicht: (2026)
Frequency-Aware Error-Bounded Caching for Accelerating Diffusion Transformers
von: Li, Guandong
Veröffentlicht: (2026)
von: Li, Guandong
Veröffentlicht: (2026)
A Survey on Cache Methods in Diffusion Models: Toward Efficient Multi-Modal Generation
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025)
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025)
Accelerating Diffusion Transformer via Gradient-Optimized Cache
von: Qiu, Junxiang, et al.
Veröffentlicht: (2025)
von: Qiu, Junxiang, et al.
Veröffentlicht: (2025)
Accelerating Diffusion Transformer via Error-Optimized Cache
von: Qiu, Junxiang, et al.
Veröffentlicht: (2025)
von: Qiu, Junxiang, et al.
Veröffentlicht: (2025)
WorldCache: Accelerating World Models for Free via Heterogeneous Token Caching
von: Feng, Weilun, et al.
Veröffentlicht: (2026)
von: Feng, Weilun, et al.
Veröffentlicht: (2026)
SpecDiff: Accelerating Diffusion Model Inference with Self-Speculation
von: Pan, Jiayi, et al.
Veröffentlicht: (2025)
von: Pan, Jiayi, et al.
Veröffentlicht: (2025)
Trajectory-Consistent Calibration for Cache-Accelerated Diffusion Models
von: Liang, Mingyu, et al.
Veröffentlicht: (2026)
von: Liang, Mingyu, et al.
Veröffentlicht: (2026)
FlashFPS: Efficient Farthest Point Sampling for Large-Scale Point Clouds via Pruning and Caching
von: Fu, Yuzhe, et al.
Veröffentlicht: (2026)
von: Fu, Yuzhe, et al.
Veröffentlicht: (2026)
CacheQuant: Comprehensively Accelerated Diffusion Models
von: Liu, Xuewen, et al.
Veröffentlicht: (2025)
von: Liu, Xuewen, et al.
Veröffentlicht: (2025)
Evolutionary Caching to Accelerate Your Off-the-Shelf Diffusion Model
von: Aggarwal, Anirud, et al.
Veröffentlicht: (2025)
von: Aggarwal, Anirud, et al.
Veröffentlicht: (2025)
No Cache Left Idle: Accelerating diffusion model via Extreme-slimming Caching
von: Wen, Tingyan, et al.
Veröffentlicht: (2025)
von: Wen, Tingyan, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
LayerSync: Self-aligning Intermediate Layers
von: Haghighi, Yasaman, et al.
Veröffentlicht: (2025) -
Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
von: Ma, Xinyin, et al.
Veröffentlicht: (2024) -
FreqCa: Accelerating Diffusion Models via Frequency-Aware Caching
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025) -
Token Caching for Diffusion Transformer Acceleration
von: Lou, Jinming, et al.
Veröffentlicht: (2024) -
Relational Feature Caching for Accelerating Diffusion Transformers
von: Son, Byunggwan, et al.
Veröffentlicht: (2026)