Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Xinyin, Fang, Gongfan, Mi, Michael Bi, Wang, Xinchao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TinyFusion: Diffusion Transformers Learned Shallow
por: Fang, Gongfan, et al.
Publicado: (2024)
por: Fang, Gongfan, et al.
Publicado: (2024)
Isomorphic Pruning for Vision Models
por: Fang, Gongfan, et al.
Publicado: (2024)
por: Fang, Gongfan, et al.
Publicado: (2024)
Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising
por: Fang, Gongfan, et al.
Publicado: (2024)
por: Fang, Gongfan, et al.
Publicado: (2024)
Token Caching for Diffusion Transformer Acceleration
por: Lou, Jinming, et al.
Publicado: (2024)
por: Lou, Jinming, et al.
Publicado: (2024)
In-Video Instructions: Visual Signals as Generative Control
por: Fang, Gongfan, et al.
Publicado: (2025)
por: Fang, Gongfan, et al.
Publicado: (2025)
Relational Feature Caching for Accelerating Diffusion Transformers
por: Son, Byunggwan, et al.
Publicado: (2026)
por: Son, Byunggwan, et al.
Publicado: (2026)
Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient
por: Chen, Zigeng, et al.
Publicado: (2024)
por: Chen, Zigeng, et al.
Publicado: (2024)
SlimSAM: 0.1% Data Makes Segment Anything Slim
por: Chen, Zigeng, et al.
Publicado: (2023)
por: Chen, Zigeng, et al.
Publicado: (2023)
Q-ARVD: Quantizing Autoregressive Video Diffusion Models
por: Tang, Siao, et al.
Publicado: (2026)
por: Tang, Siao, et al.
Publicado: (2026)
SenCache: Accelerating Diffusion Model Inference via Sensitivity-Aware Caching
por: Haghighi, Yasaman, et al.
Publicado: (2026)
por: Haghighi, Yasaman, et al.
Publicado: (2026)
ConciseHint: Boosting Efficient Reasoning via Continuous Concise Hints during Generation
por: Tang, Siao, et al.
Publicado: (2025)
por: Tang, Siao, et al.
Publicado: (2025)
Introducing Visual Perception Token into Multimodal Large Language Model
por: Yu, Runpeng, et al.
Publicado: (2025)
por: Yu, Runpeng, et al.
Publicado: (2025)
AsyncDiff: Parallelizing Diffusion Models by Asynchronous Denoising
por: Chen, Zigeng, et al.
Publicado: (2024)
por: Chen, Zigeng, et al.
Publicado: (2024)
dKV-Cache: The Cache for Diffusion Language Models
por: Ma, Xinyin, et al.
Publicado: (2025)
por: Ma, Xinyin, et al.
Publicado: (2025)
Diversity-Guided MLP Reduction for Efficient Large Vision Transformers
por: Shen, Chengchao, et al.
Publicado: (2025)
por: Shen, Chengchao, et al.
Publicado: (2025)
Rethinking Token-wise Feature Caching: Accelerating Diffusion Transformers with Dual Feature Caching
por: Zou, Chang, et al.
Publicado: (2024)
por: Zou, Chang, et al.
Publicado: (2024)
Accelerating Diffusion Transformers with Token-wise Feature Caching
por: Zou, Chang, et al.
Publicado: (2024)
por: Zou, Chang, et al.
Publicado: (2024)
SpeCa: Accelerating Diffusion Transformers with Speculative Feature Caching
por: Liu, Jiacheng, et al.
Publicado: (2025)
por: Liu, Jiacheng, et al.
Publicado: (2025)
FEB-Cache: Frequency-Guided Exposure Bias Reduction for Enhancing Diffusion Transformer Caching
por: Zou, Zhen, et al.
Publicado: (2025)
por: Zou, Zhen, et al.
Publicado: (2025)
Accelerating Diffusion Transformer via Increment-Calibrated Caching with Channel-Aware Singular Value Decomposition
por: Chen, Zhiyuan, et al.
Publicado: (2025)
por: Chen, Zhiyuan, et al.
Publicado: (2025)
Token Pruning for Caching Better: 9 Times Acceleration on Stable Diffusion for Free
por: Zhang, Evelyn, et al.
Publicado: (2024)
por: Zhang, Evelyn, et al.
Publicado: (2024)
FreqCa: Accelerating Diffusion Models via Frequency-Aware Caching
por: Liu, Jiacheng, et al.
Publicado: (2025)
por: Liu, Jiacheng, et al.
Publicado: (2025)
LightCache: Memory-Efficient, Training-Free Acceleration for Video Generation
por: Xiao, Yang, et al.
Publicado: (2025)
por: Xiao, Yang, et al.
Publicado: (2025)
Adaptive Hybrid Caching for Efficient Text-to-Video Diffusion Model Acceleration
por: Wei, Yuanxin, et al.
Publicado: (2025)
por: Wei, Yuanxin, et al.
Publicado: (2025)
FastCache: Fast Caching for Diffusion Transformer Through Learnable Linear Approximation
por: Liu, Dong, et al.
Publicado: (2025)
por: Liu, Dong, et al.
Publicado: (2025)
OmniCache: A Trajectory-Oriented Global Perspective on Training-Free Cache Reuse for Diffusion Transformer Models
por: Chu, Huanpeng, et al.
Publicado: (2025)
por: Chu, Huanpeng, et al.
Publicado: (2025)
Accelerating Diffusion Transformer via Gradient-Optimized Cache
por: Qiu, Junxiang, et al.
Publicado: (2025)
por: Qiu, Junxiang, et al.
Publicado: (2025)
Accelerating Diffusion Transformer via Error-Optimized Cache
por: Qiu, Junxiang, et al.
Publicado: (2025)
por: Qiu, Junxiang, et al.
Publicado: (2025)
WorldCache: Content-Aware Caching for Accelerated Video World Models
por: Nawaz, Umair, et al.
Publicado: (2026)
por: Nawaz, Umair, et al.
Publicado: (2026)
Dimple: Discrete Diffusion Multimodal Large Language Model with Parallel Decoding
por: Yu, Runpeng, et al.
Publicado: (2025)
por: Yu, Runpeng, et al.
Publicado: (2025)
VLA-Cache: Efficient Vision-Language-Action Manipulation via Adaptive Token Caching
por: Xu, Siyu, et al.
Publicado: (2025)
por: Xu, Siyu, et al.
Publicado: (2025)
InvarDiff: Cross-Scale Invariance Caching for Accelerated Diffusion Models
por: Wu, Zihao
Publicado: (2025)
por: Wu, Zihao
Publicado: (2025)
ProCache: Constraint-Aware Feature Caching with Selective Computation for Diffusion Transformer Acceleration
por: Cao, Fanpu, et al.
Publicado: (2025)
por: Cao, Fanpu, et al.
Publicado: (2025)
MeanCache: From Instantaneous to Average Velocity for Accelerating Flow Matching Inference
por: Gao, Huanlin, et al.
Publicado: (2026)
por: Gao, Huanlin, et al.
Publicado: (2026)
DreamCache: Finetuning-Free Lightweight Personalized Image Generation via Feature Caching
por: Aiello, Emanuele, et al.
Publicado: (2024)
por: Aiello, Emanuele, et al.
Publicado: (2024)
FORA: Fast-Forward Caching in Diffusion Transformer Acceleration
por: Selvaraju, Pratheba, et al.
Publicado: (2024)
por: Selvaraju, Pratheba, et al.
Publicado: (2024)
A Survey on Cache Methods in Diffusion Models: Toward Efficient Multi-Modal Generation
por: Liu, Jiacheng, et al.
Publicado: (2025)
por: Liu, Jiacheng, et al.
Publicado: (2025)
One-shot Federated Learning via Synthetic Distiller-Distillate Communication
por: Zhang, Junyuan, et al.
Publicado: (2024)
por: Zhang, Junyuan, et al.
Publicado: (2024)
SeaCache: Spectral-Evolution-Aware Cache for Accelerating Diffusion Models
por: Chung, Jiwoo, et al.
Publicado: (2026)
por: Chung, Jiwoo, et al.
Publicado: (2026)
Frequency-Aware Error-Bounded Caching for Accelerating Diffusion Transformers
por: Li, Guandong
Publicado: (2026)
por: Li, Guandong
Publicado: (2026)
Ejemplares similares
-
TinyFusion: Diffusion Transformers Learned Shallow
por: Fang, Gongfan, et al.
Publicado: (2024) -
Isomorphic Pruning for Vision Models
por: Fang, Gongfan, et al.
Publicado: (2024) -
Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising
por: Fang, Gongfan, et al.
Publicado: (2024) -
Token Caching for Diffusion Transformer Acceleration
por: Lou, Jinming, et al.
Publicado: (2024) -
In-Video Instructions: Visual Signals as Generative Control
por: Fang, Gongfan, et al.
Publicado: (2025)