Relational Feature Caching for Accelerating Diffusion Transformers
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Son, Byunggwan, Jeon, Jeimin, Choi, Jeongwoo, Ham, Bumsub |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
AccuQuant: Simulating Multiple Denoising Steps for Quantizing Diffusion Models
von: Lee, Seunghoon, et al.
Veröffentlicht: (2025)
von: Lee, Seunghoon, et al.
Veröffentlicht: (2025)
TAS-LoRA: Transformer Architecture Search with Mixture-of-LoRA Experts
von: Jeon, Jeimin, et al.
Veröffentlicht: (2026)
von: Jeon, Jeimin, et al.
Veröffentlicht: (2026)
GrowTAS: Progressive Expansion from Small to Large Subnets for Efficient ViT Architecture Search
von: Lee, Hyunju, et al.
Veröffentlicht: (2025)
von: Lee, Hyunju, et al.
Veröffentlicht: (2025)
FYI: Flip Your Images for Dataset Distillation
von: Son, Byunggwan, et al.
Veröffentlicht: (2024)
von: Son, Byunggwan, et al.
Veröffentlicht: (2024)
Scheduling Weight Transitions for Quantization-Aware Training
von: Lee, Junghyup, et al.
Veröffentlicht: (2024)
von: Lee, Junghyup, et al.
Veröffentlicht: (2024)
Maximizing the Position Embedding for Vision Transformers with Global Average Pooling
von: Lee, Wonjun, et al.
Veröffentlicht: (2025)
von: Lee, Wonjun, et al.
Veröffentlicht: (2025)
AZ-NAS: Assembling Zero-Cost Proxies for Network Architecture Search
von: Lee, Junghyup, et al.
Veröffentlicht: (2024)
von: Lee, Junghyup, et al.
Veröffentlicht: (2024)
Toward INT4 Fixed-Point Training via Exploring Quantization Error for Gradients
von: Kim, Dohyung, et al.
Veröffentlicht: (2024)
von: Kim, Dohyung, et al.
Veröffentlicht: (2024)
Instance-Aware Group Quantization for Vision Transformers
von: Moon, Jaehyeon, et al.
Veröffentlicht: (2024)
von: Moon, Jaehyeon, et al.
Veröffentlicht: (2024)
Rethinking Token-wise Feature Caching: Accelerating Diffusion Transformers with Dual Feature Caching
von: Zou, Chang, et al.
Veröffentlicht: (2024)
von: Zou, Chang, et al.
Veröffentlicht: (2024)
Token Caching for Diffusion Transformer Acceleration
von: Lou, Jinming, et al.
Veröffentlicht: (2024)
von: Lou, Jinming, et al.
Veröffentlicht: (2024)
Accelerating Diffusion Transformers with Token-wise Feature Caching
von: Zou, Chang, et al.
Veröffentlicht: (2024)
von: Zou, Chang, et al.
Veröffentlicht: (2024)
Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
von: Ma, Xinyin, et al.
Veröffentlicht: (2024)
von: Ma, Xinyin, et al.
Veröffentlicht: (2024)
Subnet-Aware Dynamic Supernet Training for Neural Architecture Search
von: Jeon, Jeimin, et al.
Veröffentlicht: (2025)
von: Jeon, Jeimin, et al.
Veröffentlicht: (2025)
SpeCa: Accelerating Diffusion Transformers with Speculative Feature Caching
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025)
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025)
SenCache: Accelerating Diffusion Model Inference via Sensitivity-Aware Caching
von: Haghighi, Yasaman, et al.
Veröffentlicht: (2026)
von: Haghighi, Yasaman, et al.
Veröffentlicht: (2026)
FEB-Cache: Frequency-Guided Exposure Bias Reduction for Enhancing Diffusion Transformer Caching
von: Zou, Zhen, et al.
Veröffentlicht: (2025)
von: Zou, Zhen, et al.
Veröffentlicht: (2025)
Token Pruning for Caching Better: 9 Times Acceleration on Stable Diffusion for Free
von: Zhang, Evelyn, et al.
Veröffentlicht: (2024)
von: Zhang, Evelyn, et al.
Veröffentlicht: (2024)
Adaptive Hybrid Caching for Efficient Text-to-Video Diffusion Model Acceleration
von: Wei, Yuanxin, et al.
Veröffentlicht: (2025)
von: Wei, Yuanxin, et al.
Veröffentlicht: (2025)
Adaptive Spectral Feature Forecasting for Diffusion Sampling Acceleration
von: Han, Jiaqi, et al.
Veröffentlicht: (2026)
von: Han, Jiaqi, et al.
Veröffentlicht: (2026)
Efficient Few-Shot Neural Architecture Search by Counting the Number of Nonlinear Functions
von: Oh, Youngmin, et al.
Veröffentlicht: (2024)
von: Oh, Youngmin, et al.
Veröffentlicht: (2024)
Accelerating Diffusion Transformer via Increment-Calibrated Caching with Channel-Aware Singular Value Decomposition
von: Chen, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Chen, Zhiyuan, et al.
Veröffentlicht: (2025)
FreqCa: Accelerating Diffusion Models via Frequency-Aware Caching
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025)
von: Liu, Jiacheng, et al.
Veröffentlicht: (2025)
ProCache: Constraint-Aware Feature Caching with Selective Computation for Diffusion Transformer Acceleration
von: Cao, Fanpu, et al.
Veröffentlicht: (2025)
von: Cao, Fanpu, et al.
Veröffentlicht: (2025)
ConceptAttention: Diffusion Transformers Learn Highly Interpretable Features
von: Helbling, Alec, et al.
Veröffentlicht: (2025)
von: Helbling, Alec, et al.
Veröffentlicht: (2025)
LightCache: Memory-Efficient, Training-Free Acceleration for Video Generation
von: Xiao, Yang, et al.
Veröffentlicht: (2025)
von: Xiao, Yang, et al.
Veröffentlicht: (2025)
OmniCache: A Trajectory-Oriented Global Perspective on Training-Free Cache Reuse for Diffusion Transformer Models
von: Chu, Huanpeng, et al.
Veröffentlicht: (2025)
von: Chu, Huanpeng, et al.
Veröffentlicht: (2025)
InvarDiff: Cross-Scale Invariance Caching for Accelerated Diffusion Models
von: Wu, Zihao
Veröffentlicht: (2025)
von: Wu, Zihao
Veröffentlicht: (2025)
Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
von: Xi, Haocheng, et al.
Veröffentlicht: (2025)
von: Xi, Haocheng, et al.
Veröffentlicht: (2025)
Equivariant Latent Alignment via Flow Matching under Group Symmetries
von: Kim, Sunghyun, et al.
Veröffentlicht: (2026)
von: Kim, Sunghyun, et al.
Veröffentlicht: (2026)
FastCache: Fast Caching for Diffusion Transformer Through Learnable Linear Approximation
von: Liu, Dong, et al.
Veröffentlicht: (2025)
von: Liu, Dong, et al.
Veröffentlicht: (2025)
JARViS: Detecting Actions in Video Using Unified Actor-Scene Context Relation Modeling
von: Lee, Seok Hwan, et al.
Veröffentlicht: (2024)
von: Lee, Seok Hwan, et al.
Veröffentlicht: (2024)
Exploring Hierarchical Consistency and Unbiased Objectness for Open-Vocabulary Object Detection
von: Lee, Sanghoon, et al.
Veröffentlicht: (2026)
von: Lee, Sanghoon, et al.
Veröffentlicht: (2026)
3DPillars: Pillar-based two-stage 3D object detection
von: Noh, Jongyoun, et al.
Veröffentlicht: (2025)
von: Noh, Jongyoun, et al.
Veröffentlicht: (2025)
WorldCache: Content-Aware Caching for Accelerated Video World Models
von: Nawaz, Umair, et al.
Veröffentlicht: (2026)
von: Nawaz, Umair, et al.
Veröffentlicht: (2026)
FRED: Towards a Full Rotation-Equivariance in Aerial Image Object Detection
von: Lee, Chanho, et al.
Veröffentlicht: (2023)
von: Lee, Chanho, et al.
Veröffentlicht: (2023)
DreamCache: Finetuning-Free Lightweight Personalized Image Generation via Feature Caching
von: Aiello, Emanuele, et al.
Veröffentlicht: (2024)
von: Aiello, Emanuele, et al.
Veröffentlicht: (2024)
CorGi: Contribution-Guided Block-Wise Interval Caching for Training-Free Acceleration of Diffusion Transformers
von: Son, Yonglak, et al.
Veröffentlicht: (2025)
von: Son, Yonglak, et al.
Veröffentlicht: (2025)
HarmoniCa: Harmonizing Training and Inference for Better Feature Caching in Diffusion Transformer Acceleration
von: Huang, Yushi, et al.
Veröffentlicht: (2024)
von: Huang, Yushi, et al.
Veröffentlicht: (2024)
Warm Starts Accelerate Conditional Diffusion
von: Scholz, Jonas, et al.
Veröffentlicht: (2025)
von: Scholz, Jonas, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
AccuQuant: Simulating Multiple Denoising Steps for Quantizing Diffusion Models
von: Lee, Seunghoon, et al.
Veröffentlicht: (2025) -
TAS-LoRA: Transformer Architecture Search with Mixture-of-LoRA Experts
von: Jeon, Jeimin, et al.
Veröffentlicht: (2026) -
GrowTAS: Progressive Expansion from Small to Large Subnets for Efficient ViT Architecture Search
von: Lee, Hyunju, et al.
Veröffentlicht: (2025) -
FYI: Flip Your Images for Dataset Distillation
von: Son, Byunggwan, et al.
Veröffentlicht: (2024) -
Scheduling Weight Transitions for Quantization-Aware Training
von: Lee, Junghyup, et al.
Veröffentlicht: (2024)