WorldCache: Accelerating World Models for Free via Heterogeneous Token Caching
Fuente:
arXiv
Salvato in:
| Autori principali: | Feng, Weilun, Fan, Guoxin, Qin, Haotong, Wu, Mingqiang, Li, Yuqi, Li, Xiangqi, An, Zhulin, Huang, Libo, Wang, Dingrui, Liao, Longlong, Magno, Michele, Xu, Yongjun, Yang, Chuanguang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
Quantized Visual Geometry Grounded Transformer
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
WorldCache: Content-Aware Caching for Accelerated Video World Models
di: Nawaz, Umair, et al.
Pubblicazione: (2026)
di: Nawaz, Umair, et al.
Pubblicazione: (2026)
Echo-Forcing: A Scene Memory Framework for Interactive Long Video Generation
di: Wu, Mingqiang, et al.
Pubblicazione: (2026)
di: Wu, Mingqiang, et al.
Pubblicazione: (2026)
Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
di: Feng, Weilun, et al.
Pubblicazione: (2024)
di: Feng, Weilun, et al.
Pubblicazione: (2024)
Multi-party Collaborative Attention Control for Image Customization
di: Yang, Han, et al.
Pubblicazione: (2025)
di: Yang, Han, et al.
Pubblicazione: (2025)
Relational Diffusion Distillation for Efficient Image Generation
di: Feng, Weilun, et al.
Pubblicazione: (2024)
di: Feng, Weilun, et al.
Pubblicazione: (2024)
Exemplar-Free Class Incremental Learning via Incremental Representation
di: Huang, Libo, et al.
Pubblicazione: (2024)
di: Huang, Libo, et al.
Pubblicazione: (2024)
SRKD: Towards Efficient 3D Point Cloud Segmentation via Structure- and Relation-aware Knowledge Distillation
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
Online Policy Distillation with Decision-Attention
di: Yu, Xinqiang, et al.
Pubblicazione: (2024)
di: Yu, Xinqiang, et al.
Pubblicazione: (2024)
Teacher-Guided Student Self-Knowledge Distillation Using Diffusion Model
di: Wang, Yu, et al.
Pubblicazione: (2026)
di: Wang, Yu, et al.
Pubblicazione: (2026)
Token Caching for Diffusion Transformer Acceleration
di: Lou, Jinming, et al.
Pubblicazione: (2024)
di: Lou, Jinming, et al.
Pubblicazione: (2024)
Efficient Continual Learning through Frequency Decomposition and Integration
di: Liu, Ruiqi, et al.
Pubblicazione: (2025)
di: Liu, Ruiqi, et al.
Pubblicazione: (2025)
Multi-Teacher Knowledge Distillation with Reinforcement Learning for Visual Recognition
di: Yang, Chuanguang, et al.
Pubblicazione: (2025)
di: Yang, Chuanguang, et al.
Pubblicazione: (2025)
Q&C: When Quantization Meets Cache in Efficient Image Generation
di: Ding, Xin, et al.
Pubblicazione: (2025)
di: Ding, Xin, et al.
Pubblicazione: (2025)
Parameterized Prompt for Incremental Object Detection
di: An, Zijia, et al.
Pubblicazione: (2025)
di: An, Zijia, et al.
Pubblicazione: (2025)
Frequency-Aligned Knowledge Distillation for Lightweight Spatiotemporal Forecasting
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
CLIP-KD: An Empirical Study of CLIP Model Distillation
di: Yang, Chuanguang, et al.
Pubblicazione: (2023)
di: Yang, Chuanguang, et al.
Pubblicazione: (2023)
PrePrompt: Predictive prompting for class incremental learning
di: Huang, Libo, et al.
Pubblicazione: (2025)
di: Huang, Libo, et al.
Pubblicazione: (2025)
GraphKV: Breaking the Static Selection Paradigm with Graph-Based KV Cache Eviction
di: Li, Xuelin, et al.
Pubblicazione: (2025)
di: Li, Xuelin, et al.
Pubblicazione: (2025)
FreqCache: Accelerating Embodied VLN Models with Adaptive Frequency-Guided Token Caching
di: Zheng, Zihao, et al.
Pubblicazione: (2026)
di: Zheng, Zihao, et al.
Pubblicazione: (2026)
Rethinking Token-wise Feature Caching: Accelerating Diffusion Transformers with Dual Feature Caching
di: Zou, Chang, et al.
Pubblicazione: (2024)
di: Zou, Chang, et al.
Pubblicazione: (2024)
Token Pruning for Caching Better: 9 Times Acceleration on Stable Diffusion for Free
di: Zhang, Evelyn, et al.
Pubblicazione: (2024)
di: Zhang, Evelyn, et al.
Pubblicazione: (2024)
Event-Priori-Based Vision-Language Model for Efficient Visual Understanding
di: Qin, Haotong, et al.
Pubblicazione: (2025)
di: Qin, Haotong, et al.
Pubblicazione: (2025)
Accelerating Diffusion Transformers with Token-wise Feature Caching
di: Zou, Chang, et al.
Pubblicazione: (2024)
di: Zou, Chang, et al.
Pubblicazione: (2024)
MultiAnimate: Pose-Guided Image Animation Made Extensible
di: Hu, Yingcheng, et al.
Pubblicazione: (2026)
di: Hu, Yingcheng, et al.
Pubblicazione: (2026)
PackCache: A Training-Free Acceleration Method for Unified Autoregressive Video Generation via Compact KV-Cache
di: Li, Kunyang, et al.
Pubblicazione: (2026)
di: Li, Kunyang, et al.
Pubblicazione: (2026)
Efficient Unified Caching for Accelerating Heterogeneous AI Workloads
di: Wang, Tianze, et al.
Pubblicazione: (2025)
di: Wang, Tianze, et al.
Pubblicazione: (2025)
Not All Tokens Are Worth Caching: Learning Semantic-Aware Eviction for LLM Prefix Caches
di: Fang, Shaoke, et al.
Pubblicazione: (2026)
di: Fang, Shaoke, et al.
Pubblicazione: (2026)
No Cache Left Idle: Accelerating diffusion model via Extreme-slimming Caching
di: Wen, Tingyan, et al.
Pubblicazione: (2025)
di: Wen, Tingyan, et al.
Pubblicazione: (2025)
X-Cache: Cross-Chunk Block Caching for Few-Step Autoregressive World Models Inference
di: Zeng, Yixiao, et al.
Pubblicazione: (2026)
di: Zeng, Yixiao, et al.
Pubblicazione: (2026)
HiCache: A Plug-in Scaled-Hermite Upgrade for Taylor-Style Cache-then-Forecast Diffusion Acceleration
di: Feng, Liang, et al.
Pubblicazione: (2025)
di: Feng, Liang, et al.
Pubblicazione: (2025)
AB-Cache: Training-Free Acceleration of Diffusion Models via Adams-Bashforth Cached Feature Reuse
di: Yu, Zichao, et al.
Pubblicazione: (2025)
di: Yu, Zichao, et al.
Pubblicazione: (2025)
Learning to Accelerate Vision-Language-Action Models through Adaptive Visual Token Caching
di: Wei, Yujie, et al.
Pubblicazione: (2026)
di: Wei, Yujie, et al.
Pubblicazione: (2026)
VLN-Cache: Enabling Token Caching for VLN Models with Visual/Semantic Dynamics Awareness
di: Zheng, Zihao, et al.
Pubblicazione: (2026)
di: Zheng, Zihao, et al.
Pubblicazione: (2026)
ReasonCache: Accelerating Large Reasoning Model Serving through KV Cache Sharing
di: Chen, Kaiwen, et al.
Pubblicazione: (2025)
di: Chen, Kaiwen, et al.
Pubblicazione: (2025)
LightCache: Memory-Efficient, Training-Free Acceleration for Video Generation
di: Xiao, Yang, et al.
Pubblicazione: (2025)
di: Xiao, Yang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
di: Feng, Weilun, et al.
Pubblicazione: (2025) -
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
di: Feng, Weilun, et al.
Pubblicazione: (2025) -
Quantized Visual Geometry Grounded Transformer
di: Feng, Weilun, et al.
Pubblicazione: (2025) -
WorldCache: Content-Aware Caching for Accelerated Video World Models
di: Nawaz, Umair, et al.
Pubblicazione: (2026) -
Echo-Forcing: A Scene Memory Framework for Interactive Long Video Generation
di: Wu, Mingqiang, et al.
Pubblicazione: (2026)