PackCache: A Training-Free Acceleration Method for Unified Autoregressive Video Generation via Compact KV-Cache
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Kunyang, Shah, Mubarak, Shang, Yuzhang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Attend Locally, Remember Linearly: Linear Attention as Cross-Frame Memory for Autoregressive Video Diffusion
von: Li, Kunyang, et al.
Veröffentlicht: (2026)
von: Li, Kunyang, et al.
Veröffentlicht: (2026)
Future Forcing: Future-aware Training-free KV Cache Policy for Autoregressive Video Generation
von: Luo, Jiayi, et al.
Veröffentlicht: (2026)
von: Luo, Jiayi, et al.
Veröffentlicht: (2026)
Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
von: Ji, Yicheng, et al.
Veröffentlicht: (2026)
von: Ji, Yicheng, et al.
Veröffentlicht: (2026)
AMS-KV: Adaptive KV Caching in Multi-Scale Visual Autoregressive Transformers
von: Xu, Boxun, et al.
Veröffentlicht: (2025)
von: Xu, Boxun, et al.
Veröffentlicht: (2025)
Decouple and Cache: KV Cache Construction for Streaming Video Understanding
von: Pang, Zhanzhong, et al.
Veröffentlicht: (2026)
von: Pang, Zhanzhong, et al.
Veröffentlicht: (2026)
LightCache: Memory-Efficient, Training-Free Acceleration for Video Generation
von: Xiao, Yang, et al.
Veröffentlicht: (2025)
von: Xiao, Yang, et al.
Veröffentlicht: (2025)
Past- and Future-Informed KV Cache Policy with Salience Estimation in Autoregressive Video Diffusion
von: Chen, Hanmo, et al.
Veröffentlicht: (2026)
von: Chen, Hanmo, et al.
Veröffentlicht: (2026)
Less is Enough: Training-Free Video Diffusion Acceleration via Runtime-Adaptive Caching
von: Zhou, Xin, et al.
Veröffentlicht: (2025)
von: Zhou, Xin, et al.
Veröffentlicht: (2025)
WorldCache: Accelerating World Models for Free via Heterogeneous Token Caching
von: Feng, Weilun, et al.
Veröffentlicht: (2026)
von: Feng, Weilun, et al.
Veröffentlicht: (2026)
Head-Aware KV Cache Compression for Efficient Visual Autoregressive Modeling
von: Qin, Ziran, et al.
Veröffentlicht: (2025)
von: Qin, Ziran, et al.
Veröffentlicht: (2025)
LazyMAR: Accelerating Masked Autoregressive Models via Feature Caching
von: Yan, Feihong, et al.
Veröffentlicht: (2025)
von: Yan, Feihong, et al.
Veröffentlicht: (2025)
FasterCache: Training-Free Video Diffusion Model Acceleration with High Quality
von: Lv, Zhengyao, et al.
Veröffentlicht: (2024)
von: Lv, Zhengyao, et al.
Veröffentlicht: (2024)
VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion
von: Yesiltepe, Hidir, et al.
Veröffentlicht: (2026)
von: Yesiltepe, Hidir, et al.
Veröffentlicht: (2026)
Streaming Video Question-Answering with In-context Video KV-Cache Retrieval
von: Di, Shangzhe, et al.
Veröffentlicht: (2025)
von: Di, Shangzhe, et al.
Veröffentlicht: (2025)
Motion-Aware Caching for Efficient Autoregressive Video Generation
von: Xu, Jing, et al.
Veröffentlicht: (2026)
von: Xu, Jing, et al.
Veröffentlicht: (2026)
Efficient Long-Horizon GUI Agents via Training-Free KV Cache Compression
von: Zhou, Bowen, et al.
Veröffentlicht: (2026)
von: Zhou, Bowen, et al.
Veröffentlicht: (2026)
TaoCache: Structure-Maintained Video Generation Acceleration
von: Fan, Zhentao, et al.
Veröffentlicht: (2025)
von: Fan, Zhentao, et al.
Veröffentlicht: (2025)
LiveVLM: Efficient Online Video Understanding via Streaming-Oriented KV Cache and Retrieval
von: Ning, Zhenyu, et al.
Veröffentlicht: (2025)
von: Ning, Zhenyu, et al.
Veröffentlicht: (2025)
StreamKV: Streaming Video Question-Answering with Segment-based KV Cache Retrieval and Compression
von: Chen, Yilong, et al.
Veröffentlicht: (2025)
von: Chen, Yilong, et al.
Veröffentlicht: (2025)
TurboRAG: Accelerating Retrieval-Augmented Generation with Precomputed KV Caches for Chunked Text
von: Lu, Songshuo, et al.
Veröffentlicht: (2024)
von: Lu, Songshuo, et al.
Veröffentlicht: (2024)
No Cache Left Idle: Accelerating diffusion model via Extreme-slimming Caching
von: Wen, Tingyan, et al.
Veröffentlicht: (2025)
von: Wen, Tingyan, et al.
Veröffentlicht: (2025)
MagCache: Fast Video Generation with Magnitude-Aware Cache
von: Ma, Zehong, et al.
Veröffentlicht: (2025)
von: Ma, Zehong, et al.
Veröffentlicht: (2025)
Pyramid Forcing: Head-Aware Pyramid KV Cache Policy for High-Quality Long Video Generation
von: Chen, Jiayu, et al.
Veröffentlicht: (2026)
von: Chen, Jiayu, et al.
Veröffentlicht: (2026)
PTQ4DiT: Post-training Quantization for Diffusion Transformers
von: Wu, Junyi, et al.
Veröffentlicht: (2024)
von: Wu, Junyi, et al.
Veröffentlicht: (2024)
PreciseCache: Precise Feature Caching for Efficient and High-fidelity Video Generation
von: Wang, Jiangshan, et al.
Veröffentlicht: (2026)
von: Wang, Jiangshan, et al.
Veröffentlicht: (2026)
Lane2Seq: Towards Unified Lane Detection via Sequence Generation
von: Zhou, Kunyang
Veröffentlicht: (2024)
von: Zhou, Kunyang
Veröffentlicht: (2024)
LightVLM: Acceleraing Large Multimodal Models with Pyramid Token Merging and KV Cache Compression
von: Hu, Lianyu, et al.
Veröffentlicht: (2025)
von: Hu, Lianyu, et al.
Veröffentlicht: (2025)
Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
von: Ma, Xinyin, et al.
Veröffentlicht: (2024)
von: Ma, Xinyin, et al.
Veröffentlicht: (2024)
Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing
von: Gao, Kaifeng, et al.
Veröffentlicht: (2024)
von: Gao, Kaifeng, et al.
Veröffentlicht: (2024)
PrefixKV: Adaptive Prefix KV Cache is What Vision Instruction-Following Models Need for Efficient Generation
von: Wang, Ao, et al.
Veröffentlicht: (2024)
von: Wang, Ao, et al.
Veröffentlicht: (2024)
Robin3D: Improving 3D Large Language Model via Robust Instruction Tuning
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
Accelerating Controllable Generation via Hybrid-grained Cache
von: Liu, Lin, et al.
Veröffentlicht: (2025)
von: Liu, Lin, et al.
Veröffentlicht: (2025)
QuantCache: Adaptive Importance-Guided Quantization with Hierarchical Latent and Layer Caching for Video Generation
von: Wu, Junyi, et al.
Veröffentlicht: (2025)
von: Wu, Junyi, et al.
Veröffentlicht: (2025)
UniCP: A Unified Caching and Pruning Framework for Efficient Video Generation
von: Sun, Wenzhang, et al.
Veröffentlicht: (2025)
von: Sun, Wenzhang, et al.
Veröffentlicht: (2025)
X-Cache: Cross-Chunk Block Caching for Few-Step Autoregressive World Models Inference
von: Zeng, Yixiao, et al.
Veröffentlicht: (2026)
von: Zeng, Yixiao, et al.
Veröffentlicht: (2026)
FilmWeaver: Weaving Consistent Multi-Shot Videos with Cache-Guided Autoregressive Diffusion
von: Luo, Xiangyang, et al.
Veröffentlicht: (2025)
von: Luo, Xiangyang, et al.
Veröffentlicht: (2025)
AccKV: Towards Efficient Audio-Video LLMs Inference via Adaptive-Focusing and Cross-Calibration KV Cache Optimization
von: Jiang, Zhonghua, et al.
Veröffentlicht: (2025)
von: Jiang, Zhonghua, et al.
Veröffentlicht: (2025)
SeaCache: Spectral-Evolution-Aware Cache for Accelerating Diffusion Models
von: Chung, Jiwoo, et al.
Veröffentlicht: (2026)
von: Chung, Jiwoo, et al.
Veröffentlicht: (2026)
Plug-and-Play 1.x-Bit KV Cache Quantization for Video Large Language Models
von: Tao, Keda, et al.
Veröffentlicht: (2025)
von: Tao, Keda, et al.
Veröffentlicht: (2025)
HERMES: KV Cache as Hierarchical Memory for Efficient Streaming Video Understanding
von: Zhang, Haowei, et al.
Veröffentlicht: (2026)
von: Zhang, Haowei, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Attend Locally, Remember Linearly: Linear Attention as Cross-Frame Memory for Autoregressive Video Diffusion
von: Li, Kunyang, et al.
Veröffentlicht: (2026) -
Future Forcing: Future-aware Training-free KV Cache Policy for Autoregressive Video Generation
von: Luo, Jiayi, et al.
Veröffentlicht: (2026) -
Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
von: Ji, Yicheng, et al.
Veröffentlicht: (2026) -
AMS-KV: Adaptive KV Caching in Multi-Scale Visual Autoregressive Transformers
von: Xu, Boxun, et al.
Veröffentlicht: (2025) -
Decouple and Cache: KV Cache Construction for Streaming Video Understanding
von: Pang, Zhanzhong, et al.
Veröffentlicht: (2026)