Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lv, Chengtao, Shi, Yumeng, Huang, Yushi, Gong, Ruihao, Ren, Shen, Wang, Wenya |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation
par: Huang, Yushi, et autres
Publié: (2025)
par: Huang, Yushi, et autres
Publié: (2025)
LLMC+: Benchmarking Vision-Language Model Compression with a Plug-and-play Toolkit
par: Lv, Chengtao, et autres
Publié: (2025)
par: Lv, Chengtao, et autres
Publié: (2025)
QVGen: Pushing the Limit of Quantized Video Generative Models
par: Huang, Yushi, et autres
Publié: (2025)
par: Huang, Yushi, et autres
Publié: (2025)
Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation
par: Xu, Boxun, et autres
Publié: (2026)
par: Xu, Boxun, et autres
Publié: (2026)
Static or Dynamic: Towards Query-Adaptive Token Selection for Video Question Answering
par: Shi, Yumeng, et autres
Publié: (2025)
par: Shi, Yumeng, et autres
Publié: (2025)
HarmoniCa: Harmonizing Training and Inference for Better Feature Caching in Diffusion Transformer Acceleration
par: Huang, Yushi, et autres
Publié: (2024)
par: Huang, Yushi, et autres
Publié: (2024)
Causality Matters: How Temporal Information Emerges in Video Language Models
par: Shi, Yumeng, et autres
Publié: (2025)
par: Shi, Yumeng, et autres
Publié: (2025)
MoDES: Accelerating Mixture-of-Experts Multimodal Large Language Models via Dynamic Expert Skipping
par: Huang, Yushi, et autres
Publié: (2025)
par: Huang, Yushi, et autres
Publié: (2025)
Temporal Feature Matters: A Framework for Diffusion Model Quantization
par: Huang, Yushi, et autres
Publié: (2024)
par: Huang, Yushi, et autres
Publié: (2024)
SGMD: Score Gradient Matching Distillation for Few-Step Video Diffusion Distillation
par: Wu, Zhuguanyu, et autres
Publié: (2026)
par: Wu, Zhuguanyu, et autres
Publié: (2026)
Rolling Forcing: Autoregressive Long Video Diffusion in Real Time
par: Liu, Kunhao, et autres
Publié: (2025)
par: Liu, Kunhao, et autres
Publié: (2025)
TFMQ-DM: Temporal Feature Maintenance Quantization for Diffusion Models
par: Huang, Yushi, et autres
Publié: (2023)
par: Huang, Yushi, et autres
Publié: (2023)
Bidirectional Sparse Attention for Faster Video Diffusion Training
par: Zhan, Chenlu, et autres
Publié: (2025)
par: Zhan, Chenlu, et autres
Publié: (2025)
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
par: Yang, Shuo, et autres
Publié: (2025)
par: Yang, Shuo, et autres
Publié: (2025)
Fast Autoregressive Video Diffusion and World Models with Temporal Cache Compression and Sparse Attention
par: Samuel, Dvir, et autres
Publié: (2026)
par: Samuel, Dvir, et autres
Publié: (2026)
VORTA: Efficient Video Diffusion via Routing Sparse Attention
par: Sun, Wenhao, et autres
Publié: (2025)
par: Sun, Wenhao, et autres
Publié: (2025)
Veda: Scalable Video Diffusion via Distilled Sparse Attention
par: Han, Shihao, et autres
Publié: (2026)
par: Han, Shihao, et autres
Publié: (2026)
VSA: Faster Video Diffusion with Trainable Sparse Attention
par: Zhang, Peiyuan, et autres
Publié: (2025)
par: Zhang, Peiyuan, et autres
Publié: (2025)
Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers
par: Chen, Pengtao, et autres
Publié: (2025)
par: Chen, Pengtao, et autres
Publié: (2025)
Accelerating Text-to-Video Generation with Calibrated Sparse Attention
par: Yehezkel, Shai, et autres
Publié: (2026)
par: Yehezkel, Shai, et autres
Publié: (2026)
Real-Time Motion-Controllable Autoregressive Video Diffusion
par: Zhao, Kesen, et autres
Publié: (2025)
par: Zhao, Kesen, et autres
Publié: (2025)
HASTE: Training-Free Video Diffusion Acceleration via Head-Wise Adaptive Sparse Attention
par: Zheng, Xuzhe, et autres
Publié: (2026)
par: Zheng, Xuzhe, et autres
Publié: (2026)
Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
par: Ji, Yicheng, et autres
Publié: (2026)
par: Ji, Yicheng, et autres
Publié: (2026)
Taming Teacher Forcing for Masked Autoregressive Video Generation
par: Zhou, Deyu, et autres
Publié: (2025)
par: Zhou, Deyu, et autres
Publié: (2025)
Knot Forcing: Taming Autoregressive Video Diffusion Models for Real-time Infinite Interactive Portrait Animation
par: Xiao, Steven, et autres
Publié: (2025)
par: Xiao, Steven, et autres
Publié: (2025)
DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance
par: Shen, Xuan, et autres
Publié: (2025)
par: Shen, Xuan, et autres
Publié: (2025)
MSC: Multi-Scale Spatio-Temporal Causal Attention for Autoregressive Video Diffusion
par: Xu, Xunnong, et autres
Publié: (2024)
par: Xu, Xunnong, et autres
Publié: (2024)
Attend Before Attention: Efficient and Scalable Video Understanding via Autoregressive Gazing
par: Shi, Baifeng, et autres
Publié: (2026)
par: Shi, Baifeng, et autres
Publié: (2026)
Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion
par: Huang, Xun, et autres
Publié: (2025)
par: Huang, Xun, et autres
Publié: (2025)
End-to-End Training for Autoregressive Video Diffusion via Self-Resampling
par: Guo, Yuwei, et autres
Publié: (2025)
par: Guo, Yuwei, et autres
Publié: (2025)
Head Forcing: Long Autoregressive Video Generation via Head Heterogeneity
par: Tian, Jiahao, et autres
Publié: (2026)
par: Tian, Jiahao, et autres
Publié: (2026)
Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation
par: Zhao, Min, et autres
Publié: (2026)
par: Zhao, Min, et autres
Publié: (2026)
Context Forcing: Consistent Autoregressive Video Generation with Long Context
par: Chen, Shuo, et autres
Publié: (2026)
par: Chen, Shuo, et autres
Publié: (2026)
Mutual Forcing: Dual-Mode Self-Evolution for Fast Autoregressive Audio-Video Character Generation
par: Zhou, Yupeng, et autres
Publié: (2026)
par: Zhou, Yupeng, et autres
Publié: (2026)
Efficient Autoregressive Video Diffusion with Dummy Head
par: Guo, Hang, et autres
Publié: (2026)
par: Guo, Hang, et autres
Publié: (2026)
Focused Forcing: Content-Aware Per-Frame KV Selection for Efficient Autoregressive Video Diffusion
par: Cai, Peiliang, et autres
Publié: (2026)
par: Cai, Peiliang, et autres
Publié: (2026)
DynamicRad: Content-Adaptive Sparse Attention for Long Video Diffusion
par: Long, Yongji, et autres
Publié: (2026)
par: Long, Yongji, et autres
Publié: (2026)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
par: Feng, Weilun, et autres
Publié: (2025)
par: Feng, Weilun, et autres
Publié: (2025)
ViD-GPT: Introducing GPT-style Autoregressive Generation in Video Diffusion Models
par: Gao, Kaifeng, et autres
Publié: (2024)
par: Gao, Kaifeng, et autres
Publié: (2024)
Q-ARVD: Quantizing Autoregressive Video Diffusion Models
par: Tang, Siao, et autres
Publié: (2026)
par: Tang, Siao, et autres
Publié: (2026)
Documents similaires
-
LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation
par: Huang, Yushi, et autres
Publié: (2025) -
LLMC+: Benchmarking Vision-Language Model Compression with a Plug-and-play Toolkit
par: Lv, Chengtao, et autres
Publié: (2025) -
QVGen: Pushing the Limit of Quantized Video Generative Models
par: Huang, Yushi, et autres
Publié: (2025) -
Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation
par: Xu, Boxun, et autres
Publié: (2026) -
Static or Dynamic: Towards Query-Adaptive Token Selection for Video Question Answering
par: Shi, Yumeng, et autres
Publié: (2025)