VSA: Faster Video Diffusion with Trainable Sparse Attention
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Peiyuan, Chen, Yongqi, Huang, Haofeng, Lin, Will, Liu, Zhengzhong, Stoica, Ion, Xing, Eric, Zhang, Hao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fast Video Generation with Sliding Tile Attention
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025)
Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile
di: Ding, Hangliang, et al.
Pubblicazione: (2025)
di: Ding, Hangliang, et al.
Pubblicazione: (2025)
Bidirectional Sparse Attention for Faster Video Diffusion Training
di: Zhan, Chenlu, et al.
Pubblicazione: (2025)
di: Zhan, Chenlu, et al.
Pubblicazione: (2025)
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
di: Yang, Shuo, et al.
Pubblicazione: (2025)
di: Yang, Shuo, et al.
Pubblicazione: (2025)
Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation
di: Xu, Boxun, et al.
Pubblicazione: (2026)
di: Xu, Boxun, et al.
Pubblicazione: (2026)
Trainable Log-linear Sparse Attention for Efficient Diffusion Transformers
di: Zhou, Yifan, et al.
Pubblicazione: (2025)
di: Zhou, Yifan, et al.
Pubblicazione: (2025)
Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
di: Xi, Haocheng, et al.
Pubblicazione: (2025)
di: Xi, Haocheng, et al.
Pubblicazione: (2025)
XAttention: Block Sparse Attention with Antidiagonal Scoring
di: Xu, Ruyi, et al.
Pubblicazione: (2025)
di: Xu, Ruyi, et al.
Pubblicazione: (2025)
Faster Diffusion via Temporal Attention Decomposition
di: Liu, Haozhe, et al.
Pubblicazione: (2024)
di: Liu, Haozhe, et al.
Pubblicazione: (2024)
Veda: Scalable Video Diffusion via Distilled Sparse Attention
di: Han, Shihao, et al.
Pubblicazione: (2026)
di: Han, Shihao, et al.
Pubblicazione: (2026)
Adaptive Caching for Faster Video Generation with Diffusion Transformers
di: Kahatapitiya, Kumara, et al.
Pubblicazione: (2024)
di: Kahatapitiya, Kumara, et al.
Pubblicazione: (2024)
Radial Attention: $O(n\log n)$ Sparse Attention with Energy Decay for Long Video Generation
di: Li, Xingyang, et al.
Pubblicazione: (2025)
di: Li, Xingyang, et al.
Pubblicazione: (2025)
LVSA: Training-Free Sparse Attention for Long Video Diffusion
di: Glorian, Gael, et al.
Pubblicazione: (2026)
di: Glorian, Gael, et al.
Pubblicazione: (2026)
SVG-EAR: Parameter-Free Linear Compensation for Sparse Video Generation via Error-aware Routing
di: Zhou, Xuanyi, et al.
Pubblicazione: (2026)
di: Zhou, Xuanyi, et al.
Pubblicazione: (2026)
SLA2: Sparse-Linear Attention with Learnable Routing and QAT
di: Zhang, Jintao, et al.
Pubblicazione: (2026)
di: Zhang, Jintao, et al.
Pubblicazione: (2026)
VORTA: Efficient Video Diffusion via Routing Sparse Attention
di: Sun, Wenhao, et al.
Pubblicazione: (2025)
di: Sun, Wenhao, et al.
Pubblicazione: (2025)
OmniSparse: Training-Aware Fine-Grained Sparse Attention for Long-Video MLLMs
di: Chen, Feng, et al.
Pubblicazione: (2025)
di: Chen, Feng, et al.
Pubblicazione: (2025)
Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention
di: Lv, Chengtao, et al.
Pubblicazione: (2026)
di: Lv, Chengtao, et al.
Pubblicazione: (2026)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
SLA: Beyond Sparsity in Diffusion Transformers via Fine-Tunable Sparse-Linear Attention
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
Enhancing Noise Resilience in Face Clustering via Sparse Differential Transformer
di: Zhang, Dafeng, et al.
Pubblicazione: (2025)
di: Zhang, Dafeng, et al.
Pubblicazione: (2025)
TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
SpargeAttention2: Trainable Sparse Attention via Hybrid Top-k+Top-p Masking and Distillation Fine-Tuning
di: Zhang, Jintao, et al.
Pubblicazione: (2026)
di: Zhang, Jintao, et al.
Pubblicazione: (2026)
Mixture of Distributions Matters: Dynamic Sparse Attention for Efficient Video Diffusion Transformers
di: Liu, Yuxi, et al.
Pubblicazione: (2026)
di: Liu, Yuxi, et al.
Pubblicazione: (2026)
SpargeAttention: Accurate and Training-free Sparse Attention Accelerating Any Model Inference
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
di: Zhang, Jintao, et al.
Pubblicazione: (2025)
DynamicRad: Content-Adaptive Sparse Attention for Long Video Diffusion
di: Long, Yongji, et al.
Pubblicazione: (2026)
di: Long, Yongji, et al.
Pubblicazione: (2026)
Efficient Video Diffusion with Sparse Information Transmission for Video Compression
di: Zhou, Mingde, et al.
Pubblicazione: (2026)
di: Zhou, Mingde, et al.
Pubblicazione: (2026)
Diffusion-APO: Trajectory-Aware Direct Preference Alignment for Video Diffusion Transformers
di: Zhu, Jingyuan, et al.
Pubblicazione: (2026)
di: Zhu, Jingyuan, et al.
Pubblicazione: (2026)
LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion
di: Zhao, Zengqun, et al.
Pubblicazione: (2026)
di: Zhao, Zengqun, et al.
Pubblicazione: (2026)
ACD: Direct Conditional Control for Video Diffusion Models via Attention Supervision
di: Li, Weiqi, et al.
Pubblicazione: (2025)
di: Li, Weiqi, et al.
Pubblicazione: (2025)
VecAttention: Vector-wise Sparse Attention for Accelerating Long Context Inference
di: Liu, Anmin, et al.
Pubblicazione: (2026)
di: Liu, Anmin, et al.
Pubblicazione: (2026)
Understanding Attention Mechanism in Video Diffusion Models
di: Liu, Bingyan, et al.
Pubblicazione: (2025)
di: Liu, Bingyan, et al.
Pubblicazione: (2025)
Faster Diffusion Action Segmentation
di: Wang, Shuaibing, et al.
Pubblicazione: (2024)
di: Wang, Shuaibing, et al.
Pubblicazione: (2024)
Neural Video Compression with Domain Transfer
di: Zhang, Tiange, et al.
Pubblicazione: (2026)
di: Zhang, Tiange, et al.
Pubblicazione: (2026)
PISCO: Precise Video Instance Insertion with Sparse Control
di: Gao, Xiangbo, et al.
Pubblicazione: (2026)
di: Gao, Xiangbo, et al.
Pubblicazione: (2026)
Cavia: Camera-controllable Multi-view Video Diffusion with View-Integrated Attention
di: Xu, Dejia, et al.
Pubblicazione: (2024)
di: Xu, Dejia, et al.
Pubblicazione: (2024)
PrimeComposer: Faster Progressively Combined Diffusion for Image Composition with Attention Steering
di: Wang, Yibin, et al.
Pubblicazione: (2024)
di: Wang, Yibin, et al.
Pubblicazione: (2024)
FasterCache: Training-Free Video Diffusion Model Acceleration with High Quality
di: Lv, Zhengyao, et al.
Pubblicazione: (2024)
di: Lv, Zhengyao, et al.
Pubblicazione: (2024)
MAUP: Training-free Multi-center Adaptive Uncertainty-aware Prompting for Cross-domain Few-shot Medical Image Segmentation
di: Zhu, Yazhou, et al.
Pubblicazione: (2025)
di: Zhu, Yazhou, et al.
Pubblicazione: (2025)
Concentrate on Weakness: Mining Hard Prototypes for Few-Shot Medical Image Segmentation
di: Jiang, Jianchao, et al.
Pubblicazione: (2025)
di: Jiang, Jianchao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Fast Video Generation with Sliding Tile Attention
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025) -
Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile
di: Ding, Hangliang, et al.
Pubblicazione: (2025) -
Bidirectional Sparse Attention for Faster Video Diffusion Training
di: Zhan, Chenlu, et al.
Pubblicazione: (2025) -
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
di: Yang, Shuo, et al.
Pubblicazione: (2025) -
Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation
di: Xu, Boxun, et al.
Pubblicazione: (2026)