Veda: Scalable Video Diffusion via Distilled Sparse Attention
Fuente:
arXiv
Salvato in:
| Autori principali: | Han, Shihao, Yang, Hao, Hu, Xinting, Mei, Xiaofeng, Jiang, Yi, Qi, Xiaojuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SPEED: Scalable, Precise, and Efficient Concept Erasure for Diffusion Models
di: Li, Ouxiang, et al.
Pubblicazione: (2025)
di: Li, Ouxiang, et al.
Pubblicazione: (2025)
MG-Nav: Dual-Scale Visual Navigation via Sparse Spatial Memory
di: Wang, Bo, et al.
Pubblicazione: (2025)
di: Wang, Bo, et al.
Pubblicazione: (2025)
Bidirectional Sparse Attention for Faster Video Diffusion Training
di: Zhan, Chenlu, et al.
Pubblicazione: (2025)
di: Zhan, Chenlu, et al.
Pubblicazione: (2025)
VSA: Faster Video Diffusion with Trainable Sparse Attention
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025)
VORTA: Efficient Video Diffusion via Routing Sparse Attention
di: Sun, Wenhao, et al.
Pubblicazione: (2025)
di: Sun, Wenhao, et al.
Pubblicazione: (2025)
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
di: Yang, Shuo, et al.
Pubblicazione: (2025)
di: Yang, Shuo, et al.
Pubblicazione: (2025)
Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention
di: Lv, Chengtao, et al.
Pubblicazione: (2026)
di: Lv, Chengtao, et al.
Pubblicazione: (2026)
VideoSSM: Autoregressive Long Video Generation with Hybrid State-Space Memory
di: Yu, Yifei, et al.
Pubblicazione: (2025)
di: Yu, Yifei, et al.
Pubblicazione: (2025)
QDM: Quadtree-Based Region-Adaptive Sparse Diffusion Models for Efficient Image Super-Resolution
di: Yang, Donglin, et al.
Pubblicazione: (2025)
di: Yang, Donglin, et al.
Pubblicazione: (2025)
S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
Mixture of Distributions Matters: Dynamic Sparse Attention for Efficient Video Diffusion Transformers
di: Liu, Yuxi, et al.
Pubblicazione: (2026)
di: Liu, Yuxi, et al.
Pubblicazione: (2026)
Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers
di: Yin, Minghao, et al.
Pubblicazione: (2026)
di: Yin, Minghao, et al.
Pubblicazione: (2026)
Generative Neural Video Compression via Video Diffusion Prior
di: Mao, Qi, et al.
Pubblicazione: (2025)
di: Mao, Qi, et al.
Pubblicazione: (2025)
GVD: Guiding Video Diffusion Model for Scalable Video Distillation
di: Li, Kunyang, et al.
Pubblicazione: (2025)
di: Li, Kunyang, et al.
Pubblicazione: (2025)
Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation
di: Xu, Boxun, et al.
Pubblicazione: (2026)
di: Xu, Boxun, et al.
Pubblicazione: (2026)
Waver: Wave Your Way to Lifelike Video Generation
di: Zhang, Yifu, et al.
Pubblicazione: (2025)
di: Zhang, Yifu, et al.
Pubblicazione: (2025)
DynamicRad: Content-Adaptive Sparse Attention for Long Video Diffusion
di: Long, Yongji, et al.
Pubblicazione: (2026)
di: Long, Yongji, et al.
Pubblicazione: (2026)
FullTransNet: Full Transformer with Local-Global Attention for Video Summarization
di: Lan, Libin, et al.
Pubblicazione: (2025)
di: Lan, Libin, et al.
Pubblicazione: (2025)
Video Editing via Factorized Diffusion Distillation
di: Singer, Uriel, et al.
Pubblicazione: (2024)
di: Singer, Uriel, et al.
Pubblicazione: (2024)
Streaming Autoregressive Video Generation via Diagonal Distillation
di: Liu, Jinxiu, et al.
Pubblicazione: (2026)
di: Liu, Jinxiu, et al.
Pubblicazione: (2026)
UniGeo: Taming Video Diffusion for Unified Consistent Geometry Estimation
di: Sun, Yang-Tian, et al.
Pubblicazione: (2025)
di: Sun, Yang-Tian, et al.
Pubblicazione: (2025)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
Long-Horizon Streaming Video Generation via Hybrid Attention with Decoupled Distillation
di: Li, Ruibin, et al.
Pubblicazione: (2026)
di: Li, Ruibin, et al.
Pubblicazione: (2026)
Data-free Knowledge Distillation with Diffusion Models
di: Qi, Xiaohua, et al.
Pubblicazione: (2025)
di: Qi, Xiaohua, et al.
Pubblicazione: (2025)
Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation
di: Zhao, Min, et al.
Pubblicazione: (2026)
di: Zhao, Min, et al.
Pubblicazione: (2026)
SpargeAttention2: Trainable Sparse Attention via Hybrid Top-k+Top-p Masking and Distillation Fine-Tuning
di: Zhang, Jintao, et al.
Pubblicazione: (2026)
di: Zhang, Jintao, et al.
Pubblicazione: (2026)
BLADE: Block-Sparse Attention Meets Step Distillation for Efficient Video Generation
di: Gu, Youping, et al.
Pubblicazione: (2025)
di: Gu, Youping, et al.
Pubblicazione: (2025)
Attend Before Attention: Efficient and Scalable Video Understanding via Autoregressive Gazing
di: Shi, Baifeng, et al.
Pubblicazione: (2026)
di: Shi, Baifeng, et al.
Pubblicazione: (2026)
Articulated Kinematics Distillation from Video Diffusion Models
di: Li, Xuan, et al.
Pubblicazione: (2025)
di: Li, Xuan, et al.
Pubblicazione: (2025)
Structure From Tracking: Distilling Structure-Preserving Motion for Video Generation
di: Fei, Yang, et al.
Pubblicazione: (2025)
di: Fei, Yang, et al.
Pubblicazione: (2025)
DFSAttn: Dynamic Fine-grained Sparse Attention for Efficient Video Generation
di: Hu, Jie, et al.
Pubblicazione: (2026)
di: Hu, Jie, et al.
Pubblicazione: (2026)
OmniSparse: Training-Aware Fine-Grained Sparse Attention for Long-Video MLLMs
di: Chen, Feng, et al.
Pubblicazione: (2025)
di: Chen, Feng, et al.
Pubblicazione: (2025)
Splatter a Video: Video Gaussian Representation for Versatile Processing
di: Sun, Yang-Tian, et al.
Pubblicazione: (2024)
di: Sun, Yang-Tian, et al.
Pubblicazione: (2024)
Efficient Dataset Distillation via Minimax Diffusion
di: Gu, Jianyang, et al.
Pubblicazione: (2023)
di: Gu, Jianyang, et al.
Pubblicazione: (2023)
Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions
di: Dong, ZiYi, et al.
Pubblicazione: (2025)
di: Dong, ZiYi, et al.
Pubblicazione: (2025)
LVSA: Training-Free Sparse Attention for Long Video Diffusion
di: Glorian, Gael, et al.
Pubblicazione: (2026)
di: Glorian, Gael, et al.
Pubblicazione: (2026)
LIVE: Long-horizon Interactive Video World Modeling
di: Huang, Junchao, et al.
Pubblicazione: (2026)
di: Huang, Junchao, et al.
Pubblicazione: (2026)
ElasticDiT: Efficient Diffusion Transformers via Elastic Architecture and Sparse Attention for High-Resolution Image Generation on Mobile Devices
di: Du, Kunpeng, et al.
Pubblicazione: (2026)
di: Du, Kunpeng, et al.
Pubblicazione: (2026)
X2I: Seamless Integration of Multimodal Understanding into Diffusion Transformer via Attention Distillation
di: Ma, Jian, et al.
Pubblicazione: (2025)
di: Ma, Jian, et al.
Pubblicazione: (2025)
Trainable Log-linear Sparse Attention for Efficient Diffusion Transformers
di: Zhou, Yifan, et al.
Pubblicazione: (2025)
di: Zhou, Yifan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SPEED: Scalable, Precise, and Efficient Concept Erasure for Diffusion Models
di: Li, Ouxiang, et al.
Pubblicazione: (2025) -
MG-Nav: Dual-Scale Visual Navigation via Sparse Spatial Memory
di: Wang, Bo, et al.
Pubblicazione: (2025) -
Bidirectional Sparse Attention for Faster Video Diffusion Training
di: Zhan, Chenlu, et al.
Pubblicazione: (2025) -
VSA: Faster Video Diffusion with Trainable Sparse Attention
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025) -
VORTA: Efficient Video Diffusion via Routing Sparse Attention
di: Sun, Wenhao, et al.
Pubblicazione: (2025)