Fast Video Generation with Sliding Tile Attention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Peiyuan, Chen, Yongqi, Su, Runlong, Ding, Hangliang, Stoica, Ion, Liu, Zhengzhong, Zhang, Hao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile
par: Ding, Hangliang, et autres
Publié: (2025)
par: Ding, Hangliang, et autres
Publié: (2025)
VSA: Faster Video Diffusion with Trainable Sparse Attention
par: Zhang, Peiyuan, et autres
Publié: (2025)
par: Zhang, Peiyuan, et autres
Publié: (2025)
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
par: Yang, Shuo, et autres
Publié: (2025)
par: Yang, Shuo, et autres
Publié: (2025)
TICON: A Slide-Level Tile Contextualizer for Histopathology Representation Learning
par: Belagali, Varun, et autres
Publié: (2025)
par: Belagali, Varun, et autres
Publié: (2025)
UltraGen: High-Resolution Video Generation with Hierarchical Attention
par: Hu, Teng, et autres
Publié: (2025)
par: Hu, Teng, et autres
Publié: (2025)
SVG-EAR: Parameter-Free Linear Compensation for Sparse Video Generation via Error-aware Routing
par: Zhou, Xuanyi, et autres
Publié: (2026)
par: Zhou, Xuanyi, et autres
Publié: (2026)
FreeSwim: Revisiting Sliding-Window Attention Mechanisms for Training-Free Ultra-High-Resolution Video Generation
par: Wu, Yunfeng, et autres
Publié: (2025)
par: Wu, Yunfeng, et autres
Publié: (2025)
MonarchRT: Efficient Attention for Real-Time Video Generation
par: Agarwal, Krish, et autres
Publié: (2026)
par: Agarwal, Krish, et autres
Publié: (2026)
Radial Attention: $O(n\log n)$ Sparse Attention with Energy Decay for Long Video Generation
par: Li, Xingyang, et autres
Publié: (2025)
par: Li, Xingyang, et autres
Publié: (2025)
Structure From Tracking: Distilling Structure-Preserving Motion for Video Generation
par: Fei, Yang, et autres
Publié: (2025)
par: Fei, Yang, et autres
Publié: (2025)
SWIFT: Sliding Window Reconstruction for Few-Shot Training-Free Generated Video Attribution
par: Wang, Chao, et autres
Publié: (2026)
par: Wang, Chao, et autres
Publié: (2026)
FastVID: Dynamic Density Pruning for Fast Video Large Language Models
par: Shen, Leqi, et autres
Publié: (2025)
par: Shen, Leqi, et autres
Publié: (2025)
Attention Beats Linear for Fast Implicit Neural Representation Generation
par: Zhang, Shuyi, et autres
Publié: (2024)
par: Zhang, Shuyi, et autres
Publié: (2024)
PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention
par: Chen, Yipeng, et autres
Publié: (2025)
par: Chen, Yipeng, et autres
Publié: (2025)
Compact Attention: Exploiting Structured Spatio-Temporal Sparsity for Fast Video Generation
par: Li, Qirui, et autres
Publié: (2025)
par: Li, Qirui, et autres
Publié: (2025)
FC-VFI: Faithful and Consistent Video Frame Interpolation for High-FPS Slow Motion Video Generation
par: Ding, Ganggui, et autres
Publié: (2026)
par: Ding, Ganggui, et autres
Publié: (2026)
Sliding Window Attention for Learned Video Compression
par: Kopte, Alexander, et autres
Publié: (2025)
par: Kopte, Alexander, et autres
Publié: (2025)
Bidirectional Sparse Attention for Faster Video Diffusion Training
par: Zhan, Chenlu, et autres
Publié: (2025)
par: Zhan, Chenlu, et autres
Publié: (2025)
RedunCut: Measurement-Driven Sampling and Accuracy Performance Modeling for Low-Cost Live Video Analytics
par: Sela, Gur-Eyal, et autres
Publié: (2025)
par: Sela, Gur-Eyal, et autres
Publié: (2025)
Balanced 3DGS: Gaussian-wise Parallelism Rendering with Fine-Grained Tiling
par: Gui, Hao, et autres
Publié: (2024)
par: Gui, Hao, et autres
Publié: (2024)
Attention-Challenging Multiple Instance Learning for Whole Slide Image Classification
par: Zhang, Yunlong, et autres
Publié: (2023)
par: Zhang, Yunlong, et autres
Publié: (2023)
RAPTOR: Real-Time High-Resolution UAV Video Prediction with Efficient Video Attention
par: Chen, Zhan, et autres
Publié: (2025)
par: Chen, Zhan, et autres
Publié: (2025)
DSAGL: Dual-Stream Attention-Guided Learning for Weakly Supervised Whole Slide Image Classification
par: Cao, Daoxi, et autres
Publié: (2025)
par: Cao, Daoxi, et autres
Publié: (2025)
Semantics-Aware Attention Guidance for Diagnosing Whole Slide Images
par: Liu, Kechun, et autres
Publié: (2024)
par: Liu, Kechun, et autres
Publié: (2024)
Mixup Helps Understanding Multimodal Video Better
par: Ma, Xiaoyu, et autres
Publié: (2025)
par: Ma, Xiaoyu, et autres
Publié: (2025)
GPD: Guided Progressive Distillation for Fast and High-Quality Video Generation
par: Liang, Xiao, et autres
Publié: (2026)
par: Liang, Xiao, et autres
Publié: (2026)
Momentum Guidance: Plug-and-Play Guidance for Flow Models
par: Liao, Runlong, et autres
Publié: (2026)
par: Liao, Runlong, et autres
Publié: (2026)
3D4D: An Interactive, Editable, 4D World Model via 3D Video Generation
par: He, Yunhong, et autres
Publié: (2025)
par: He, Yunhong, et autres
Publié: (2025)
SLA2: Sparse-Linear Attention with Learnable Routing and QAT
par: Zhang, Jintao, et autres
Publié: (2026)
par: Zhang, Jintao, et autres
Publié: (2026)
TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times
par: Zhang, Jintao, et autres
Publié: (2025)
par: Zhang, Jintao, et autres
Publié: (2025)
MagCache: Fast Video Generation with Magnitude-Aware Cache
par: Ma, Zehong, et autres
Publié: (2025)
par: Ma, Zehong, et autres
Publié: (2025)
Fast Encoding and Decoding for Implicit Video Representation
par: Chen, Hao, et autres
Publié: (2024)
par: Chen, Hao, et autres
Publié: (2024)
Generating, Fast and Slow: Scalable Parallel Video Generation with Video Interface Networks
par: Dedhia, Bhishma, et autres
Publié: (2025)
par: Dedhia, Bhishma, et autres
Publié: (2025)
Speed by Simplicity: A Single-Stream Architecture for Fast Audio-Video Generative Foundation Model
par: SII-GAIR, et autres
Publié: (2026)
par: SII-GAIR, et autres
Publié: (2026)
Look a Group at Once: Multi-Slide Modeling for Survival Prediction
par: Li, Xinyang, et autres
Publié: (2024)
par: Li, Xinyang, et autres
Publié: (2024)
PSGS: Text-driven Panorama Sliding Scene Generation via Gaussian Splatting
par: Zhang, Xin, et autres
Publié: (2026)
par: Zhang, Xin, et autres
Publié: (2026)
Rectified SpaAttn: Revisiting Attention Sparsity for Efficient Video Generation
par: Liu, Xuewen, et autres
Publié: (2025)
par: Liu, Xuewen, et autres
Publié: (2025)
Enhancing Noise Resilience in Face Clustering via Sparse Differential Transformer
par: Zhang, Dafeng, et autres
Publié: (2025)
par: Zhang, Dafeng, et autres
Publié: (2025)
Rethinking Attention-Based Multiple Instance Learning for Whole-Slide Pathological Image Classification: An Instance Attribute Viewpoint
par: Cai, Linghan, et autres
Publié: (2024)
par: Cai, Linghan, et autres
Publié: (2024)
Towards One-step Causal Video Generation via Adversarial Self-Distillation
par: Yang, Yongqi, et autres
Publié: (2025)
par: Yang, Yongqi, et autres
Publié: (2025)
Documents similaires
-
Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile
par: Ding, Hangliang, et autres
Publié: (2025) -
VSA: Faster Video Diffusion with Trainable Sparse Attention
par: Zhang, Peiyuan, et autres
Publié: (2025) -
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
par: Yang, Shuo, et autres
Publié: (2025) -
TICON: A Slide-Level Tile Contextualizer for Histopathology Representation Learning
par: Belagali, Varun, et autres
Publié: (2025) -
UltraGen: High-Resolution Video Generation with Hierarchical Attention
par: Hu, Teng, et autres
Publié: (2025)