Efficient Video Diffusion with Sparse Information Transmission for Video Compression
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhou, Mingde, Chen, Zheng, Zhang, Yulun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DC-VideoGen: Efficient Video Generation with Deep Compression Video Autoencoder
di: Chen, Junyu, et al.
Pubblicazione: (2025)
di: Chen, Junyu, et al.
Pubblicazione: (2025)
Fast Autoregressive Video Diffusion and World Models with Temporal Cache Compression and Sparse Attention
di: Samuel, Dvir, et al.
Pubblicazione: (2026)
di: Samuel, Dvir, et al.
Pubblicazione: (2026)
Contribution-aware Token Compression for Efficient Video Understanding via Reinforcement Learning
di: Ma, Yinchao, et al.
Pubblicazione: (2026)
di: Ma, Yinchao, et al.
Pubblicazione: (2026)
SANA-Video: Efficient Video Generation with Block Linear Diffusion Transformer
di: Chen, Junsong, et al.
Pubblicazione: (2025)
di: Chen, Junsong, et al.
Pubblicazione: (2025)
Steering One-Step Diffusion Model with Fidelity-Rich Decoder for Fast Image Compression
di: Chen, Zheng, et al.
Pubblicazione: (2025)
di: Chen, Zheng, et al.
Pubblicazione: (2025)
StreamingTOM: Streaming Token Compression for Efficient Video Understanding
di: Chen, Xueyi, et al.
Pubblicazione: (2025)
di: Chen, Xueyi, et al.
Pubblicazione: (2025)
Latent-Compressed Variational Autoencoder for Video Diffusion Models
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
HASTE: Training-Free Video Diffusion Acceleration via Head-Wise Adaptive Sparse Attention
di: Zheng, Xuzhe, et al.
Pubblicazione: (2026)
di: Zheng, Xuzhe, et al.
Pubblicazione: (2026)
Conditional Video Generation for High-Efficiency Video Compression
di: Yi, Fangqiu, et al.
Pubblicazione: (2025)
di: Yi, Fangqiu, et al.
Pubblicazione: (2025)
Low-Bitrate Video Compression through Semantic-Conditioned Diffusion
di: Wang, Lingdong, et al.
Pubblicazione: (2025)
di: Wang, Lingdong, et al.
Pubblicazione: (2025)
VMonarch: Efficient Video Diffusion Transformers with Structured Attention
di: Liang, Cheng, et al.
Pubblicazione: (2026)
di: Liang, Cheng, et al.
Pubblicazione: (2026)
Task-Aware KV Compression For Cost-Effective Long Video Understanding
di: Qin, Minghao, et al.
Pubblicazione: (2025)
di: Qin, Minghao, et al.
Pubblicazione: (2025)
Motion Guided Token Compression for Efficient Masked Video Modeling
di: Feng, Yukun, et al.
Pubblicazione: (2024)
di: Feng, Yukun, et al.
Pubblicazione: (2024)
Fast and Memory-Efficient Video Diffusion Using Streamlined Inference
di: Zhan, Zheng, et al.
Pubblicazione: (2024)
di: Zhan, Zheng, et al.
Pubblicazione: (2024)
Any-to-Bokeh: Arbitrary-Subject Video Refocusing with Video Diffusion Model
di: Yang, Yang, et al.
Pubblicazione: (2025)
di: Yang, Yang, et al.
Pubblicazione: (2025)
Accurate and Fast Compressed Video Captioning
di: Shen, Yaojie, et al.
Pubblicazione: (2023)
di: Shen, Yaojie, et al.
Pubblicazione: (2023)
Enabling Versatile Controls for Video Diffusion Models
di: Zhang, Xu, et al.
Pubblicazione: (2025)
di: Zhang, Xu, et al.
Pubblicazione: (2025)
UAR-NVC: A Unified AutoRegressive Framework for Memory-Efficient Neural Video Compression
di: Wang, Jia, et al.
Pubblicazione: (2025)
di: Wang, Jia, et al.
Pubblicazione: (2025)
xGen-VideoSyn-1: High-fidelity Text-to-Video Synthesis with Compressed Representations
di: Qin, Can, et al.
Pubblicazione: (2024)
di: Qin, Can, et al.
Pubblicazione: (2024)
Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers
di: Chen, Pengtao, et al.
Pubblicazione: (2025)
di: Chen, Pengtao, et al.
Pubblicazione: (2025)
Focused Forcing: Content-Aware Per-Frame KV Selection for Efficient Autoregressive Video Diffusion
di: Cai, Peiliang, et al.
Pubblicazione: (2026)
di: Cai, Peiliang, et al.
Pubblicazione: (2026)
InfoTok: Adaptive Discrete Video Tokenizer via Information-Theoretic Compression
di: Ye, Haotian, et al.
Pubblicazione: (2025)
di: Ye, Haotian, et al.
Pubblicazione: (2025)
LRConv-NeRV: Low Rank Convolution for Efficient Neural Video Compression
di: Shanableh, Tamer
Pubblicazione: (2026)
di: Shanableh, Tamer
Pubblicazione: (2026)
Label-Efficient Data Augmentation with Video Diffusion Models for Guidewire Segmentation in Cardiac Fluoroscopy
di: Pan, Shaoyan, et al.
Pubblicazione: (2024)
di: Pan, Shaoyan, et al.
Pubblicazione: (2024)
PISCO: Precise Video Instance Insertion with Sparse Control
di: Gao, Xiangbo, et al.
Pubblicazione: (2026)
di: Gao, Xiangbo, et al.
Pubblicazione: (2026)
SSM Meets Video Diffusion Models: Efficient Long-Term Video Generation with Structured State Spaces
di: Oshima, Yuta, et al.
Pubblicazione: (2024)
di: Oshima, Yuta, et al.
Pubblicazione: (2024)
SViTT-Ego: A Sparse Video-Text Transformer for Egocentric Video
di: Valdez, Hector A., et al.
Pubblicazione: (2024)
di: Valdez, Hector A., et al.
Pubblicazione: (2024)
Temporal Aware Pruning for Efficient Diffusion-based Video Generation
di: Li, Sheng, et al.
Pubblicazione: (2026)
di: Li, Sheng, et al.
Pubblicazione: (2026)
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)
di: Liu, Runtao, et al.
Pubblicazione: (2024)
MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model
di: Niu, Muyao, et al.
Pubblicazione: (2024)
di: Niu, Muyao, et al.
Pubblicazione: (2024)
Mobile Video Diffusion
di: Yahia, Haitam Ben, et al.
Pubblicazione: (2024)
di: Yahia, Haitam Ben, et al.
Pubblicazione: (2024)
ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
VideoEraser: Concept Erasure in Text-to-Video Diffusion Models
di: Xu, Naen, et al.
Pubblicazione: (2025)
di: Xu, Naen, et al.
Pubblicazione: (2025)
STANCE: Motion Coherent Video Generation Via Sparse-to-Dense Anchored Encoding
di: Chen, Zhifei, et al.
Pubblicazione: (2025)
di: Chen, Zhifei, et al.
Pubblicazione: (2025)
TrackDiffusion: Tracklet-Conditioned Video Generation via Diffusion Models
di: Li, Pengxiang, et al.
Pubblicazione: (2023)
di: Li, Pengxiang, et al.
Pubblicazione: (2023)
S2DM: Sector-Shaped Diffusion Models for Video Generation
di: Lang, Haoran, et al.
Pubblicazione: (2024)
di: Lang, Haoran, et al.
Pubblicazione: (2024)
Video-GPT via Next Clip Diffusion
di: Zhuang, Shaobin, et al.
Pubblicazione: (2025)
di: Zhuang, Shaobin, et al.
Pubblicazione: (2025)
M-LLM Based Video Frame Selection for Efficient Video Understanding
di: Hu, Kai, et al.
Pubblicazione: (2025)
di: Hu, Kai, et al.
Pubblicazione: (2025)
FADE: Frequency-Aware Diffusion Model Factorization for Video Editing
di: Zhu, Yixuan, et al.
Pubblicazione: (2025)
di: Zhu, Yixuan, et al.
Pubblicazione: (2025)
SNED: Superposition Network Architecture Search for Efficient Video Diffusion Model
di: Li, Zhengang, et al.
Pubblicazione: (2024)
di: Li, Zhengang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DC-VideoGen: Efficient Video Generation with Deep Compression Video Autoencoder
di: Chen, Junyu, et al.
Pubblicazione: (2025) -
Fast Autoregressive Video Diffusion and World Models with Temporal Cache Compression and Sparse Attention
di: Samuel, Dvir, et al.
Pubblicazione: (2026) -
Contribution-aware Token Compression for Efficient Video Understanding via Reinforcement Learning
di: Ma, Yinchao, et al.
Pubblicazione: (2026) -
SANA-Video: Efficient Video Generation with Block Linear Diffusion Transformer
di: Chen, Junsong, et al.
Pubblicazione: (2025) -
Steering One-Step Diffusion Model with Fidelity-Rich Decoder for Fast Image Compression
di: Chen, Zheng, et al.
Pubblicazione: (2025)