Mobile Video Diffusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Yahia, Haitam Ben, Korzhenkov, Denis, Lelekas, Ioannis, Ghodrati, Amir, Habibian, Amirhossein |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MoViE: Mobile Diffusion for Video Editing
di: Karjauv, Adil, et al.
Pubblicazione: (2024)
di: Karjauv, Adil, et al.
Pubblicazione: (2024)
Attention Surgery: An Efficient Recipe to Linearize Your Video Diffusion Transformer
di: Ghafoorian, Mohsen, et al.
Pubblicazione: (2025)
di: Ghafoorian, Mohsen, et al.
Pubblicazione: (2025)
Neodragon: Mobile Video Generation using Diffusion Transformer
di: Karnewar, Animesh, et al.
Pubblicazione: (2025)
di: Karnewar, Animesh, et al.
Pubblicazione: (2025)
MoAlign: Motion-Centric Representation Alignment for Video Diffusion Models
di: Bhowmik, Aritra, et al.
Pubblicazione: (2025)
di: Bhowmik, Aritra, et al.
Pubblicazione: (2025)
PyramidalWan: On Making Pretrained Video Model Pyramidal for Efficient Inference
di: Korzhenkov, Denis, et al.
Pubblicazione: (2026)
di: Korzhenkov, Denis, et al.
Pubblicazione: (2026)
ReHyAt: Recurrent Hybrid Attention for Video Diffusion Transformers
di: Ghafoorian, Mohsen, et al.
Pubblicazione: (2026)
di: Ghafoorian, Mohsen, et al.
Pubblicazione: (2026)
Gated Relational Alignment via Confidence-based Distillation for Efficient VLMs
di: Chen, Yanlong, et al.
Pubblicazione: (2026)
di: Chen, Yanlong, et al.
Pubblicazione: (2026)
Clockwork Diffusion: Efficient Generation With Model-Step Distillation
di: Habibian, Amirhossein, et al.
Pubblicazione: (2023)
di: Habibian, Amirhossein, et al.
Pubblicazione: (2023)
Enhancing Novel View Synthesis via Geometry Grounded Set Diffusion
di: Zanjani, Farhad G., et al.
Pubblicazione: (2026)
di: Zanjani, Farhad G., et al.
Pubblicazione: (2026)
Multi-Scale Local Speculative Decoding for Image Generation
di: Peruzzo, Elia, et al.
Pubblicazione: (2026)
di: Peruzzo, Elia, et al.
Pubblicazione: (2026)
FashionSD-X: Multimodal Fashion Garment Synthesis using Latent Diffusion
di: Singh, Abhishek Kumar, et al.
Pubblicazione: (2024)
di: Singh, Abhishek Kumar, et al.
Pubblicazione: (2024)
Fast Autoregressive Video Diffusion and World Models with Temporal Cache Compression and Sparse Attention
di: Samuel, Dvir, et al.
Pubblicazione: (2026)
di: Samuel, Dvir, et al.
Pubblicazione: (2026)
DiffusionAct: Controllable Diffusion Autoencoder for One-shot Face Reenactment
di: Bounareli, Stella, et al.
Pubblicazione: (2024)
di: Bounareli, Stella, et al.
Pubblicazione: (2024)
Object-Centric Diffusion for Efficient Video Editing
di: Kahatapitiya, Kumara, et al.
Pubblicazione: (2024)
di: Kahatapitiya, Kumara, et al.
Pubblicazione: (2024)
Controllable 3D Placement of Objects with Scene-Aware Diffusion Models
di: Omran, Mohamed, et al.
Pubblicazione: (2025)
di: Omran, Mohamed, et al.
Pubblicazione: (2025)
VidVec: Unlocking Video MLLM Embeddings for Video-Text Retrieval
di: Tzachor, Issar, et al.
Pubblicazione: (2026)
di: Tzachor, Issar, et al.
Pubblicazione: (2026)
Diffusion Models as Data Mining Tools
di: Siglidis, Ioannis, et al.
Pubblicazione: (2024)
di: Siglidis, Ioannis, et al.
Pubblicazione: (2024)
GVD: Guiding Video Diffusion Model for Scalable Video Distillation
di: Li, Kunyang, et al.
Pubblicazione: (2025)
di: Li, Kunyang, et al.
Pubblicazione: (2025)
Efficient Video Diffusion with Sparse Information Transmission for Video Compression
di: Zhou, Mingde, et al.
Pubblicazione: (2026)
di: Zhou, Mingde, et al.
Pubblicazione: (2026)
ReWind: Understanding Long Videos with Instructed Learnable Memory
di: Diko, Anxhelo, et al.
Pubblicazione: (2024)
di: Diko, Anxhelo, et al.
Pubblicazione: (2024)
Enhancing Video Understanding: Deep Neural Networks for Spatiotemporal Analysis
di: Fadaei, Amir Hosein, et al.
Pubblicazione: (2025)
di: Fadaei, Amir Hosein, et al.
Pubblicazione: (2025)
Perceptual Evaluation of GANs and Diffusion Models for Generating X-rays
di: Schuit, Gregory, et al.
Pubblicazione: (2025)
di: Schuit, Gregory, et al.
Pubblicazione: (2025)
Erased but Exploitable: Black-box Embedding-Aware Prompting Against Unlearned Text-to-Image Diffusion Models
di: Koma, Arian Komaei, et al.
Pubblicazione: (2026)
di: Koma, Arian Komaei, et al.
Pubblicazione: (2026)
SANA-Video: Efficient Video Generation with Block Linear Diffusion Transformer
di: Chen, Junsong, et al.
Pubblicazione: (2025)
di: Chen, Junsong, et al.
Pubblicazione: (2025)
Any-to-Bokeh: Arbitrary-Subject Video Refocusing with Video Diffusion Model
di: Yang, Yang, et al.
Pubblicazione: (2025)
di: Yang, Yang, et al.
Pubblicazione: (2025)
TrackDiffusion: Tracklet-Conditioned Video Generation via Diffusion Models
di: Li, Pengxiang, et al.
Pubblicazione: (2023)
di: Li, Pengxiang, et al.
Pubblicazione: (2023)
VidCtx: Context-aware Video Question Answering with Image Models
di: Goulas, Andreas, et al.
Pubblicazione: (2024)
di: Goulas, Andreas, et al.
Pubblicazione: (2024)
Re-Attentional Controllable Video Diffusion Editing
di: Wang, Yuanzhi, et al.
Pubblicazione: (2024)
di: Wang, Yuanzhi, et al.
Pubblicazione: (2024)
DIVD: Deblurring with Improved Video Diffusion Model
di: Long, Haoyang, et al.
Pubblicazione: (2024)
di: Long, Haoyang, et al.
Pubblicazione: (2024)
Enabling Versatile Controls for Video Diffusion Models
di: Zhang, Xu, et al.
Pubblicazione: (2025)
di: Zhang, Xu, et al.
Pubblicazione: (2025)
Video-GPT via Next Clip Diffusion
di: Zhuang, Shaobin, et al.
Pubblicazione: (2025)
di: Zhuang, Shaobin, et al.
Pubblicazione: (2025)
Memory-Efficient Continual Learning Object Segmentation for Long Video
di: Nazemi, Amir, et al.
Pubblicazione: (2023)
di: Nazemi, Amir, et al.
Pubblicazione: (2023)
MAVIN: Multi-Action Video Generation with Diffusion Models via Transition Video Infilling
di: Zhang, Bowen, et al.
Pubblicazione: (2024)
di: Zhang, Bowen, et al.
Pubblicazione: (2024)
Magic-Me: Identity-Specific Video Customized Diffusion
di: Ma, Ze, et al.
Pubblicazione: (2024)
di: Ma, Ze, et al.
Pubblicazione: (2024)
Boosting Camera Motion Control for Video Diffusion Transformers
di: Cheong, Soon Yau, et al.
Pubblicazione: (2024)
di: Cheong, Soon Yau, et al.
Pubblicazione: (2024)
QVD: Post-training Quantization for Video Diffusion Models
di: Tian, Shilong, et al.
Pubblicazione: (2024)
di: Tian, Shilong, et al.
Pubblicazione: (2024)
Causally Steered Diffusion for Automated Video Counterfactual Generation
di: Spyrou, Nikos, et al.
Pubblicazione: (2025)
di: Spyrou, Nikos, et al.
Pubblicazione: (2025)
VMonarch: Efficient Video Diffusion Transformers with Structured Attention
di: Liang, Cheng, et al.
Pubblicazione: (2026)
di: Liang, Cheng, et al.
Pubblicazione: (2026)
Adapting VACE for Real-Time Autoregressive Video Diffusion
di: Fosdick, Ryan
Pubblicazione: (2026)
di: Fosdick, Ryan
Pubblicazione: (2026)
Latent-Compressed Variational Autoencoder for Video Diffusion Models
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
Documenti analoghi
-
MoViE: Mobile Diffusion for Video Editing
di: Karjauv, Adil, et al.
Pubblicazione: (2024) -
Attention Surgery: An Efficient Recipe to Linearize Your Video Diffusion Transformer
di: Ghafoorian, Mohsen, et al.
Pubblicazione: (2025) -
Neodragon: Mobile Video Generation using Diffusion Transformer
di: Karnewar, Animesh, et al.
Pubblicazione: (2025) -
MoAlign: Motion-Centric Representation Alignment for Video Diffusion Models
di: Bhowmik, Aritra, et al.
Pubblicazione: (2025) -
PyramidalWan: On Making Pretrained Video Model Pyramidal for Efficient Inference
di: Korzhenkov, Denis, et al.
Pubblicazione: (2026)