MotionAura: Generating High-Quality and Motion Consistent Videos using Discrete Diffusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Susladkar, Onkar, Gupta, Jishu Sen, Sehgal, Chirag, Mittal, Sparsh, Singhal, Rekha |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
D2Styler: Advancing Arbitrary Style Transfer with Discrete Diffusion Methods
di: Susladkar, Onkar, et al.
Pubblicazione: (2024)
di: Susladkar, Onkar, et al.
Pubblicazione: (2024)
Dressing the Imagination: A Dataset for AI-Powered Translation of Text into Fashion Outfits and A Novel NeRA Adapter for Enhanced Feature Adaptation
di: Deshmukh, Gayatri, et al.
Pubblicazione: (2024)
di: Deshmukh, Gayatri, et al.
Pubblicazione: (2024)
Historic Scripts to Modern Vision: A Novel Dataset and A VLM Framework for Transliteration of Modi Script to Devanagari
di: Kausadikar, Harshal, et al.
Pubblicazione: (2025)
di: Kausadikar, Harshal, et al.
Pubblicazione: (2025)
L2GNet: Optimal Local-to-Global Representation of Anatomical Structures for Generalized Medical Image Segmentation
di: Gorade, Vandan, et al.
Pubblicazione: (2025)
di: Gorade, Vandan, et al.
Pubblicazione: (2025)
Best of Both Worlds: Multimodal Reasoning and Generation via Unified Discrete Flow Matching
di: Susladkar, Onkar, et al.
Pubblicazione: (2026)
di: Susladkar, Onkar, et al.
Pubblicazione: (2026)
Harmonized Spatial and Spectral Learning for Robust and Generalized Medical Image Segmentation
di: Gorade, Vandan, et al.
Pubblicazione: (2024)
di: Gorade, Vandan, et al.
Pubblicazione: (2024)
ViCTr: Vital Consistency Transfer for Pathology Aware Image Synthesis
di: Susladkar, Onkar, et al.
Pubblicazione: (2025)
di: Susladkar, Onkar, et al.
Pubblicazione: (2025)
Motion Consistency Model: Accelerating Video Diffusion with Disentangled Motion-Appearance Distillation
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024)
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024)
HumANDiff: Articulated Noise Diffusion for Motion-Consistent Human Video Generation
di: Hu, Tao, et al.
Pubblicazione: (2026)
di: Hu, Tao, et al.
Pubblicazione: (2026)
Training-Free Motion-Guided Video Generation with Enhanced Temporal Consistency Using Motion Consistency Loss
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
Fréchet Video Motion Distance: A Metric for Evaluating Motion Consistency in Videos
di: Liu, Jiahe, et al.
Pubblicazione: (2024)
di: Liu, Jiahe, et al.
Pubblicazione: (2024)
EMDM: Efficient Motion Diffusion Model for Fast and High-Quality Motion Generation
di: Zhou, Wenyang, et al.
Pubblicazione: (2023)
di: Zhou, Wenyang, et al.
Pubblicazione: (2023)
Motion-I2V: Consistent and Controllable Image-to-Video Generation with Explicit Motion Modeling
di: Shi, Xiaoyu, et al.
Pubblicazione: (2024)
di: Shi, Xiaoyu, et al.
Pubblicazione: (2024)
DiMo: Discrete Diffusion Modeling for Motion Generation and Understanding
di: Zhang, Ning, et al.
Pubblicazione: (2026)
di: Zhang, Ning, et al.
Pubblicazione: (2026)
FC-VFI: Faithful and Consistent Video Frame Interpolation for High-FPS Slow Motion Video Generation
di: Ding, Ganggui, et al.
Pubblicazione: (2026)
di: Ding, Ganggui, et al.
Pubblicazione: (2026)
DeCo: Decoupled Human-Centered Diffusion Video Editing with Motion Consistency
di: Zhong, Xiaojing, et al.
Pubblicazione: (2024)
di: Zhong, Xiaojing, et al.
Pubblicazione: (2024)
PyraTok: Language-Aligned Pyramidal Tokenizer for Video Understanding and Generation
di: Susladkar, Onkar, et al.
Pubblicazione: (2026)
di: Susladkar, Onkar, et al.
Pubblicazione: (2026)
MotionStone: Decoupled Motion Intensity Modulation with Diffusion Transformer for Image-to-Video Generation
di: Shi, Shuwei, et al.
Pubblicazione: (2024)
di: Shi, Shuwei, et al.
Pubblicazione: (2024)
MoGAN: Improving Motion Quality in Video Diffusion via Few-Step Motion Adversarial Post-Training
di: Xue, Haotian, et al.
Pubblicazione: (2025)
di: Xue, Haotian, et al.
Pubblicazione: (2025)
MechVerse: Evaluating Physical Motion Consistency in Video Generation Models
di: Jain, Rahul, et al.
Pubblicazione: (2026)
di: Jain, Rahul, et al.
Pubblicazione: (2026)
MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance
di: Zhang, Yuang, et al.
Pubblicazione: (2024)
di: Zhang, Yuang, et al.
Pubblicazione: (2024)
Motion-Guided Latent Diffusion for Temporally Consistent Real-world Video Super-resolution
di: Yang, Xi, et al.
Pubblicazione: (2023)
di: Yang, Xi, et al.
Pubblicazione: (2023)
EchoMotion: Unified Human Video and Motion Generation via Dual-Modality Diffusion Transformer
di: Yang, Yuxiao, et al.
Pubblicazione: (2025)
di: Yang, Yuxiao, et al.
Pubblicazione: (2025)
MultiMotion: Multi Subject Video Motion Transfer via Video Diffusion Transformer
di: Liu, Penghui, et al.
Pubblicazione: (2025)
di: Liu, Penghui, et al.
Pubblicazione: (2025)
Motion Prompting: Controlling Video Generation with Motion Trajectories
di: Geng, Daniel, et al.
Pubblicazione: (2024)
di: Geng, Daniel, et al.
Pubblicazione: (2024)
GeCo: Evaluating Geometric Consistency for Video Generation via Motion and Structure
di: Gu, Leslie, et al.
Pubblicazione: (2025)
di: Gu, Leslie, et al.
Pubblicazione: (2025)
Causal Motion Diffusion Models for Autoregressive Motion Generation
di: Yu, Qing, et al.
Pubblicazione: (2026)
di: Yu, Qing, et al.
Pubblicazione: (2026)
BlockVid: Block Diffusion for High-Quality and Consistent Minute-Long Video Generation
di: Zhang, Zeyu, et al.
Pubblicazione: (2025)
di: Zhang, Zeyu, et al.
Pubblicazione: (2025)
Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
Temporal Consistency-Aware Text-to-Motion Generation
di: Wang, Hongsong, et al.
Pubblicazione: (2026)
di: Wang, Hongsong, et al.
Pubblicazione: (2026)
MotionRAG: Motion Retrieval-Augmented Image-to-Video Generation
di: Zhu, Chenhui, et al.
Pubblicazione: (2025)
di: Zhu, Chenhui, et al.
Pubblicazione: (2025)
MotionBooth: Motion-Aware Customized Text-to-Video Generation
di: Wu, Jianzong, et al.
Pubblicazione: (2024)
di: Wu, Jianzong, et al.
Pubblicazione: (2024)
MotiMotion: Motion-Controlled Video Generation with Visual Reasoning
di: Hsin-Ying, Lee, et al.
Pubblicazione: (2026)
di: Hsin-Ying, Lee, et al.
Pubblicazione: (2026)
MoDiT: Learning Highly Consistent 3D Motion Coefficients with Diffusion Transformer for Talking Head Generation
di: Wang, Yucheng, et al.
Pubblicazione: (2025)
di: Wang, Yucheng, et al.
Pubblicazione: (2025)
Proteus-ID: ID-Consistent and Motion-Coherent Video Customization
di: Zhang, Guiyu, et al.
Pubblicazione: (2025)
di: Zhang, Guiyu, et al.
Pubblicazione: (2025)
Denoising Reuse: Exploiting Inter-frame Motion Consistency for Efficient Video Latent Generation
di: Wang, Chenyu, et al.
Pubblicazione: (2024)
di: Wang, Chenyu, et al.
Pubblicazione: (2024)
MotionMix: Weakly-Supervised Diffusion for Controllable Motion Generation
di: Hoang, Nhat M., et al.
Pubblicazione: (2024)
di: Hoang, Nhat M., et al.
Pubblicazione: (2024)
MotionLCM: Real-time Controllable Motion Generation via Latent Consistency Model
di: Dai, Wenxun, et al.
Pubblicazione: (2024)
di: Dai, Wenxun, et al.
Pubblicazione: (2024)
Spectral Motion Alignment for Video Motion Transfer using Diffusion Models
di: Park, Geon Yeong, et al.
Pubblicazione: (2024)
di: Park, Geon Yeong, et al.
Pubblicazione: (2024)
Cinemo: Consistent and Controllable Image Animation with Motion Diffusion Models
di: Ma, Xin, et al.
Pubblicazione: (2024)
di: Ma, Xin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
D2Styler: Advancing Arbitrary Style Transfer with Discrete Diffusion Methods
di: Susladkar, Onkar, et al.
Pubblicazione: (2024) -
Dressing the Imagination: A Dataset for AI-Powered Translation of Text into Fashion Outfits and A Novel NeRA Adapter for Enhanced Feature Adaptation
di: Deshmukh, Gayatri, et al.
Pubblicazione: (2024) -
Historic Scripts to Modern Vision: A Novel Dataset and A VLM Framework for Transliteration of Modi Script to Devanagari
di: Kausadikar, Harshal, et al.
Pubblicazione: (2025) -
L2GNet: Optimal Local-to-Global Representation of Anatomical Structures for Generalized Medical Image Segmentation
di: Gorade, Vandan, et al.
Pubblicazione: (2025) -
Best of Both Worlds: Multimodal Reasoning and Generation via Unified Discrete Flow Matching
di: Susladkar, Onkar, et al.
Pubblicazione: (2026)