Wan-Move: Motion-controllable Video Generation via Latent Trajectory Guidance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chu, Ruihang, He, Yefei, Chen, Zhekai, Zhang, Shiwei, Xu, Xiaogang, Xia, Bin, Wang, Dingdong, Yi, Hongwei, Liu, Xihui, Zhao, Hengshuang, Liu, Yu, Zhang, Yingya, Yang, Yujiu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TTS-VAR: A Test-Time Scaling Framework for Visual Auto-Regressive Generation
par: Chen, Zhekai, et autres
Publié: (2025)
par: Chen, Zhekai, et autres
Publié: (2025)
DreamVideo-Omni: Omni-Motion Controlled Multi-Subject Video Customization with Latent Identity Reinforcement Learning
par: Wei, Yujie, et autres
Publié: (2026)
par: Wei, Yujie, et autres
Publié: (2026)
Routing Matters in MoE: Scaling Diffusion Transformers with Explicit Routing Guidance
par: Wei, Yujie, et autres
Publié: (2025)
par: Wei, Yujie, et autres
Publié: (2025)
VideoZoomer: Reinforcement-Learned Temporal Focusing for Long Video Reasoning
par: Ding, Yang, et autres
Publié: (2025)
par: Ding, Yang, et autres
Publié: (2025)
MSAVBench: Towards Comprehensive and Reliable Evaluation of Multi-Shot Audio-Video Generation
par: Wei, Yujie, et autres
Publié: (2026)
par: Wei, Yujie, et autres
Publié: (2026)
FreeScale: Unleashing the Resolution of Diffusion Models via Tuning-Free Scale Fusion
par: Qiu, Haonan, et autres
Publié: (2024)
par: Qiu, Haonan, et autres
Publié: (2024)
Replace Anyone in Videos
par: Wang, Xiang, et autres
Publié: (2024)
par: Wang, Xiang, et autres
Publié: (2024)
Video-Zero: Self-Evolution Video Understanding
par: Zhang, Ruixu, et autres
Publié: (2026)
par: Zhang, Ruixu, et autres
Publié: (2026)
AVBench: Human-Aligned and Automated Evaluation Benchmark for Audio-Video Generative Models
par: Yang, Jialiang, et autres
Publié: (2026)
par: Yang, Jialiang, et autres
Publié: (2026)
O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing
par: Chen, Yuqing, et autres
Publié: (2025)
par: Chen, Yuqing, et autres
Publié: (2025)
Wan: Open and Advanced Large-Scale Video Generative Models
par: Wan, Team, et autres
Publié: (2025)
par: Wan, Team, et autres
Publié: (2025)
MACRO: Advancing Multi-Reference Image Generation with Structured Long-Context Data
par: Chen, Zhekai, et autres
Publié: (2026)
par: Chen, Zhekai, et autres
Publié: (2026)
TRACE: Object Motion Editing in Videos with First-Frame Trajectory Guidance
par: Phung, Quynh, et autres
Publié: (2026)
par: Phung, Quynh, et autres
Publié: (2026)
Exploiting Discriminative Codebook Prior for Autoregressive Image Generation
par: Tang, Longxiang, et autres
Publié: (2025)
par: Tang, Longxiang, et autres
Publié: (2025)
Wan-R1: Verifiable-Reinforcement Learning for Video Reasoning
par: Liu, Ming, et autres
Publié: (2026)
par: Liu, Ming, et autres
Publié: (2026)
AdaViewPlanner: Adapting Video Diffusion Models for Viewpoint Planning in 4D Scenes
par: Li, Yu, et autres
Publié: (2025)
par: Li, Yu, et autres
Publié: (2025)
DreamVideo-2: Zero-Shot Subject-Driven Video Customization with Precise Motion Control
par: Wei, Yujie, et autres
Publié: (2024)
par: Wei, Yujie, et autres
Publié: (2024)
SynMotion: Semantic-Visual Adaptation for Motion Customized Video Generation
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
Moto: Latent Motion Token as the Bridging Language for Learning Robot Manipulation from Videos
par: Chen, Yi, et autres
Publié: (2024)
par: Chen, Yi, et autres
Publié: (2024)
FreeMask: Rethinking the Importance of Attention Masks for Zero-Shot Video Editing
par: Cai, Lingling, et autres
Publié: (2024)
par: Cai, Lingling, et autres
Publié: (2024)
MagicMotion: Controllable Video Generation with Dense-to-Sparse Trajectory Guidance
par: Li, Quanhao, et autres
Publié: (2025)
par: Li, Quanhao, et autres
Publié: (2025)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
par: Wang, Xiang, et autres
Publié: (2025)
par: Wang, Xiang, et autres
Publié: (2025)
Smaller Models are Natural Explorers for Policy-Level Diversity in GRPO
par: Ren, Yiming, et autres
Publié: (2026)
par: Ren, Yiming, et autres
Publié: (2026)
DreamVE: Unified Instruction-based Image and Video Editing
par: Xia, Bin, et autres
Publié: (2025)
par: Xia, Bin, et autres
Publié: (2025)
Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model
par: Liu, Feng, et autres
Publié: (2024)
par: Liu, Feng, et autres
Publié: (2024)
Velocity-Space 3D Asset Editing
par: Liu, Hao, et autres
Publié: (2026)
par: Liu, Hao, et autres
Publié: (2026)
Think Before You Move: Latent Motion Reasoning for Text-to-Motion Generation
par: Qian, Yijie, et autres
Publié: (2025)
par: Qian, Yijie, et autres
Publié: (2025)
FlashMotion: Few-Step Controllable Video Generation with Trajectory Guidance
par: Li, Quanhao, et autres
Publié: (2026)
par: Li, Quanhao, et autres
Publié: (2026)
Generative Universal Verifier as Multimodal Meta-Reasoner
par: Zhang, Xinchen, et autres
Publié: (2025)
par: Zhang, Xinchen, et autres
Publié: (2025)
Wan-S2V: Audio-Driven Cinematic Video Generation
par: Gao, Xin, et autres
Publié: (2025)
par: Gao, Xin, et autres
Publié: (2025)
PersonalVideo: High ID-Fidelity Video Customization without Dynamic and Semantic Degradation
par: Li, Hengjia, et autres
Publié: (2024)
par: Li, Hengjia, et autres
Publié: (2024)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
par: Wang, Xiang, et autres
Publié: (2024)
par: Wang, Xiang, et autres
Publié: (2024)
SafeMove-RL: A Certifiable Reinforcement Learning Framework for Dynamic Motion Constraints in Trajectory Planning
par: Liu, Tengfei, et autres
Publié: (2025)
par: Liu, Tengfei, et autres
Publié: (2025)
GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver
par: Chen, Yuqing, et autres
Publié: (2026)
par: Chen, Yuqing, et autres
Publié: (2026)
Wan-Weaver: Interleaved Multi-modal Generation via Decoupled Training
par: Xing, Jinbo, et autres
Publié: (2026)
par: Xing, Jinbo, et autres
Publié: (2026)
PanoWan: Lifting Diffusion Video Generation Models to 360° with Latitude/Longitude-aware Mechanisms
par: Xia, Yifei, et autres
Publié: (2025)
par: Xia, Yifei, et autres
Publié: (2025)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
par: Ma, Yifeng, et autres
Publié: (2023)
par: Ma, Yifeng, et autres
Publié: (2023)
Geometric-Aware Low-Light Image and Video Enhancement via Depth Guidance
par: Lin, Yingqi, et autres
Publié: (2023)
par: Lin, Yingqi, et autres
Publié: (2023)
Effect of MgO on the Dissolution Behavior of Lime in Dephosphorization Slags for Double Slag Refining in Basic Oxygen Furnace
par: Yunjin Xia, et autres
Publié: (2025)
par: Yunjin Xia, et autres
Publié: (2025)
DiffCamera: Arbitrary Refocusing on Images
par: Wang, Yiyang, et autres
Publié: (2025)
par: Wang, Yiyang, et autres
Publié: (2025)
Documents similaires
-
TTS-VAR: A Test-Time Scaling Framework for Visual Auto-Regressive Generation
par: Chen, Zhekai, et autres
Publié: (2025) -
DreamVideo-Omni: Omni-Motion Controlled Multi-Subject Video Customization with Latent Identity Reinforcement Learning
par: Wei, Yujie, et autres
Publié: (2026) -
Routing Matters in MoE: Scaling Diffusion Transformers with Explicit Routing Guidance
par: Wei, Yujie, et autres
Publié: (2025) -
VideoZoomer: Reinforcement-Learned Temporal Focusing for Long Video Reasoning
par: Ding, Yang, et autres
Publié: (2025) -
MSAVBench: Towards Comprehensive and Reliable Evaluation of Multi-Shot Audio-Video Generation
par: Wei, Yujie, et autres
Publié: (2026)