Wan-S2V: Audio-Driven Cinematic Video Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gao, Xin, Hu, Li, Hu, Siqi, Huang, Mingyang, Ji, Chaonan, Meng, Dechao, Qi, Jinwei, Qiao, Penchong, Shen, Zhen, Song, Yafei, Sun, Ke, Tian, Linrui, Wang, Guangyuan, Wang, Qi, Wang, Zhongjian, Xiao, Jiayu, Xu, Sheng, Zhang, Bang, Zhang, Peng, Zhang, Xindi, Zhang, Zhe, Zhou, Jingren, Zhuo, Lian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Wan-Animate: Unified Character Animation and Replacement with Holistic Replication
par: Cheng, Gang, et autres
Publié: (2025)
par: Cheng, Gang, et autres
Publié: (2025)
OmniTalker: One-shot Real-time Text-Driven Talking Audio-Video Generation With Multimodal Style Mimicking
par: Wang, Zhongjian, et autres
Publié: (2025)
par: Wang, Zhongjian, et autres
Publié: (2025)
MirrorMe: Towards Realtime and High Fidelity Audio-Driven Halfbody Animation
par: Meng, Dechao, et autres
Publié: (2025)
par: Meng, Dechao, et autres
Publié: (2025)
EMO2: End-Effector Guided Audio-Driven Avatar Video Generation
par: Tian, Linrui, et autres
Publié: (2025)
par: Tian, Linrui, et autres
Publié: (2025)
SyncAnyone: Implicit Disentanglement via Progressive Self-Correction for Lip-Syncing in the wild
par: Zhang, Xindi, et autres
Publié: (2025)
par: Zhang, Xindi, et autres
Publié: (2025)
Knot Forcing: Taming Autoregressive Video Diffusion Models for Real-time Infinite Interactive Portrait Animation
par: Xiao, Steven, et autres
Publié: (2025)
par: Xiao, Steven, et autres
Publié: (2025)
EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions
par: Tian, Linrui, et autres
Publié: (2024)
par: Tian, Linrui, et autres
Publié: (2024)
PortraitDirector: A Hierarchical Disentanglement Framework for Controllable and Real-time Facial Reenactment
par: Ji, Chaonan, et autres
Publié: (2026)
par: Ji, Chaonan, et autres
Publié: (2026)
Controllable and Expressive One-Shot Video Head Swapping
par: Ji, Chaonan, et autres
Publié: (2025)
par: Ji, Chaonan, et autres
Publié: (2025)
Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance
par: Hu, Li, et autres
Publié: (2025)
par: Hu, Li, et autres
Publié: (2025)
OutfitAnyone: Ultra-high Quality Virtual Try-On for Any Clothing and Any Person
par: Sun, Ke, et autres
Publié: (2024)
par: Sun, Ke, et autres
Publié: (2024)
ChatAnyone: Stylized Real-time Portrait Video Generation with Hierarchical Motion Diffusion Model
par: Qi, Jinwei, et autres
Publié: (2025)
par: Qi, Jinwei, et autres
Publié: (2025)
Exploring Timeline Control for Facial Motion Generation
par: Ma, Yifeng, et autres
Publié: (2025)
par: Ma, Yifeng, et autres
Publié: (2025)
A new proof of Carlitz-Wan conjecture on exceptional polynomials
par: Hu, Yilong, et autres
Publié: (2026)
par: Hu, Yilong, et autres
Publié: (2026)
A Review on the Current Research Status of Key Areas in Wireless Capsule Endoscopy
par: Guangyuan Wang, et autres
Publié: (2025)
par: Guangyuan Wang, et autres
Publié: (2025)
UCM: Unifying Camera Control and Memory with Time-aware Positional Encoding Warping for World Models
par: Xu, Tianxing, et autres
Publié: (2026)
par: Xu, Tianxing, et autres
Publié: (2026)
Cinematic Audio Source Separation Using Visual Cues
par: Zhang, Kang, et autres
Publié: (2026)
par: Zhang, Kang, et autres
Publié: (2026)
Wan-R1: Verifiable-Reinforcement Learning for Video Reasoning
par: Liu, Ming, et autres
Publié: (2026)
par: Liu, Ming, et autres
Publié: (2026)
A mesh-free method for interface problems using the deep learning approach
par: Wang, Zhongjian, et autres
Publié: (2019)
par: Wang, Zhongjian, et autres
Publié: (2019)
A Novel Stochastic Particle-Field Algorithm for a Reaction-Diffusion-Advection Cancer Invasion Model
par: Hu, Jingyuan, et autres
Publié: (2026)
par: Hu, Jingyuan, et autres
Publié: (2026)
A Stochastic Interacting Particle-Field Algorithm for a Haptotaxis Advection-Diffusion System Modeling Cancer Cell Invasion
par: Hu, Boyi, et autres
Publié: (2024)
par: Hu, Boyi, et autres
Publié: (2024)
A Stochastic Genetic Interacting Particle Method for Reaction-Diffusion-Advection Equations
par: Hu, Boyi, et autres
Publié: (2025)
par: Hu, Boyi, et autres
Publié: (2025)
Convergence Analysis of a Stochastic Interacting Particle-Field Algorithm for 3D Parabolic-Parabolic Keller-Segel Systems
par: Hu, Boyi, et autres
Publié: (2025)
par: Hu, Boyi, et autres
Publié: (2025)
A fast stochastic interacting particle-field method for 3D parabolic parabolic Chemotaxis systems: numerical algorithms and error analysis
par: Hu, Jingyuan, et autres
Publié: (2025)
par: Hu, Jingyuan, et autres
Publié: (2025)
Co-speech Gesture Video Generation via Motion-Based Graph Retrieval
par: Song, Yafei, et autres
Publié: (2025)
par: Song, Yafei, et autres
Publié: (2025)
Projection Head is Secretly an Information Bottleneck
par: Ouyang, Zhuo, et autres
Publié: (2025)
par: Ouyang, Zhuo, et autres
Publié: (2025)
Inverter Redistribution through Self-Dual and Self-Anti-Dual Function Transformation
par: Wang, Jingren, et autres
Publié: (2026)
par: Wang, Jingren, et autres
Publié: (2026)
Wan-Image: Pushing the Boundaries of Generative Visual Intelligence
par: Mao, Chaojie, et autres
Publié: (2026)
par: Mao, Chaojie, et autres
Publié: (2026)
Camera Artist: A Multi-Agent Framework for Cinematic Language Storytelling Video Generation
par: Hu, Haobo, et autres
Publié: (2026)
par: Hu, Haobo, et autres
Publié: (2026)
MotionRAG-Diff: A Retrieval-Augmented Diffusion Framework for Long-Term Music-to-Dance Generation
par: Huang, Mingyang, et autres
Publié: (2025)
par: Huang, Mingyang, et autres
Publié: (2025)
AudioMotionBench: Evaluating Auditory Motion Perception in Audio LLMs
par: Sun, Zhe, et autres
Publié: (2025)
par: Sun, Zhe, et autres
Publié: (2025)
Balance Divergence for Knowledge Distillation
par: Qi, Yafei, et autres
Publié: (2025)
par: Qi, Yafei, et autres
Publié: (2025)
Wan: Open and Advanced Large-Scale Video Generative Models
par: Wan, Team, et autres
Publié: (2025)
par: Wan, Team, et autres
Publié: (2025)
Preconditioned One-Step Generative Modeling for Bayesian Inverse Problems in Function Spaces
par: Cheng, Zilan, et autres
Publié: (2026)
par: Cheng, Zilan, et autres
Publié: (2026)
A DeepParticle method for learning and generating aggregation patterns in multi-dimensional Keller-Segel chemotaxis systems
par: Wang, Zhongjian, et autres
Publié: (2022)
par: Wang, Zhongjian, et autres
Publié: (2022)
A Novel Stochastic Interacting Particle-Field Algorithm for 3D Parabolic-Parabolic Keller-Segel Chemotaxis System
par: Wang, Zhongjian, et autres
Publié: (2023)
par: Wang, Zhongjian, et autres
Publié: (2023)
ShotVerse: Advancing Cinematic Camera Control for Text-Driven Multi-Shot Video Creation
par: Yang, Songlin, et autres
Publié: (2026)
par: Yang, Songlin, et autres
Publié: (2026)
Exceptional extensions of local fields and the Carlitz--Wan conjecture
par: Ding, Zhiguo, et autres
Publié: (2025)
par: Ding, Zhiguo, et autres
Publié: (2025)
A structure-preserving scheme for computing effective diffusivity and anomalous diffusion phenomena of random flows
par: Zhang, Tan, et autres
Publié: (2024)
par: Zhang, Tan, et autres
Publié: (2024)
A Bidirectional DeepParticle Method for Efficiently Solving Low-dimensional Transport Map Problems
par: Zhang, Tan, et autres
Publié: (2025)
par: Zhang, Tan, et autres
Publié: (2025)
Documents similaires
-
Wan-Animate: Unified Character Animation and Replacement with Holistic Replication
par: Cheng, Gang, et autres
Publié: (2025) -
OmniTalker: One-shot Real-time Text-Driven Talking Audio-Video Generation With Multimodal Style Mimicking
par: Wang, Zhongjian, et autres
Publié: (2025) -
MirrorMe: Towards Realtime and High Fidelity Audio-Driven Halfbody Animation
par: Meng, Dechao, et autres
Publié: (2025) -
EMO2: End-Effector Guided Audio-Driven Avatar Video Generation
par: Tian, Linrui, et autres
Publié: (2025) -
SyncAnyone: Implicit Disentanglement via Progressive Self-Correction for Lip-Syncing in the wild
par: Zhang, Xindi, et autres
Publié: (2025)