SV4D 2.0: Enhancing Spatio-Temporal Consistency in Multi-View Video Diffusion for High-Quality 4D Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yao, Chun-Han, Xie, Yiming, Voleti, Vikram, Jiang, Huaizu, Jampani, Varun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency
par: Xie, Yiming, et autres
Publié: (2024)
par: Xie, Yiming, et autres
Publié: (2024)
HouseCrafter: Lifting Floorplans to 3D Scenes with 2D Diffusion Model
par: Nguyen, Hieu T., et autres
Publié: (2024)
par: Nguyen, Hieu T., et autres
Publié: (2024)
SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using Latent Video Diffusion
par: Voleti, Vikram, et autres
Publié: (2024)
par: Voleti, Vikram, et autres
Publié: (2024)
SViM3D: Stable Video Material Diffusion for Single Image 3D Generation
par: Engelhardt, Andreas, et autres
Publié: (2025)
par: Engelhardt, Andreas, et autres
Publié: (2025)
Stable Part Diffusion 4D: Multi-View RGB and Kinematic Parts Video Generation
par: Zhang, Hao, et autres
Publié: (2025)
par: Zhang, Hao, et autres
Publié: (2025)
SMooDi: Stylized Motion Diffusion Model
par: Zhong, Lei, et autres
Publié: (2024)
par: Zhong, Lei, et autres
Publié: (2024)
HOI-Diff: Text-Driven Synthesis of 3D Human-Object Interactions using Diffusion Models
par: Peng, Xiaogang, et autres
Publié: (2023)
par: Peng, Xiaogang, et autres
Publié: (2023)
Stable Virtual Camera: Generative View Synthesis with Diffusion Models
par: Zhou, Jensen, et autres
Publié: (2025)
par: Zhou, Jensen, et autres
Publié: (2025)
OmniControl: Control Any Joint at Any Time for Human Motion Generation
par: Xie, Yiming, et autres
Publié: (2023)
par: Xie, Yiming, et autres
Publié: (2023)
Diffuman4D: 4D Consistent Human View Synthesis from Sparse-View Videos with Spatio-Temporal Diffusion Models
par: Jin, Yudong, et autres
Publié: (2025)
par: Jin, Yudong, et autres
Publié: (2025)
HumANDiff: Articulated Noise Diffusion for Motion-Consistent Human Video Generation
par: Hu, Tao, et autres
Publié: (2026)
par: Hu, Tao, et autres
Publié: (2026)
Stable Video-Driven Portraits
par: R., Mallikarjun B., et autres
Publié: (2025)
par: R., Mallikarjun B., et autres
Publié: (2025)
FaceCraft4D: Animated 3D Facial Avatar Generation from a Single Image
par: Yin, Fei, et autres
Publié: (2025)
par: Yin, Fei, et autres
Publié: (2025)
Human Video Generation from a Single Image with 3D Pose and View Control
par: Wang, Tiantian, et autres
Publié: (2026)
par: Wang, Tiantian, et autres
Publié: (2026)
STCDiT: Spatio-Temporally Consistent Diffusion Transformer for High-Quality Video Super-Resolution
par: Chen, Junyang, et autres
Publié: (2025)
par: Chen, Junyang, et autres
Publié: (2025)
LASER: Layer-wise Scale Alignment for Training-Free Streaming 4D Reconstruction
par: Ding, Tianye, et autres
Publié: (2025)
par: Ding, Tianye, et autres
Publié: (2025)
SV-DRR: High-Fidelity Novel View X-Ray Synthesis Using Diffusion Model
par: Xie, Chun, et autres
Publié: (2025)
par: Xie, Chun, et autres
Publié: (2025)
Splat4D: Diffusion-Enhanced 4D Gaussian Splatting for Temporally and Spatially Consistent Content Creation
par: Yin, Minghao, et autres
Publié: (2025)
par: Yin, Minghao, et autres
Publié: (2025)
Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression
par: Meng, Zichong, et autres
Publié: (2024)
par: Meng, Zichong, et autres
Publié: (2024)
ConDense: Consistent 2D/3D Pre-training for Dense and Sparse Features from Multi-View Images
par: Zhang, Xiaoshuai, et autres
Publié: (2024)
par: Zhang, Xiaoshuai, et autres
Publié: (2024)
SparseCam4D: Spatio-Temporally Consistent 4D Reconstruction from Sparse Cameras
par: Pan, Weihong, et autres
Publié: (2026)
par: Pan, Weihong, et autres
Publié: (2026)
4D-GSW: Kinematic-Aware Spatio-Temporal Consistent Watermarking for 4D Gaussian Splatting
par: Zhou, Sifan, et autres
Publié: (2026)
par: Zhou, Sifan, et autres
Publié: (2026)
STP4D: Spatio-Temporal-Prompt Consistent Modeling for Text-to-4D Gaussian Splatting
par: Deng, Yunze, et autres
Publié: (2025)
par: Deng, Yunze, et autres
Publié: (2025)
Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model
par: Li, Peiyan, et autres
Publié: (2026)
par: Li, Peiyan, et autres
Publié: (2026)
Diffusion4D: Fast Spatial-temporal Consistent 4D Generation via Video Diffusion Models
par: Liang, Hanwen, et autres
Publié: (2024)
par: Liang, Hanwen, et autres
Publié: (2024)
4DSTR: Advancing Generative 4D Gaussians with Spatial-Temporal Rectification for High-Quality and Consistent 4D Generation
par: Liu, Mengmeng, et autres
Publié: (2025)
par: Liu, Mengmeng, et autres
Publié: (2025)
View-Consistent Diffusion Representations for 3D-Consistent Video Generation
par: Danier, Duolikun, et autres
Publié: (2025)
par: Danier, Duolikun, et autres
Publié: (2025)
Shaping Realities: Enhancing 3D Generative AI with Fabrication Constraints
par: Faruqi, Faraz, et autres
Publié: (2024)
par: Faruqi, Faraz, et autres
Publié: (2024)
STS-Mixer: Spatio-Temporal-Spectral Mixer for 4D Point Cloud Video Understanding
par: Li, Wenhao, et autres
Publié: (2026)
par: Li, Wenhao, et autres
Publié: (2026)
3D-Adapter: Geometry-Consistent Multi-View Diffusion for High-Quality 3D Generation
par: Chen, Hansheng, et autres
Publié: (2024)
par: Chen, Hansheng, et autres
Publié: (2024)
SF3D: Stable Fast 3D Mesh Reconstruction with UV-unwrapping and Illumination Disentanglement
par: Boss, Mark, et autres
Publié: (2024)
par: Boss, Mark, et autres
Publié: (2024)
Phys4D: Fine-Grained Physics-Consistent 4D Modeling from Video Diffusion
par: Lu, Haoran, et autres
Publié: (2026)
par: Lu, Haoran, et autres
Publié: (2026)
SV-GS: Sparse View 4D Reconstruction with Skeleton-Driven Gaussian Splatting
par: Chao, Jun-Jee, et autres
Publié: (2026)
par: Chao, Jun-Jee, et autres
Publié: (2026)
Computational Tradeoffs in Image Synthesis: Diffusion, Masked-Token, and Next-Token Prediction
par: Kilian, Maciej, et autres
Publié: (2024)
par: Kilian, Maciej, et autres
Publié: (2024)
A Strong Baseline for Point Cloud Registration via Direct Superpoints Matching
par: Gupta, Aniket, et autres
Publié: (2023)
par: Gupta, Aniket, et autres
Publié: (2023)
Absolute Coordinates Make Motion Generation Easy
par: Meng, Zichong, et autres
Publié: (2025)
par: Meng, Zichong, et autres
Publié: (2025)
SyncNoise: Geometrically Consistent Noise Prediction for Text-based 3D Scene Editing
par: Li, Ruihuang, et autres
Publié: (2024)
par: Li, Ruihuang, et autres
Publié: (2024)
CAT4D: Create Anything in 4D with Multi-View Video Diffusion Models
par: Wu, Rundi, et autres
Publié: (2024)
par: Wu, Rundi, et autres
Publié: (2024)
MVP4D: Multi-View Portrait Video Diffusion for Animatable 4D Avatars
par: Taubner, Felix, et autres
Publié: (2025)
par: Taubner, Felix, et autres
Publié: (2025)
Unified Dense Prediction of Video Diffusion
par: Yang, Lehan, et autres
Publié: (2025)
par: Yang, Lehan, et autres
Publié: (2025)
Documents similaires
-
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency
par: Xie, Yiming, et autres
Publié: (2024) -
HouseCrafter: Lifting Floorplans to 3D Scenes with 2D Diffusion Model
par: Nguyen, Hieu T., et autres
Publié: (2024) -
SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using Latent Video Diffusion
par: Voleti, Vikram, et autres
Publié: (2024) -
SViM3D: Stable Video Material Diffusion for Single Image 3D Generation
par: Engelhardt, Andreas, et autres
Publié: (2025) -
Stable Part Diffusion 4D: Multi-View RGB and Kinematic Parts Video Generation
par: Zhang, Hao, et autres
Publié: (2025)