Human Video Generation from a Single Image with 3D Pose and View Control
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Tiantian, Yao, Chun-Han, Hu, Tao, Reddy, Mallikarjun Byrasandra Ramalinga, Yang, Ming-Hsuan, Jampani, Varun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FaceCraft4D: Animated 3D Facial Avatar Generation from a Single Image
di: Yin, Fei, et al.
Pubblicazione: (2025)
di: Yin, Fei, et al.
Pubblicazione: (2025)
HumANDiff: Articulated Noise Diffusion for Motion-Consistent Human Video Generation
di: Hu, Tao, et al.
Pubblicazione: (2026)
di: Hu, Tao, et al.
Pubblicazione: (2026)
SViM3D: Stable Video Material Diffusion for Single Image 3D Generation
di: Engelhardt, Andreas, et al.
Pubblicazione: (2025)
di: Engelhardt, Andreas, et al.
Pubblicazione: (2025)
Stable Part Diffusion 4D: Multi-View RGB and Kinematic Parts Video Generation
di: Zhang, Hao, et al.
Pubblicazione: (2025)
di: Zhang, Hao, et al.
Pubblicazione: (2025)
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency
di: Xie, Yiming, et al.
Pubblicazione: (2024)
di: Xie, Yiming, et al.
Pubblicazione: (2024)
SV4D 2.0: Enhancing Spatio-Temporal Consistency in Multi-View Video Diffusion for High-Quality 4D Generation
di: Yao, Chun-Han, et al.
Pubblicazione: (2025)
di: Yao, Chun-Han, et al.
Pubblicazione: (2025)
SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using Latent Video Diffusion
di: Voleti, Vikram, et al.
Pubblicazione: (2024)
di: Voleti, Vikram, et al.
Pubblicazione: (2024)
MVD-Fusion: Single-view 3D via Depth-consistent Multi-view Generation
di: Hu, Hanzhe, et al.
Pubblicazione: (2024)
di: Hu, Hanzhe, et al.
Pubblicazione: (2024)
Unified Dense Prediction of Video Diffusion
di: Yang, Lehan, et al.
Pubblicazione: (2025)
di: Yang, Lehan, et al.
Pubblicazione: (2025)
Stable Video-Driven Portraits
di: R., Mallikarjun B., et al.
Pubblicazione: (2025)
di: R., Mallikarjun B., et al.
Pubblicazione: (2025)
SPAR3D: Stable Point-Aware Reconstruction of 3D Objects from Single Images
di: Huang, Zixuan, et al.
Pubblicazione: (2025)
di: Huang, Zixuan, et al.
Pubblicazione: (2025)
OmniControl: Control Any Joint at Any Time for Human Motion Generation
di: Xie, Yiming, et al.
Pubblicazione: (2023)
di: Xie, Yiming, et al.
Pubblicazione: (2023)
Stable Virtual Camera: Generative View Synthesis with Diffusion Models
di: Zhou, Jensen, et al.
Pubblicazione: (2025)
di: Zhou, Jensen, et al.
Pubblicazione: (2025)
Learning Action and Reasoning-Centric Image Editing from Videos and Simulations
di: Krojer, Benno, et al.
Pubblicazione: (2024)
di: Krojer, Benno, et al.
Pubblicazione: (2024)
ContactArt: Learning 3D Interaction Priors for Category-level Articulated Object and Hand Poses Estimation
di: Zhu, Zehao, et al.
Pubblicazione: (2023)
di: Zhu, Zehao, et al.
Pubblicazione: (2023)
CharacterGen: Efficient 3D Character Generation from Single Images with Multi-View Pose Canonicalization
di: Peng, Hao-Yang, et al.
Pubblicazione: (2024)
di: Peng, Hao-Yang, et al.
Pubblicazione: (2024)
Blur2Sharp: Human Novel Pose and View Synthesis with Generative Prior Refinement
di: Lai, Chia-Hern, et al.
Pubblicazione: (2025)
di: Lai, Chia-Hern, et al.
Pubblicazione: (2025)
SF3D: Stable Fast 3D Mesh Reconstruction with UV-unwrapping and Illumination Disentanglement
di: Boss, Mark, et al.
Pubblicazione: (2024)
di: Boss, Mark, et al.
Pubblicazione: (2024)
ConDense: Consistent 2D/3D Pre-training for Dense and Sparse Features from Multi-View Images
di: Zhang, Xiaoshuai, et al.
Pubblicazione: (2024)
di: Zhang, Xiaoshuai, et al.
Pubblicazione: (2024)
Computational Tradeoffs in Image Synthesis: Diffusion, Masked-Token, and Next-Token Prediction
di: Kilian, Maciej, et al.
Pubblicazione: (2024)
di: Kilian, Maciej, et al.
Pubblicazione: (2024)
Shaping Realities: Enhancing 3D Generative AI with Fabrication Constraints
di: Faruqi, Faraz, et al.
Pubblicazione: (2024)
di: Faruqi, Faraz, et al.
Pubblicazione: (2024)
WordRobe: Text-Guided Generation of Textured 3D Garments
di: Srivastava, Astitva, et al.
Pubblicazione: (2024)
di: Srivastava, Astitva, et al.
Pubblicazione: (2024)
ZeST: Zero-Shot Material Transfer from a Single Image
di: Cheng, Ta-Ying, et al.
Pubblicazione: (2024)
di: Cheng, Ta-Ying, et al.
Pubblicazione: (2024)
HOI-Diff: Text-Driven Synthesis of 3D Human-Object Interactions using Diffusion Models
di: Peng, Xiaogang, et al.
Pubblicazione: (2023)
di: Peng, Xiaogang, et al.
Pubblicazione: (2023)
Foley Control: Aligning a Frozen Latent Text-to-Audio Model to Video
di: Rowles, Ciara, et al.
Pubblicazione: (2025)
di: Rowles, Ciara, et al.
Pubblicazione: (2025)
Not all Views are Created Equal: Analyzing Viewpoint Instabilities in Vision Foundation Models
di: Michalkiewicz, Mateusz, et al.
Pubblicazione: (2024)
di: Michalkiewicz, Mateusz, et al.
Pubblicazione: (2024)
Restage4D: Reanimating Deformable 3D Reconstruction from a Single Video
di: He, Jixuan, et al.
Pubblicazione: (2025)
di: He, Jixuan, et al.
Pubblicazione: (2025)
3D Congealing: 3D-Aware Image Alignment in the Wild
di: Zhang, Yunzhi, et al.
Pubblicazione: (2024)
di: Zhang, Yunzhi, et al.
Pubblicazione: (2024)
HouseCrafter: Lifting Floorplans to 3D Scenes with 2D Diffusion Model
di: Nguyen, Hieu T., et al.
Pubblicazione: (2024)
di: Nguyen, Hieu T., et al.
Pubblicazione: (2024)
MonST3R: A Simple Approach for Estimating Geometry in the Presence of Motion
di: Zhang, Junyi, et al.
Pubblicazione: (2024)
di: Zhang, Junyi, et al.
Pubblicazione: (2024)
Telling Left from Right: Identifying Geometry-Aware Semantic Correspondence
di: Zhang, Junyi, et al.
Pubblicazione: (2023)
di: Zhang, Junyi, et al.
Pubblicazione: (2023)
TripoSR: Fast 3D Object Reconstruction from a Single Image
di: Tochilkin, Dmitry, et al.
Pubblicazione: (2024)
di: Tochilkin, Dmitry, et al.
Pubblicazione: (2024)
ICE-G: Image Conditional Editing of 3D Gaussian Splats
di: Jaganathan, Vishnu, et al.
Pubblicazione: (2024)
di: Jaganathan, Vishnu, et al.
Pubblicazione: (2024)
PandaPose: 3D Human Pose Lifting from a Single Image via Propagating 2D Pose Prior to 3D Anchor Space
di: Zheng, Jinghong, et al.
Pubblicazione: (2026)
di: Zheng, Jinghong, et al.
Pubblicazione: (2026)
PromptRR: Diffusion Models as Prompt Generators for Single Image Reflection Removal
di: Wang, Tao, et al.
Pubblicazione: (2024)
di: Wang, Tao, et al.
Pubblicazione: (2024)
Enhancing Domain Generalization in 3D Human Pose Estimation through Controllable Generative Augmentation
di: Hu, Xinhao, et al.
Pubblicazione: (2026)
di: Hu, Xinhao, et al.
Pubblicazione: (2026)
Layout-your-3D: Controllable and Precise 3D Generation with 2D Blueprint
di: Zhou, Junwei, et al.
Pubblicazione: (2024)
di: Zhou, Junwei, et al.
Pubblicazione: (2024)
3D-Aware Implicit Motion Control for View-Adaptive Human Video Generation
di: Fang, Zhixue, et al.
Pubblicazione: (2026)
di: Fang, Zhixue, et al.
Pubblicazione: (2026)
PhysRig: Differentiable Physics-Based Skinning and Rigging Framework for Realistic Articulated Object Modeling
di: Zhang, Hao, et al.
Pubblicazione: (2025)
di: Zhang, Hao, et al.
Pubblicazione: (2025)
E$^3$C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control
di: Gu, Qiao, et al.
Pubblicazione: (2026)
di: Gu, Qiao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
FaceCraft4D: Animated 3D Facial Avatar Generation from a Single Image
di: Yin, Fei, et al.
Pubblicazione: (2025) -
HumANDiff: Articulated Noise Diffusion for Motion-Consistent Human Video Generation
di: Hu, Tao, et al.
Pubblicazione: (2026) -
SViM3D: Stable Video Material Diffusion for Single Image 3D Generation
di: Engelhardt, Andreas, et al.
Pubblicazione: (2025) -
Stable Part Diffusion 4D: Multi-View RGB and Kinematic Parts Video Generation
di: Zhang, Hao, et al.
Pubblicazione: (2025) -
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency
di: Xie, Yiming, et al.
Pubblicazione: (2024)