HumANDiff: Articulated Noise Diffusion for Motion-Consistent Human Video Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Tao, Jampani, Varun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SV4D 2.0: Enhancing Spatio-Temporal Consistency in Multi-View Video Diffusion for High-Quality 4D Generation
par: Yao, Chun-Han, et autres
Publié: (2025)
par: Yao, Chun-Han, et autres
Publié: (2025)
SyncNoise: Geometrically Consistent Noise Prediction for Text-based 3D Scene Editing
par: Li, Ruihuang, et autres
Publié: (2024)
par: Li, Ruihuang, et autres
Publié: (2024)
OmniControl: Control Any Joint at Any Time for Human Motion Generation
par: Xie, Yiming, et autres
Publié: (2023)
par: Xie, Yiming, et autres
Publié: (2023)
Human Video Generation from a Single Image with 3D Pose and View Control
par: Wang, Tiantian, et autres
Publié: (2026)
par: Wang, Tiantian, et autres
Publié: (2026)
SMooDi: Stylized Motion Diffusion Model
par: Zhong, Lei, et autres
Publié: (2024)
par: Zhong, Lei, et autres
Publié: (2024)
PhysRig: Differentiable Physics-Based Skinning and Rigging Framework for Realistic Articulated Object Modeling
par: Zhang, Hao, et autres
Publié: (2025)
par: Zhang, Hao, et autres
Publié: (2025)
Stable Part Diffusion 4D: Multi-View RGB and Kinematic Parts Video Generation
par: Zhang, Hao, et autres
Publié: (2025)
par: Zhang, Hao, et autres
Publié: (2025)
Computational Tradeoffs in Image Synthesis: Diffusion, Masked-Token, and Next-Token Prediction
par: Kilian, Maciej, et autres
Publié: (2024)
par: Kilian, Maciej, et autres
Publié: (2024)
Unified Dense Prediction of Video Diffusion
par: Yang, Lehan, et autres
Publié: (2025)
par: Yang, Lehan, et autres
Publié: (2025)
MVD-Fusion: Single-view 3D via Depth-consistent Multi-view Generation
par: Hu, Hanzhe, et autres
Publié: (2024)
par: Hu, Hanzhe, et autres
Publié: (2024)
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency
par: Xie, Yiming, et autres
Publié: (2024)
par: Xie, Yiming, et autres
Publié: (2024)
HOI-Diff: Text-Driven Synthesis of 3D Human-Object Interactions using Diffusion Models
par: Peng, Xiaogang, et autres
Publié: (2023)
par: Peng, Xiaogang, et autres
Publié: (2023)
HumMUSS: Human Motion Understanding using State Space Models
par: Mondal, Arnab Kumar, et autres
Publié: (2024)
par: Mondal, Arnab Kumar, et autres
Publié: (2024)
DeCo: Decoupled Human-Centered Diffusion Video Editing with Motion Consistency
par: Zhong, Xiaojing, et autres
Publié: (2024)
par: Zhong, Xiaojing, et autres
Publié: (2024)
MotionAura: Generating High-Quality and Motion Consistent Videos using Discrete Diffusion
par: Susladkar, Onkar, et autres
Publié: (2024)
par: Susladkar, Onkar, et autres
Publié: (2024)
Towards Highly-Constrained Human Motion Generation with Retrieval-Guided Diffusion Noise Optimization
par: Liu, Hanchao, et autres
Publié: (2026)
par: Liu, Hanchao, et autres
Publié: (2026)
HouseCrafter: Lifting Floorplans to 3D Scenes with 2D Diffusion Model
par: Nguyen, Hieu T., et autres
Publié: (2024)
par: Nguyen, Hieu T., et autres
Publié: (2024)
HumMorph: Generalized Dynamic Human Neural Fields from Few Views
par: Zadrożny, Jakub, et autres
Publié: (2025)
par: Zadrożny, Jakub, et autres
Publié: (2025)
ContactArt: Learning 3D Interaction Priors for Category-level Articulated Object and Hand Poses Estimation
par: Zhu, Zehao, et autres
Publié: (2023)
par: Zhu, Zehao, et autres
Publié: (2023)
Consistent Human Image and Video Generation with Spatially Conditioned Diffusion
par: Cao, Mingdeng, et autres
Publié: (2024)
par: Cao, Mingdeng, et autres
Publié: (2024)
ArtMesh: Part-Aware Articulated Mesh Fields with Motion-Consistent Dynamics
par: Yuan, Sylvia, et autres
Publié: (2026)
par: Yuan, Sylvia, et autres
Publié: (2026)
Motion Consistency Model: Accelerating Video Diffusion with Disentangled Motion-Appearance Distillation
par: Zhai, Yuanhao, et autres
Publié: (2024)
par: Zhai, Yuanhao, et autres
Publié: (2024)
SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using Latent Video Diffusion
par: Voleti, Vikram, et autres
Publié: (2024)
par: Voleti, Vikram, et autres
Publié: (2024)
SViM3D: Stable Video Material Diffusion for Single Image 3D Generation
par: Engelhardt, Andreas, et autres
Publié: (2025)
par: Engelhardt, Andreas, et autres
Publié: (2025)
CoNo: Consistency Noise Injection for Tuning-free Long Video Diffusion
par: Wang, Xingrui, et autres
Publié: (2024)
par: Wang, Xingrui, et autres
Publié: (2024)
Stable Cinemetrics : Structured Taxonomy and Evaluation for Professional Video Generation
par: Chatterjee, Agneet, et autres
Publié: (2025)
par: Chatterjee, Agneet, et autres
Publié: (2025)
EchoMotion: Unified Human Video and Motion Generation via Dual-Modality Diffusion Transformer
par: Yang, Yuxiao, et autres
Publié: (2025)
par: Yang, Yuxiao, et autres
Publié: (2025)
Stable Video-Driven Portraits
par: R., Mallikarjun B., et autres
Publié: (2025)
par: R., Mallikarjun B., et autres
Publié: (2025)
Training-Free Motion-Guided Video Generation with Enhanced Temporal Consistency Using Motion Consistency Loss
par: Zhang, Xinyu, et autres
Publié: (2025)
par: Zhang, Xinyu, et autres
Publié: (2025)
WordRobe: Text-Guided Generation of Textured 3D Garments
par: Srivastava, Astitva, et autres
Publié: (2024)
par: Srivastava, Astitva, et autres
Publié: (2024)
Stable Virtual Camera: Generative View Synthesis with Diffusion Models
par: Zhou, Jensen, et autres
Publié: (2025)
par: Zhou, Jensen, et autres
Publié: (2025)
Ouroboros-Diffusion: Exploring Consistent Content Generation in Tuning-free Long Video Diffusion
par: Chen, Jingyuan, et autres
Publié: (2025)
par: Chen, Jingyuan, et autres
Publié: (2025)
Learning Action and Reasoning-Centric Image Editing from Videos and Simulations
par: Krojer, Benno, et autres
Publié: (2024)
par: Krojer, Benno, et autres
Publié: (2024)
HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation
par: Gan, Qijun, et autres
Publié: (2025)
par: Gan, Qijun, et autres
Publié: (2025)
Foley Control: Aligning a Frozen Latent Text-to-Audio Model to Video
par: Rowles, Ciara, et autres
Publié: (2025)
par: Rowles, Ciara, et autres
Publié: (2025)
LaMD: Latent Motion Diffusion for Image-Conditional Video Generation
par: Hu, Yaosi, et autres
Publié: (2023)
par: Hu, Yaosi, et autres
Publié: (2023)
MARBLE: Material Recomposition and Blending in CLIP-Space
par: Cheng, Ta-Ying, et autres
Publié: (2025)
par: Cheng, Ta-Ying, et autres
Publié: (2025)
FROMAT: Multiview Material Appearance Transfer via Few-Shot Self-Attention Adaptation
par: Kompanowski, Hubert, et autres
Publié: (2025)
par: Kompanowski, Hubert, et autres
Publié: (2025)
SF3D: Stable Fast 3D Mesh Reconstruction with UV-unwrapping and Illumination Disentanglement
par: Boss, Mark, et autres
Publié: (2024)
par: Boss, Mark, et autres
Publié: (2024)
Articulated Kinematics Distillation from Video Diffusion Models
par: Li, Xuan, et autres
Publié: (2025)
par: Li, Xuan, et autres
Publié: (2025)
Documents similaires
-
SV4D 2.0: Enhancing Spatio-Temporal Consistency in Multi-View Video Diffusion for High-Quality 4D Generation
par: Yao, Chun-Han, et autres
Publié: (2025) -
SyncNoise: Geometrically Consistent Noise Prediction for Text-based 3D Scene Editing
par: Li, Ruihuang, et autres
Publié: (2024) -
OmniControl: Control Any Joint at Any Time for Human Motion Generation
par: Xie, Yiming, et autres
Publié: (2023) -
Human Video Generation from a Single Image with 3D Pose and View Control
par: Wang, Tiantian, et autres
Publié: (2026) -
SMooDi: Stylized Motion Diffusion Model
par: Zhong, Lei, et autres
Publié: (2024)