Consistent Human Image and Video Generation with Spatially Conditioned Diffusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Cao, Mingdeng, Mou, Chong, Yuan, Ziyang, Wang, Xintao, Zhang, Zhaoyang, Shan, Ying, Zheng, Yinqiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ReVideo: Remake a Video with Motion and Content Control
di: Mou, Chong, et al.
Pubblicazione: (2024)
di: Mou, Chong, et al.
Pubblicazione: (2024)
MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model
di: Niu, Muyao, et al.
Pubblicazione: (2024)
di: Niu, Muyao, et al.
Pubblicazione: (2024)
Instruction-based Image Manipulation by Watching How Things Move
di: Cao, Mingdeng, et al.
Pubblicazione: (2024)
di: Cao, Mingdeng, et al.
Pubblicazione: (2024)
DiffEditor: Boosting Accuracy and Flexibility on Diffusion-based Image Editing
di: Mou, Chong, et al.
Pubblicazione: (2024)
di: Mou, Chong, et al.
Pubblicazione: (2024)
AniCrafter: Customizing Realistic Human-Centric Animation via Avatar-Background Conditioning in Video Diffusion Models
di: Niu, Muyao, et al.
Pubblicazione: (2025)
di: Niu, Muyao, et al.
Pubblicazione: (2025)
Rolling Shutter Correction with Intermediate Distortion Flow Estimation
di: Cao, Mingdeng, et al.
Pubblicazione: (2024)
di: Cao, Mingdeng, et al.
Pubblicazione: (2024)
Image Conductor: Precision Control for Interactive Video Synthesis
di: Li, Yaowei, et al.
Pubblicazione: (2024)
di: Li, Yaowei, et al.
Pubblicazione: (2024)
VideoPainter: Any-length Video Inpainting and Editing with Plug-and-Play Context Control
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
MiraData: A Large-Scale Video Dataset with Long Durations and Structured Captions
di: Ju, Xuan, et al.
Pubblicazione: (2024)
di: Ju, Xuan, et al.
Pubblicazione: (2024)
360DVD: Controllable Panorama Video Generation with 360-Degree Video Diffusion Model
di: Wang, Qian, et al.
Pubblicazione: (2024)
di: Wang, Qian, et al.
Pubblicazione: (2024)
LaMD: Latent Motion Diffusion for Image-Conditional Video Generation
di: Hu, Yaosi, et al.
Pubblicazione: (2023)
di: Hu, Yaosi, et al.
Pubblicazione: (2023)
All-in-One Transferring Image Compression from Human Perception to Multi-Machine Perception
di: Zhao, Jiancheng, et al.
Pubblicazione: (2025)
di: Zhao, Jiancheng, et al.
Pubblicazione: (2025)
VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models
di: Chen, Haoxin, et al.
Pubblicazione: (2024)
di: Chen, Haoxin, et al.
Pubblicazione: (2024)
MotionCtrl: A Unified and Flexible Motion Controller for Video Generation
di: Wang, Zhouxia, et al.
Pubblicazione: (2023)
di: Wang, Zhouxia, et al.
Pubblicazione: (2023)
Analysis and Benchmarking of Extending Blind Face Image Restoration to Videos
di: Wang, Zhouxia, et al.
Pubblicazione: (2024)
di: Wang, Zhouxia, et al.
Pubblicazione: (2024)
EventHDR: from Event to High-Speed HDR Videos and Beyond
di: Zou, Yunhao, et al.
Pubblicazione: (2024)
di: Zou, Yunhao, et al.
Pubblicazione: (2024)
Hierarchical Codec Diffusion for Video-to-Speech Generation
di: Ye, Jiaxin, et al.
Pubblicazione: (2026)
di: Ye, Jiaxin, et al.
Pubblicazione: (2026)
FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling
di: Qiu, Haonan, et al.
Pubblicazione: (2023)
di: Qiu, Haonan, et al.
Pubblicazione: (2023)
MotionStone: Decoupled Motion Intensity Modulation with Diffusion Transformer for Image-to-Video Generation
di: Shi, Shuwei, et al.
Pubblicazione: (2024)
di: Shi, Shuwei, et al.
Pubblicazione: (2024)
CustomCrafter: Customized Video Generation with Preserving Motion and Concept Composition Abilities
di: Wu, Tao, et al.
Pubblicazione: (2024)
di: Wu, Tao, et al.
Pubblicazione: (2024)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
di: Wang, Xiang, et al.
Pubblicazione: (2024)
di: Wang, Xiang, et al.
Pubblicazione: (2024)
ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning
di: Huang, Yuzhou, et al.
Pubblicazione: (2025)
di: Huang, Yuzhou, et al.
Pubblicazione: (2025)
ContextAnyone: Context-Aware Diffusion for Character-Consistent Text-to-Video Generation
di: Mai, Ziyang, et al.
Pubblicazione: (2025)
di: Mai, Ziyang, et al.
Pubblicazione: (2025)
BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion
di: Ju, Xuan, et al.
Pubblicazione: (2024)
di: Ju, Xuan, et al.
Pubblicazione: (2024)
DepthSync: Diffusion Guidance-Based Depth Synchronization for Scale- and Geometry-Consistent Video Depth Estimation
di: Dong, Yue-Jiang, et al.
Pubblicazione: (2025)
di: Dong, Yue-Jiang, et al.
Pubblicazione: (2025)
StyleAdapter: A Unified Stylized Image Generation Model
di: Wang, Zhouxia, et al.
Pubblicazione: (2023)
di: Wang, Zhouxia, et al.
Pubblicazione: (2023)
OmniDrag: Enabling Motion Control for Omnidirectional Image-to-Video Generation
di: Li, Weiqi, et al.
Pubblicazione: (2024)
di: Li, Weiqi, et al.
Pubblicazione: (2024)
Diffusion-Based Hierarchical Image Steganography
di: Xu, Youmin, et al.
Pubblicazione: (2024)
di: Xu, Youmin, et al.
Pubblicazione: (2024)
Measuring 3D Spatial Geometric Consistency in Dynamic Generated Videos
di: Dou, Weijia, et al.
Pubblicazione: (2026)
di: Dou, Weijia, et al.
Pubblicazione: (2026)
FullDiT2: Efficient In-Context Conditioning for Video Diffusion Transformers
di: He, Xuanhua, et al.
Pubblicazione: (2025)
di: He, Xuanhua, et al.
Pubblicazione: (2025)
Edit Temporal-Consistent Videos with Image Diffusion Model
di: Wang, Yuanzhi, et al.
Pubblicazione: (2023)
di: Wang, Yuanzhi, et al.
Pubblicazione: (2023)
VividPose: Advancing Stable Video Diffusion for Realistic Human Image Animation
di: Wang, Qilin, et al.
Pubblicazione: (2024)
di: Wang, Qilin, et al.
Pubblicazione: (2024)
Context as Memory: Scene-Consistent Interactive Long Video Generation with Memory Retrieval
di: Yu, Jiwen, et al.
Pubblicazione: (2025)
di: Yu, Jiwen, et al.
Pubblicazione: (2025)
Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos
di: Ma, Yue, et al.
Pubblicazione: (2023)
di: Ma, Yue, et al.
Pubblicazione: (2023)
Enhancing Shape Perception and Segmentation Consistency for Industrial Image Inspection
di: Mao, Guoxuan, et al.
Pubblicazione: (2025)
di: Mao, Guoxuan, et al.
Pubblicazione: (2025)
SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints
di: Bai, Jianhong, et al.
Pubblicazione: (2024)
di: Bai, Jianhong, et al.
Pubblicazione: (2024)
Towards Spatially Consistent Image Generation: On Incorporating Intrinsic Scene Properties into Diffusion Models
di: Lee, Hyundo, et al.
Pubblicazione: (2025)
di: Lee, Hyundo, et al.
Pubblicazione: (2025)
Diffusion4D: Fast Spatial-temporal Consistent 4D Generation via Video Diffusion Models
di: Liang, Hanwen, et al.
Pubblicazione: (2024)
di: Liang, Hanwen, et al.
Pubblicazione: (2024)
InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models
di: Xu, Jiale, et al.
Pubblicazione: (2024)
di: Xu, Jiale, et al.
Pubblicazione: (2024)
JVID: Joint Video-Image Diffusion for Visual-Quality and Temporal-Consistency in Video Generation
di: Reynaud, Hadrien, et al.
Pubblicazione: (2024)
di: Reynaud, Hadrien, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ReVideo: Remake a Video with Motion and Content Control
di: Mou, Chong, et al.
Pubblicazione: (2024) -
MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model
di: Niu, Muyao, et al.
Pubblicazione: (2024) -
Instruction-based Image Manipulation by Watching How Things Move
di: Cao, Mingdeng, et al.
Pubblicazione: (2024) -
DiffEditor: Boosting Accuracy and Flexibility on Diffusion-based Image Editing
di: Mou, Chong, et al.
Pubblicazione: (2024) -
AniCrafter: Customizing Realistic Human-Centric Animation via Avatar-Background Conditioning in Video Diffusion Models
di: Niu, Muyao, et al.
Pubblicazione: (2025)