HyperMotionX: The Dataset and Benchmark with DiT-Based Pose-Guided Human Image Animation of Complex Motions
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Shuolin, Zheng, Siming, Wang, Ziyi, Yu, HC, Chen, Jinwei, Zhang, Huaqi, Zhou, Daquan, Lee, Tong-Yee, Li, Bo, Jiang, Peng-Tao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RED: Robust Event-Guided Motion Deblurring with Modality-Specific Disentanglement
di: Leng, Yihong, et al.
Pubblicazione: (2025)
di: Leng, Yihong, et al.
Pubblicazione: (2025)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
di: Wang, Xiang, et al.
Pubblicazione: (2025)
di: Wang, Xiang, et al.
Pubblicazione: (2025)
HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation
di: Gan, Qijun, et al.
Pubblicazione: (2025)
di: Gan, Qijun, et al.
Pubblicazione: (2025)
SketchColour: Channel Concat Guided DiT-based Sketch-to-Colour Pipeline for 2D Animation
di: Sadihin, Bryan Constantine, et al.
Pubblicazione: (2025)
di: Sadihin, Bryan Constantine, et al.
Pubblicazione: (2025)
Attend to Not Attended: Structure-then-Detail Token Merging for Post-training DiT Acceleration
di: Fang, Haipeng, et al.
Pubblicazione: (2025)
di: Fang, Haipeng, et al.
Pubblicazione: (2025)
X-UniMotion: Animating Human Images with Expressive, Unified and Identity-Agnostic Motion Latents
di: Song, Guoxian, et al.
Pubblicazione: (2025)
di: Song, Guoxian, et al.
Pubblicazione: (2025)
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
di: Feng, He, et al.
Pubblicazione: (2025)
di: Feng, He, et al.
Pubblicazione: (2025)
Do As I Do: Pose Guided Human Motion Copy
di: Wu, Sifan, et al.
Pubblicazione: (2024)
di: Wu, Sifan, et al.
Pubblicazione: (2024)
RealisDance-DiT: Simple yet Strong Baseline towards Controllable Character Animation in the Wild
di: Zhou, Jingkai, et al.
Pubblicazione: (2025)
di: Zhou, Jingkai, et al.
Pubblicazione: (2025)
DiT4DiT: Jointly Modeling Video Dynamics and Actions for Generalizable Robot Control
di: Ma, Teli, et al.
Pubblicazione: (2026)
di: Ma, Teli, et al.
Pubblicazione: (2026)
MagicAnime: A Hierarchically Annotated, Multimodal and Multitasking Dataset with Benchmarks for Cartoon Animation Generation
di: Xu, Shuolin, et al.
Pubblicazione: (2025)
di: Xu, Shuolin, et al.
Pubblicazione: (2025)
Animate-X: Universal Character Image Animation with Enhanced Motion Representation
di: Tan, Shuai, et al.
Pubblicazione: (2024)
di: Tan, Shuai, et al.
Pubblicazione: (2024)
DiVE: DiT-based Video Generation with Enhanced Control
di: Jiang, Junpeng, et al.
Pubblicazione: (2024)
di: Jiang, Junpeng, et al.
Pubblicazione: (2024)
VidAnimator: User-Guided Stylized 3D Character Animation from Human Videos
di: Ye, Xinwu, et al.
Pubblicazione: (2025)
di: Ye, Xinwu, et al.
Pubblicazione: (2025)
DiT-HC: Enabling Efficient Training of Visual Generation Model DiT on HPC-oriented CPU Cluster
di: Zhang, Jinxiao, et al.
Pubblicazione: (2026)
di: Zhang, Jinxiao, et al.
Pubblicazione: (2026)
BigMaQ: A Big Macaque Motion and Animation Dataset Bridging Image and 3D Pose Representations
di: Martini, Lucas, et al.
Pubblicazione: (2026)
di: Martini, Lucas, et al.
Pubblicazione: (2026)
Lumina-Next: Making Lumina-T2X Stronger and Faster with Next-DiT
di: Zhuo, Le, et al.
Pubblicazione: (2024)
di: Zhuo, Le, et al.
Pubblicazione: (2024)
Target Pose Guided Whole-body Grasping Motion Generation for Digital Humans
di: Shao, Quanquan, et al.
Pubblicazione: (2024)
di: Shao, Quanquan, et al.
Pubblicazione: (2024)
MoVer: Motion Verification for Motion Graphics Animations
di: Ma, Jiaju, et al.
Pubblicazione: (2025)
di: Ma, Jiaju, et al.
Pubblicazione: (2025)
GSDeformer: Direct, Real-time and Extensible Cage-based Deformation for 3D Gaussian Splatting
di: Huang, Jiajun, et al.
Pubblicazione: (2024)
di: Huang, Jiajun, et al.
Pubblicazione: (2024)
HeadRouter: A Training-free Image Editing Framework for MM-DiTs by Adaptively Routing Attention Heads
di: Xu, Yu, et al.
Pubblicazione: (2024)
di: Xu, Yu, et al.
Pubblicazione: (2024)
X-Portrait: Expressive Portrait Animation with Hierarchical Motion Attention
di: Xie, You, et al.
Pubblicazione: (2024)
di: Xie, You, et al.
Pubblicazione: (2024)
$Δ$-DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers
di: Chen, Pengtao, et al.
Pubblicazione: (2024)
di: Chen, Pengtao, et al.
Pubblicazione: (2024)
MultiAnimate: Pose-Guided Image Animation Made Extensible
di: Hu, Yingcheng, et al.
Pubblicazione: (2026)
di: Hu, Yingcheng, et al.
Pubblicazione: (2026)
GaussianMotion: End-to-End Learning of Animatable Gaussian Avatars with Pose Guidance from Text
di: Shim, Gyumin, et al.
Pubblicazione: (2025)
di: Shim, Gyumin, et al.
Pubblicazione: (2025)
Animate Your Motion: Turning Still Images into Dynamic Videos
di: Li, Mingxiao, et al.
Pubblicazione: (2024)
di: Li, Mingxiao, et al.
Pubblicazione: (2024)
Motion-X++: A Large-Scale Multimodal 3D Whole-body Human Motion Dataset
di: Zhang, Yuhong, et al.
Pubblicazione: (2025)
di: Zhang, Yuhong, et al.
Pubblicazione: (2025)
Motion-X: A Large-scale 3D Expressive Whole-body Human Motion Dataset
di: Lin, Jing, et al.
Pubblicazione: (2023)
di: Lin, Jing, et al.
Pubblicazione: (2023)
Human4DiT: 360-degree Human Video Generation with 4D Diffusion Transformer
di: Shao, Ruizhi, et al.
Pubblicazione: (2024)
di: Shao, Ruizhi, et al.
Pubblicazione: (2024)
SD-DiT: Unleashing the Power of Self-supervised Discrimination in Diffusion Transformer
di: Zhu, Rui, et al.
Pubblicazione: (2024)
di: Zhu, Rui, et al.
Pubblicazione: (2024)
Exploring Timeline Control for Facial Motion Generation
di: Ma, Yifeng, et al.
Pubblicazione: (2025)
di: Ma, Yifeng, et al.
Pubblicazione: (2025)
MotionMap: Representing Multimodality in Human Pose Forecasting
di: Hosseininejad, Reyhaneh, et al.
Pubblicazione: (2024)
di: Hosseininejad, Reyhaneh, et al.
Pubblicazione: (2024)
DiT360: High-Fidelity Panoramic Image Generation via Hybrid Training
di: Feng, Haoran, et al.
Pubblicazione: (2025)
di: Feng, Haoran, et al.
Pubblicazione: (2025)
ZigMa: A DiT-style Zigzag Mamba Diffusion Model
di: Hu, Vincent Tao, et al.
Pubblicazione: (2024)
di: Hu, Vincent Tao, et al.
Pubblicazione: (2024)
Once Is Enough: Lightweight DiT-Based Video Virtual Try-On via One-Time Garment Appearance Injection
di: Pan, Yanjie, et al.
Pubblicazione: (2025)
di: Pan, Yanjie, et al.
Pubblicazione: (2025)
Self-Avatar Animation in Virtual Reality: Impact of Motion Signals Artifacts on the Full-Body Pose Reconstruction
di: Maiorca, Antoine, et al.
Pubblicazione: (2024)
di: Maiorca, Antoine, et al.
Pubblicazione: (2024)
MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance
di: Zhang, Yuang, et al.
Pubblicazione: (2024)
di: Zhang, Yuang, et al.
Pubblicazione: (2024)
xDiT: an Inference Engine for Diffusion Transformers (DiTs) with Massive Parallelism
di: Fang, Jiarui, et al.
Pubblicazione: (2024)
di: Fang, Jiarui, et al.
Pubblicazione: (2024)
DiT4Edit: Diffusion Transformer for Image Editing
di: Feng, Kunyu, et al.
Pubblicazione: (2024)
di: Feng, Kunyu, et al.
Pubblicazione: (2024)
LaVin-DiT: Large Vision Diffusion Transformer
di: Wang, Zhaoqing, et al.
Pubblicazione: (2024)
di: Wang, Zhaoqing, et al.
Pubblicazione: (2024)
Documenti analoghi
-
RED: Robust Event-Guided Motion Deblurring with Modality-Specific Disentanglement
di: Leng, Yihong, et al.
Pubblicazione: (2025) -
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
di: Wang, Xiang, et al.
Pubblicazione: (2025) -
HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation
di: Gan, Qijun, et al.
Pubblicazione: (2025) -
SketchColour: Channel Concat Guided DiT-based Sketch-to-Colour Pipeline for 2D Animation
di: Sadihin, Bryan Constantine, et al.
Pubblicazione: (2025) -
Attend to Not Attended: Structure-then-Detail Token Merging for Post-training DiT Acceleration
di: Fang, Haipeng, et al.
Pubblicazione: (2025)