PoseAnything: Universal Pose-guided Video Generation with Part-aware Temporal Coherence
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Ruiyan, Hu, Teng, Huang, Kaihui, Su, Zihan, Yi, Ran, Ma, Lizhuang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction
por: Yi, Ran, et al.
Publicado: (2025)
por: Yi, Ran, et al.
Publicado: (2025)
Collaborative Face Experts Fusion in Video Generation: Boosting Identity Consistency Across Large Face Poses
por: Wang, Yuji, et al.
Publicado: (2025)
por: Wang, Yuji, et al.
Publicado: (2025)
Evolution of Video Generative Foundations
por: Hu, Teng, et al.
Publicado: (2026)
por: Hu, Teng, et al.
Publicado: (2026)
UltraGen: High-Resolution Video Generation with Hierarchical Attention
por: Hu, Teng, et al.
Publicado: (2025)
por: Hu, Teng, et al.
Publicado: (2025)
InstanceV: Instance-Level Video Generation
por: Chen, Yuheng, et al.
Publicado: (2025)
por: Chen, Yuheng, et al.
Publicado: (2025)
Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos
por: Ma, Yue, et al.
Publicado: (2023)
por: Ma, Yue, et al.
Publicado: (2023)
Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation
por: Chen, Yuheng, et al.
Publicado: (2026)
por: Chen, Yuheng, et al.
Publicado: (2026)
MotionMaster: Training-free Camera Motion Transfer For Video Generation
por: Hu, Teng, et al.
Publicado: (2024)
por: Hu, Teng, et al.
Publicado: (2024)
SDPose: Tokenized Pose Estimation via Circulation-Guide Self-Distillation
por: Chen, Sichen, et al.
Publicado: (2024)
por: Chen, Sichen, et al.
Publicado: (2024)
PoseGen: In-Context LoRA Finetuning for Pose-Controllable Long Human Video Generation
por: He, Jingxuan, et al.
Publicado: (2025)
por: He, Jingxuan, et al.
Publicado: (2025)
SaRA: High-Efficient Diffusion Model Fine-tuning with Progressive Sparse Low-Rank Adaptation
por: Hu, Teng, et al.
Publicado: (2024)
por: Hu, Teng, et al.
Publicado: (2024)
PoseCrafter: Extreme Pose Estimation with Hybrid Video Synthesis
por: Mao, Qing, et al.
Publicado: (2025)
por: Mao, Qing, et al.
Publicado: (2025)
WildPose: A Unified Framework for Robust Pose Estimation in the Wild
por: Zheng, Jianhao, et al.
Publicado: (2026)
por: Zheng, Jianhao, et al.
Publicado: (2026)
Identity-Preserving Text-to-Video Generation Guided by Simple yet Effective Spatial-Temporal Decoupled Representations
por: Wang, Yuji, et al.
Publicado: (2025)
por: Wang, Yuji, et al.
Publicado: (2025)
AutoComPose: Automatic Generation of Pose Transition Descriptions for Composed Pose Retrieval Using Multimodal LLMs
por: Shen, Yi-Ting, et al.
Publicado: (2025)
por: Shen, Yi-Ting, et al.
Publicado: (2025)
EgoSim: Egocentric World Simulator for Embodied Interaction Generation
por: Hao, Jinkun, et al.
Publicado: (2026)
por: Hao, Jinkun, et al.
Publicado: (2026)
Temporally Guided Articulated Hand Pose Tracking in Surgical Videos
por: Louis, Nathan, et al.
Publicado: (2021)
por: Louis, Nathan, et al.
Publicado: (2021)
AvatarPose: Avatar-guided 3D Pose Estimation of Close Human Interaction from Sparse Multi-view Videos
por: Lu, Feichi, et al.
Publicado: (2024)
por: Lu, Feichi, et al.
Publicado: (2024)
Pose-Guided Fine-Grained Sign Language Video Generation
por: Shi, Tongkai, et al.
Publicado: (2024)
por: Shi, Tongkai, et al.
Publicado: (2024)
PoseTraj: Pose-Aware Trajectory Control in Video Diffusion
por: Ji, Longbin, et al.
Publicado: (2025)
por: Ji, Longbin, et al.
Publicado: (2025)
Rethink Sparse Signals for Pose-guided Text-to-image Generation
por: Xuan, Wenjie, et al.
Publicado: (2025)
por: Xuan, Wenjie, et al.
Publicado: (2025)
STAR-Pose: Efficient Low-Resolution Video Human Pose Estimation via Spatial-Temporal Adaptive Super-Resolution
por: Jin, Yucheng, et al.
Publicado: (2025)
por: Jin, Yucheng, et al.
Publicado: (2025)
MagicPose: Realistic Human Poses and Facial Expressions Retargeting with Identity-aware Diffusion
por: Chang, Di, et al.
Publicado: (2023)
por: Chang, Di, et al.
Publicado: (2023)
Pose-Aware Diffusion for 3D Generation
por: Zhou, Zihan, et al.
Publicado: (2026)
por: Zhou, Zihan, et al.
Publicado: (2026)
StarPose: 3D Human Pose Estimation via Spatial-Temporal Autoregressive Diffusion
por: Yang, Haoxin, et al.
Publicado: (2025)
por: Yang, Haoxin, et al.
Publicado: (2025)
Follow-Your-MultiPose: Tuning-Free Multi-Character Text-to-Video Generation via Pose Guidance
por: Zhang, Beiyuan, et al.
Publicado: (2024)
por: Zhang, Beiyuan, et al.
Publicado: (2024)
Improving Autoregressive Visual Generation with Cluster-Oriented Token Prediction
por: Hu, Teng, et al.
Publicado: (2025)
por: Hu, Teng, et al.
Publicado: (2025)
Alignment is All You Need: A Training-free Augmentation Strategy for Pose-guided Video Generation
por: Jin, Xiaoyu, et al.
Publicado: (2024)
por: Jin, Xiaoyu, et al.
Publicado: (2024)
ManiPose: A Comprehensive Benchmark for Pose-aware Object Manipulation in Robotics
por: Yu, Qiaojun, et al.
Publicado: (2024)
por: Yu, Qiaojun, et al.
Publicado: (2024)
SpatioTemporal Learning for Human Pose Estimation in Sparsely-Labeled Videos
por: Jiao, Yingying, et al.
Publicado: (2025)
por: Jiao, Yingying, et al.
Publicado: (2025)
Harmony: Harmonizing Audio and Video Generation through Cross-Task Synergy
por: Hu, Teng, et al.
Publicado: (2025)
por: Hu, Teng, et al.
Publicado: (2025)
AdR-Gaussian: Accelerating Gaussian Splatting with Adaptive Radius
por: Wang, Xinzhe, et al.
Publicado: (2024)
por: Wang, Xinzhe, et al.
Publicado: (2024)
PoseEmbroider: Towards a 3D, Visual, Semantic-aware Human Pose Representation
por: Delmas, Ginger, et al.
Publicado: (2024)
por: Delmas, Ginger, et al.
Publicado: (2024)
Can Generative Video Models Help Pose Estimation?
por: Cai, Ruojin, et al.
Publicado: (2024)
por: Cai, Ruojin, et al.
Publicado: (2024)
Cambrian-P: Pose-Grounded Video Understanding
por: Yang, Jihan, et al.
Publicado: (2026)
por: Yang, Jihan, et al.
Publicado: (2026)
Generative Hierarchical Temporal Transformer for Hand Pose and Action Modeling
por: Wen, Yilin, et al.
Publicado: (2023)
por: Wen, Yilin, et al.
Publicado: (2023)
End-to-End Multi-Person Pose Estimation with Pose-Aware Video Transformer
por: Yu, Yonghui, et al.
Publicado: (2025)
por: Yu, Yonghui, et al.
Publicado: (2025)
SignAligner: Harmonizing Complementary Pose Modalities for Coherent Sign Language Generation
por: Wang, Xu, et al.
Publicado: (2025)
por: Wang, Xu, et al.
Publicado: (2025)
CUPID: Generative 3D Reconstruction via Joint Object and Pose Modeling
por: Huang, Binbin, et al.
Publicado: (2025)
por: Huang, Binbin, et al.
Publicado: (2025)
BEAR: A Video Dataset For Fine-grained Behaviors Recognition Oriented with Action and Environment Factors
por: Hu, Chengyang, et al.
Publicado: (2025)
por: Hu, Chengyang, et al.
Publicado: (2025)
Ejemplares similares
-
IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction
por: Yi, Ran, et al.
Publicado: (2025) -
Collaborative Face Experts Fusion in Video Generation: Boosting Identity Consistency Across Large Face Poses
por: Wang, Yuji, et al.
Publicado: (2025) -
Evolution of Video Generative Foundations
por: Hu, Teng, et al.
Publicado: (2026) -
UltraGen: High-Resolution Video Generation with Hierarchical Attention
por: Hu, Teng, et al.
Publicado: (2025) -
InstanceV: Instance-Level Video Generation
por: Chen, Yuheng, et al.
Publicado: (2025)