Generating Human Motion in 3D Scenes from Text Descriptions
Fuente:
arXiv
Guardado en:
| Autores principales: | Cen, Zhi, Pi, Huaijin, Peng, Sida, Shen, Zehong, Yang, Minghui, Zhu, Shuai, Bao, Hujun, Zhou, Xiaowei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
World-Grounded Human Motion Recovery via Gravity-View Coordinates
por: Shen, Zehong, et al.
Publicado: (2024)
por: Shen, Zehong, et al.
Publicado: (2024)
Ready-to-React: Online Reaction Policy for Two-Character Interaction Generation
por: Cen, Zhi, et al.
Publicado: (2025)
por: Cen, Zhi, et al.
Publicado: (2025)
Motion-2-To-3: Leveraging 2D Motion Data for 3D Motion Generations
por: Guo, Ruoxi, et al.
Publicado: (2024)
por: Guo, Ruoxi, et al.
Publicado: (2024)
Contact Matrix: Enhancing Dance Motion Synthesis with Precise Interaction Modeling
por: Chen, Xuhai, et al.
Publicado: (2026)
por: Chen, Xuhai, et al.
Publicado: (2026)
StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
por: Yang, Yifan, et al.
Publicado: (2025)
por: Yang, Yifan, et al.
Publicado: (2025)
MatchAnything: Universal Cross-Modality Image Matching with Large-Scale Pre-Training
por: He, Xingyi, et al.
Publicado: (2025)
por: He, Xingyi, et al.
Publicado: (2025)
UniVerse: Unleashing the Scene Prior of Video Diffusion Models for Robust Radiance Field Reconstruction
por: Cao, Jin, et al.
Publicado: (2025)
por: Cao, Jin, et al.
Publicado: (2025)
MotionStreamer: Streaming Motion Generation via Diffusion-based Autoregressive Model in Causal Latent Space
por: Xiao, Lixing, et al.
Publicado: (2025)
por: Xiao, Lixing, et al.
Publicado: (2025)
MaPa: Text-driven Photorealistic Material Painting for 3D Shapes
por: Zhang, Shangzan, et al.
Publicado: (2024)
por: Zhang, Shangzan, et al.
Publicado: (2024)
Diffuman4D: 4D Consistent Human View Synthesis from Sparse-View Videos with Spatio-Temporal Diffusion Models
por: Jin, Yudong, et al.
Publicado: (2025)
por: Jin, Yudong, et al.
Publicado: (2025)
Split4D: Decomposed 4D Scene Reconstruction Without Video Segmentation
por: Hu, Yongzhen, et al.
Publicado: (2025)
por: Hu, Yongzhen, et al.
Publicado: (2025)
CoDA: Coordinated Diffusion Noise Optimization for Whole-Body Manipulation of Articulated Objects
por: Pi, Huaijin, et al.
Publicado: (2025)
por: Pi, Huaijin, et al.
Publicado: (2025)
FreeTimeGS: Free Gaussian Primitives at Anytime and Anywhere for Dynamic Scene Reconstruction
por: Wang, Yifan, et al.
Publicado: (2025)
por: Wang, Yifan, et al.
Publicado: (2025)
Dyn-E: Local Appearance Editing of Dynamic Neural Radiance Fields
por: Zhang, Shangzan, et al.
Publicado: (2023)
por: Zhang, Shangzan, et al.
Publicado: (2023)
3D-SceneDreamer: Text-Driven 3D-Consistent Scene Generation
por: Zhang, Frank, et al.
Publicado: (2024)
por: Zhang, Frank, et al.
Publicado: (2024)
Precise Action-to-Video Generation Through Visual Action Prompts
por: Wang, Yuang, et al.
Publicado: (2025)
por: Wang, Yuang, et al.
Publicado: (2025)
HumanRAM: Feed-forward Human Reconstruction and Animation Model using Transformers
por: Yu, Zhiyuan, et al.
Publicado: (2025)
por: Yu, Zhiyuan, et al.
Publicado: (2025)
Natural Human Motion Recovery by Aligning High-Order Temporal Dynamics from Monocular Videos
por: Wei, Dingkun, et al.
Publicado: (2026)
por: Wei, Dingkun, et al.
Publicado: (2026)
Representing Long Volumetric Video with Temporal Gaussian Hierarchy
por: Xu, Zhen, et al.
Publicado: (2024)
por: Xu, Zhen, et al.
Publicado: (2024)
HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation
por: Dong, Wenqi, et al.
Publicado: (2025)
por: Dong, Wenqi, et al.
Publicado: (2025)
EnvGS: Modeling View-Dependent Appearance with Environment Gaussian
por: Xie, Tao, et al.
Publicado: (2024)
por: Xie, Tao, et al.
Publicado: (2024)
Generating Human Interaction Motions in Scenes with Text Control
por: Yi, Hongwei, et al.
Publicado: (2024)
por: Yi, Hongwei, et al.
Publicado: (2024)
Embracing Aleatoric Uncertainty: Generating Diverse 3D Human Motion
por: Qin, Zheng, et al.
Publicado: (2025)
por: Qin, Zheng, et al.
Publicado: (2025)
Multi-view Reconstruction via SfM-guided Monocular Depth Estimation
por: Guo, Haoyu, et al.
Publicado: (2025)
por: Guo, Haoyu, et al.
Publicado: (2025)
SAM-guided Graph Cut for 3D Instance Segmentation
por: Guo, Haoyu, et al.
Publicado: (2023)
por: Guo, Haoyu, et al.
Publicado: (2023)
TELA: Text to Layer-wise 3D Clothed Human Generation
por: Dong, Junting, et al.
Publicado: (2024)
por: Dong, Junting, et al.
Publicado: (2024)
Painting 3D Nature in 2D: View Synthesis of Natural Scenes from a Single Semantic Mask
por: Zhang, Shangzan, et al.
Publicado: (2023)
por: Zhang, Shangzan, et al.
Publicado: (2023)
4D Panoptic Scene Graph Generation
por: Yang, Jingkang, et al.
Publicado: (2024)
por: Yang, Jingkang, et al.
Publicado: (2024)
EmbodMocap: In-the-Wild 4D Human-Scene Reconstruction for Embodied Agents
por: Wang, Wenjia, et al.
Publicado: (2026)
por: Wang, Wenjia, et al.
Publicado: (2026)
SpatialTracker: Tracking Any 2D Pixels in 3D Space
por: Xiao, Yuxi, et al.
Publicado: (2024)
por: Xiao, Yuxi, et al.
Publicado: (2024)
SGFormer: Satellite-Ground Fusion for 3D Semantic Scene Completion
por: Guo, Xiyue, et al.
Publicado: (2025)
por: Guo, Xiyue, et al.
Publicado: (2025)
InstaScene: Towards Complete 3D Instance Decomposition and Reconstruction from Cluttered Scenes
por: Yang, Zesong, et al.
Publicado: (2025)
por: Yang, Zesong, et al.
Publicado: (2025)
Text-Image Conditioned 3D Generation
por: Cen, Jiazhong, et al.
Publicado: (2026)
por: Cen, Jiazhong, et al.
Publicado: (2026)
Prompting Depth Anything for 4K Resolution Accurate Metric Depth Estimation
por: Lin, Haotong, et al.
Publicado: (2024)
por: Lin, Haotong, et al.
Publicado: (2024)
Generating Continual Human Motion in Diverse 3D Scenes
por: Mir, Aymen, et al.
Publicado: (2023)
por: Mir, Aymen, et al.
Publicado: (2023)
Mocap-2-to-3: Multi-view Lifting for Monocular Motion Recovery with 2D Pretraining
por: Wang, Zhumei, et al.
Publicado: (2025)
por: Wang, Zhumei, et al.
Publicado: (2025)
EgoAgent: A Joint Predictive Agent Model in Egocentric Worlds
por: Chen, Lu, et al.
Publicado: (2025)
por: Chen, Lu, et al.
Publicado: (2025)
Reg3D: Reconstructive Geometry Instruction Tuning for 3D Scene Understanding
por: Zheng, Hongpei, et al.
Publicado: (2025)
por: Zheng, Hongpei, et al.
Publicado: (2025)
NIS-SLAM: Neural Implicit Semantic RGB-D SLAM for 3D Consistent Scene Understanding
por: Zhai, Hongjia, et al.
Publicado: (2024)
por: Zhai, Hongjia, et al.
Publicado: (2024)
SpatialTrackerV2: 3D Point Tracking Made Easy
por: Xiao, Yuxi, et al.
Publicado: (2025)
por: Xiao, Yuxi, et al.
Publicado: (2025)
Ejemplares similares
-
World-Grounded Human Motion Recovery via Gravity-View Coordinates
por: Shen, Zehong, et al.
Publicado: (2024) -
Ready-to-React: Online Reaction Policy for Two-Character Interaction Generation
por: Cen, Zhi, et al.
Publicado: (2025) -
Motion-2-To-3: Leveraging 2D Motion Data for 3D Motion Generations
por: Guo, Ruoxi, et al.
Publicado: (2024) -
Contact Matrix: Enhancing Dance Motion Synthesis with Precise Interaction Modeling
por: Chen, Xuhai, et al.
Publicado: (2026) -
StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
por: Yang, Yifan, et al.
Publicado: (2025)