Layered 3D Human Generation via Semantic-Aware Diffusion Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yi, Ma, Jian, Shao, Ruizhi, Feng, Qiao, Lai, Yu-Kun, Liu, Yebin, Li, Kun |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HumanCoser: Layered 3D Human Generation via Semantic-Aware Diffusion Model
par: Wang, Yi, et autres
Publié: (2024)
par: Wang, Yi, et autres
Publié: (2024)
Human4DiT: 360-degree Human Video Generation with 4D Diffusion Transformer
par: Shao, Ruizhi, et autres
Publié: (2024)
par: Shao, Ruizhi, et autres
Publié: (2024)
FOF-X: Towards Real-time Detailed Human Reconstruction from a Single Image
par: Feng, Qiao, et autres
Publié: (2024)
par: Feng, Qiao, et autres
Publié: (2024)
R2Human: Real-Time 3D Human Appearance Rendering from a Single Image
par: Yang, Yuanwang, et autres
Publié: (2023)
par: Yang, Yuanwang, et autres
Publié: (2023)
OAHuman: Occlusion-Aware 3D Human Reconstruction from Monocular Images
par: Yang, Yuanwang, et autres
Publié: (2026)
par: Yang, Yuanwang, et autres
Publié: (2026)
UniMo: Unifying 2D Video and 3D Human Motion with an Autoregressive Framework
par: Pang, Youxin, et autres
Publié: (2025)
par: Pang, Youxin, et autres
Publié: (2025)
HHMR: Holistic Hand Mesh Recovery by Enhancing the Multimodal Controllability of Graph Diffusion Models
par: Li, Mengcheng, et autres
Publié: (2024)
par: Li, Mengcheng, et autres
Publié: (2024)
Interspatial Attention for Efficient 4D Human Video Generation
par: Shao, Ruizhi, et autres
Publié: (2025)
par: Shao, Ruizhi, et autres
Publié: (2025)
SViMo: Synchronized Diffusion for Video and Motion Generation in Hand-object Interaction Scenarios
par: Dang, Lingwei, et autres
Publié: (2025)
par: Dang, Lingwei, et autres
Publié: (2025)
GPS-Gaussian: Generalizable Pixel-wise 3D Gaussian Splatting for Real-time Human Novel View Synthesis
par: Zheng, Shunyuan, et autres
Publié: (2023)
par: Zheng, Shunyuan, et autres
Publié: (2023)
Joint2Human: High-quality 3D Human Generation via Compact Spherical Embedding of 3D Joints
par: Zhang, Muxin, et autres
Publié: (2023)
par: Zhang, Muxin, et autres
Publié: (2023)
Ins-HOI: Instance Aware Human-Object Interactions Recovery
par: Zhang, Jiajun, et autres
Publié: (2023)
par: Zhang, Jiajun, et autres
Publié: (2023)
DreamCraft3D++: Efficient Hierarchical 3D Generation with Multi-Plane Reconstruction Model
par: Sun, Jingxiang, et autres
Publié: (2024)
par: Sun, Jingxiang, et autres
Publié: (2024)
GPS-Gaussian+: Generalizable Pixel-wise 3D Gaussian Splatting for Real-Time Human-Scene Rendering from Sparse Views
par: Zhou, Boyao, et autres
Publié: (2024)
par: Zhou, Boyao, et autres
Publié: (2024)
CoopDiff: Anticipating 3D Human-object Interactions via Contact-consistent Decoupled Diffusion
par: Lin, Xiaotong, et autres
Publié: (2025)
par: Lin, Xiaotong, et autres
Publié: (2025)
Topology Sculptor, Shape Refiner: Discrete Diffusion Model for High-Fidelity 3D Meshes Generation
par: Song, Kaiyu, et autres
Publié: (2025)
par: Song, Kaiyu, et autres
Publié: (2025)
DevilSight: Augmenting Monocular Human Avatar Reconstruction through a Virtual Perspective
par: Chen, Yushuo, et autres
Publié: (2025)
par: Chen, Yushuo, et autres
Publié: (2025)
SemanticSplat: Feed-Forward 3D Scene Understanding with Language-Aware Gaussian Fields
par: Li, Qijing, et autres
Publié: (2025)
par: Li, Qijing, et autres
Publié: (2025)
CloSET: Modeling Clothed Humans on Continuous Surface with Explicit Template Decomposition
par: Zhang, Hongwen, et autres
Publié: (2023)
par: Zhang, Hongwen, et autres
Publié: (2023)
SpeechAct: Towards Generating Whole-body Motion from Speech
par: Zhang, Jinsong, et autres
Publié: (2023)
par: Zhang, Jinsong, et autres
Publié: (2023)
Human-Aware 3D Scene Generation with Spatially-constrained Diffusion Models
par: Hong, Xiaolin, et autres
Publié: (2024)
par: Hong, Xiaolin, et autres
Publié: (2024)
SemanticHuman-HD: High-Resolution Semantic Disentangled 3D Human Generation
par: Zheng, Peng, et autres
Publié: (2024)
par: Zheng, Peng, et autres
Publié: (2024)
3D-Aware Implicit Motion Control for View-Adaptive Human Video Generation
par: Fang, Zhixue, et autres
Publié: (2026)
par: Fang, Zhixue, et autres
Publié: (2026)
ManiVideo: Generating Hand-Object Manipulation Video with Dexterous and Generalizable Grasping
par: Pang, Youxin, et autres
Publié: (2024)
par: Pang, Youxin, et autres
Publié: (2024)
3D-aware Image Generation and Editing with Multi-modal Conditions
par: Li, Bo, et autres
Publié: (2024)
par: Li, Bo, et autres
Publié: (2024)
Human as Points: Explicit Point-based 3D Human Reconstruction from Single-view RGB Images
par: Tang, Yingzhi, et autres
Publié: (2023)
par: Tang, Yingzhi, et autres
Publié: (2023)
FineDiffusion: Scaling up Diffusion Models for Fine-grained Image Generation with 10,000 Classes
par: Pan, Ziying, et autres
Publié: (2024)
par: Pan, Ziying, et autres
Publié: (2024)
MILD: Multi-Layer Diffusion Strategy for Complex and Precise Multi-IP Aware Human Erasing
par: Yu, Jinghan, et autres
Publié: (2025)
par: Yu, Jinghan, et autres
Publié: (2025)
The Roles of Contextual Semantic Relevance Metrics in Human Visual Processing
par: Sun, Kun, et autres
Publié: (2024)
par: Sun, Kun, et autres
Publié: (2024)
TopoDiT-3D: Topology-Aware Diffusion Transformer with Bottleneck Structure for 3D Point Cloud Generation
par: Guan, Zechao, et autres
Publié: (2025)
par: Guan, Zechao, et autres
Publié: (2025)
GeoDiff4D: Geometry-Aware Diffusion for 4D Head Avatar Reconstruction
par: Xu, Chao, et autres
Publié: (2026)
par: Xu, Chao, et autres
Publié: (2026)
RESCUE: Crowd Evacuation Simulation via Controlling SDM-United Characters
par: Liu, Xiaolin, et autres
Publié: (2025)
par: Liu, Xiaolin, et autres
Publié: (2025)
Frequency Regulation for Exposure Bias Mitigation in Diffusion Models
par: Yu, Meng, et autres
Publié: (2025)
par: Yu, Meng, et autres
Publié: (2025)
GaussianDiffusion: 3D Gaussian Splatting for Denoising Diffusion Probabilistic Models with Structured Noise
par: Li, Xinhai, et autres
Publié: (2023)
par: Li, Xinhai, et autres
Publié: (2023)
GAF: Gaussian Action Field as a 4D Representation for Dynamic World Modeling in Robotic Manipulation
par: Chai, Ying, et autres
Publié: (2025)
par: Chai, Ying, et autres
Publié: (2025)
Recovering 3D Human Mesh from Monocular Images: A Survey
par: Tian, Yating, et autres
Publié: (2022)
par: Tian, Yating, et autres
Publié: (2022)
Slot-ID: Identity-Preserving Video Generation from Reference Videos via Slot-Based Temporal Identity Encoding
par: Lai, Yixuan, et autres
Publié: (2026)
par: Lai, Yixuan, et autres
Publié: (2026)
3D Gaussian Blendshapes for Head Avatar Animation
par: Ma, Shengjie, et autres
Publié: (2024)
par: Ma, Shengjie, et autres
Publié: (2024)
GAFD-CC: Global-Aware Feature Decoupling with Confidence Calibration for OOD Detection
par: Zou, Kun, et autres
Publié: (2025)
par: Zou, Kun, et autres
Publié: (2025)
SeaLion: Semantic Part-Aware Latent Point Diffusion Models for 3D Generation
par: Zhu, Dekai, et autres
Publié: (2025)
par: Zhu, Dekai, et autres
Publié: (2025)
Documents similaires
-
HumanCoser: Layered 3D Human Generation via Semantic-Aware Diffusion Model
par: Wang, Yi, et autres
Publié: (2024) -
Human4DiT: 360-degree Human Video Generation with 4D Diffusion Transformer
par: Shao, Ruizhi, et autres
Publié: (2024) -
FOF-X: Towards Real-time Detailed Human Reconstruction from a Single Image
par: Feng, Qiao, et autres
Publié: (2024) -
R2Human: Real-Time 3D Human Appearance Rendering from a Single Image
par: Yang, Yuanwang, et autres
Publié: (2023) -
OAHuman: Occlusion-Aware 3D Human Reconstruction from Monocular Images
par: Yang, Yuanwang, et autres
Publié: (2026)