Zero-Shot Human-Object Interaction Synthesis with Multimodal Priors
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lou, Yuke, Wang, Yiming, Wu, Zhen, Zhao, Rui, Wang, Wenjia, Shi, Mingyi, Komura, Taku |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SIMS: Simulating Stylized Human-Scene Interactions with Retrieval-Augmented Script Generation
par: Wang, Wenjia, et autres
Publié: (2024)
par: Wang, Wenjia, et autres
Publié: (2024)
RMD: A Simple Baseline for More General Human Motion Generation via Training-free Retrieval-Augmented Motion Diffuse
par: Liao, Zhouyingcheng, et autres
Publié: (2024)
par: Liao, Zhouyingcheng, et autres
Publié: (2024)
CBIL: Collective Behavior Imitation Learning for Fish from Real Videos
par: Wu, Yifan, et autres
Publié: (2025)
par: Wu, Yifan, et autres
Publié: (2025)
EgoGrasp: World-Space Hand-Object Interaction Estimation from Egocentric Videos
par: Fu, Hongming, et autres
Publié: (2026)
par: Fu, Hongming, et autres
Publié: (2026)
TLControl: Trajectory and Language Control for Human Motion Synthesis
par: Wan, Weilin, et autres
Publié: (2023)
par: Wan, Weilin, et autres
Publié: (2023)
Taming Diffusion Probabilistic Models for Character Control
par: Chen, Rui, et autres
Publié: (2024)
par: Chen, Rui, et autres
Publié: (2024)
SENC: Handling Self-collision in Neural Cloth Simulation
par: Liao, Zhouyingcheng, et autres
Publié: (2024)
par: Liao, Zhouyingcheng, et autres
Publié: (2024)
InteractEdit: Zero-Shot Editing of Human-Object Interactions in Images
par: Hoe, Jiun Tian, et autres
Publié: (2025)
par: Hoe, Jiun Tian, et autres
Publié: (2025)
MOSPA: Human Motion Generation Driven by Spatial Audio
par: Xu, Shuyang, et autres
Publié: (2025)
par: Xu, Shuyang, et autres
Publié: (2025)
CoDA: Coordinated Diffusion Noise Optimization for Whole-Body Manipulation of Articulated Objects
par: Pi, Huaijin, et autres
Publié: (2025)
par: Pi, Huaijin, et autres
Publié: (2025)
HOI-PAGE: Zero-Shot Human-Object Interaction Generation with Part Affordance Guidance
par: Li, Lei, et autres
Publié: (2025)
par: Li, Lei, et autres
Publié: (2025)
ZeroHSI: Zero-Shot 4D Human-Scene Interaction by Video Generation
par: Li, Hongjie, et autres
Publié: (2024)
par: Li, Hongjie, et autres
Publié: (2024)
MotioNet: 3D Human Motion Reconstruction from Monocular Video with Skeleton Consistency
par: Shi, Mingyi, et autres
Publié: (2020)
par: Shi, Mingyi, et autres
Publié: (2020)
It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model
par: Shi, Mingyi, et autres
Publié: (2024)
par: Shi, Mingyi, et autres
Publié: (2024)
InterPrior: Scaling Generative Control for Physics-Based Human-Object Interactions
par: Xu, Sirui, et autres
Publié: (2026)
par: Xu, Sirui, et autres
Publié: (2026)
Next-Scale Autoregressive Models are Zero-Shot Single-Image Object View Synthesizers
par: Yuan, Shiran, et autres
Publié: (2025)
par: Yuan, Shiran, et autres
Publié: (2025)
EMDM: Efficient Motion Diffusion Model for Fast and High-Quality Motion Generation
par: Zhou, Wenyang, et autres
Publié: (2023)
par: Zhou, Wenyang, et autres
Publié: (2023)
ZeroNVS: Zero-Shot 360-Degree View Synthesis from a Single Image
par: Sargent, Kyle, et autres
Publié: (2023)
par: Sargent, Kyle, et autres
Publié: (2023)
Monocular Human-Object Reconstruction in the Wild
par: Huo, Chaofan, et autres
Publié: (2024)
par: Huo, Chaofan, et autres
Publié: (2024)
MotionWavelet: Human Motion Prediction via Wavelet Manifold Learning
par: Feng, Yuming, et autres
Publié: (2024)
par: Feng, Yuming, et autres
Publié: (2024)
Copy-Trasform-Paste: Zero-Shot Object-Object Alignment Guided by Vision-Language and Geometric Constraints
par: Gatenyo, Rotem, et autres
Publié: (2026)
par: Gatenyo, Rotem, et autres
Publié: (2026)
SVGS: Enhancing Gaussian Splatting Using Primitives with Spatially Varying Colors
par: Xu, Rui, et autres
Publié: (2024)
par: Xu, Rui, et autres
Publié: (2024)
Online Neural Path Guiding with Normalized Anisotropic Spherical Gaussians
par: Huang, Jiawei, et autres
Publié: (2023)
par: Huang, Jiawei, et autres
Publié: (2023)
DecoupledGaussian: Object-Scene Decoupling for Physics-Based Interaction
par: Wang, Miaowei, et autres
Publié: (2025)
par: Wang, Miaowei, et autres
Publié: (2025)
Self-Ensembling Gaussian Splatting for Few-Shot Novel View Synthesis
par: Zhao, Chen, et autres
Publié: (2024)
par: Zhao, Chen, et autres
Publié: (2024)
Spec-Gloss Surfels and Normal-Diffuse Priors for Relightable Glossy Objects
par: Kouros, Georgios, et autres
Publié: (2025)
par: Kouros, Georgios, et autres
Publié: (2025)
EG-HumanNeRF: Efficient Generalizable Human NeRF Utilizing Human Prior for Sparse View
par: Wang, Zhaorong, et autres
Publié: (2024)
par: Wang, Zhaorong, et autres
Publié: (2024)
SyncDreamer: Generating Multiview-consistent Images from a Single-view Image
par: Liu, Yuan, et autres
Publié: (2023)
par: Liu, Yuan, et autres
Publié: (2023)
CWF: Consolidating Weak Features in High-quality Mesh Simplification
par: Xu, Rui, et autres
Publié: (2024)
par: Xu, Rui, et autres
Publié: (2024)
Coverage Axis++: Efficient Inner Point Selection for 3D Shape Skeletonization
par: Wang, Zimeng, et autres
Publié: (2024)
par: Wang, Zimeng, et autres
Publié: (2024)
Motion-2-To-3: Leveraging 2D Motion Data for 3D Motion Generations
par: Guo, Ruoxi, et autres
Publié: (2024)
par: Guo, Ruoxi, et autres
Publié: (2024)
StackFLOW: Monocular Human-Object Reconstruction by Stacked Normalizing Flow with Offset
par: Huo, Chaofan, et autres
Publié: (2024)
par: Huo, Chaofan, et autres
Publié: (2024)
iDiT-HOI: Inpainting-based Hand Object Interaction Reenactment via Video Diffusion Transformer
par: Shen, Zhelun, et autres
Publié: (2025)
par: Shen, Zhelun, et autres
Publié: (2025)
ZS-SRT: An Efficient Zero-Shot Super-Resolution Training Method for Neural Radiance Fields
par: Feng, Xiang, et autres
Publié: (2023)
par: Feng, Xiang, et autres
Publié: (2023)
Neural Texture Splatting: Expressive 3D Gaussian Splatting for View Synthesis, Geometry, and Dynamic Reconstruction
par: Wang, Yiming, et autres
Publié: (2025)
par: Wang, Yiming, et autres
Publié: (2025)
Pano2Room: Novel View Synthesis from a Single Indoor Panorama
par: Pu, Guo, et autres
Publié: (2024)
par: Pu, Guo, et autres
Publié: (2024)
Surf-D: Generating High-Quality Surfaces of Arbitrary Topologies Using Diffusion Models
par: Yu, Zhengming, et autres
Publié: (2023)
par: Yu, Zhengming, et autres
Publié: (2023)
ObjectMover: Generative Object Movement with Video Prior
par: Yu, Xin, et autres
Publié: (2025)
par: Yu, Xin, et autres
Publié: (2025)
InterMimic: Towards Universal Whole-Body Control for Physics-Based Human-Object Interactions
par: Xu, Sirui, et autres
Publié: (2025)
par: Xu, Sirui, et autres
Publié: (2025)
Portrait Video Editing Empowered by Multimodal Generative Priors
par: Gao, Xuan, et autres
Publié: (2024)
par: Gao, Xuan, et autres
Publié: (2024)
Documents similaires
-
SIMS: Simulating Stylized Human-Scene Interactions with Retrieval-Augmented Script Generation
par: Wang, Wenjia, et autres
Publié: (2024) -
RMD: A Simple Baseline for More General Human Motion Generation via Training-free Retrieval-Augmented Motion Diffuse
par: Liao, Zhouyingcheng, et autres
Publié: (2024) -
CBIL: Collective Behavior Imitation Learning for Fish from Real Videos
par: Wu, Yifan, et autres
Publié: (2025) -
EgoGrasp: World-Space Hand-Object Interaction Estimation from Egocentric Videos
par: Fu, Hongming, et autres
Publié: (2026) -
TLControl: Trajectory and Language Control for Human Motion Synthesis
par: Wan, Weilin, et autres
Publié: (2023)