Uni3C: Unifying Precisely 3D-Enhanced Camera and Human Motion Controls for Video Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cao, Chenjie, Zhou, Jingkai, Li, Shikai, Liang, Jingyun, Yu, Chaohui, Wang, Fan, Xue, Xiangyang, Fu, Yanwei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RealisMotion: Decomposed Human Motion Control and Video Generation in the World Space
par: Liang, Jingyun, et autres
Publié: (2025)
par: Liang, Jingyun, et autres
Publié: (2025)
MVInpainter: Learning Multi-View Consistent Inpainting to Bridge 2D and 3D Editing
par: Cao, Chenjie, et autres
Publié: (2024)
par: Cao, Chenjie, et autres
Publié: (2024)
MVGenMaster: Scaling Multi-View Generation from Any Image via 3D Priors Enhanced Diffusion Model
par: Cao, Chenjie, et autres
Publié: (2024)
par: Cao, Chenjie, et autres
Publié: (2024)
SC4D: Sparse-Controlled Video-to-4D Generation and Motion Transfer
par: Wu, Zijie, et autres
Publié: (2024)
par: Wu, Zijie, et autres
Publié: (2024)
Towards 3D-Aware Video Diffusion Models: Render-Free Human Motion Control with Mesh Tokenization
par: Liang, Jingyun, et autres
Publié: (2026)
par: Liang, Jingyun, et autres
Publié: (2026)
3DV-TON: Textured 3D-Guided Consistent Video Try-on via Diffusion Models
par: Wei, Min, et autres
Publié: (2025)
par: Wei, Min, et autres
Publié: (2025)
Improving Neural Surface Reconstruction with Feature Priors from Multi-View Image
par: Ren, Xinlin, et autres
Publié: (2024)
par: Ren, Xinlin, et autres
Publié: (2024)
Towards Enhanced Image Inpainting: Mitigating Unwanted Object Insertion and Preserving Color Consistency
par: Wang, Yikai, et autres
Publié: (2023)
par: Wang, Yikai, et autres
Publié: (2023)
LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion
par: Zhang, Yisu, et autres
Publié: (2025)
par: Zhang, Yisu, et autres
Publié: (2025)
Animate3D: Animating Any 3D Model with Multi-view Video Diffusion
par: Jiang, Yanqin, et autres
Publié: (2024)
par: Jiang, Yanqin, et autres
Publié: (2024)
AnyRefill: A Unified, Data-Efficient Framework for Left-Prompt-Guided Vision Tasks
par: Xie, Ming, et autres
Publié: (2025)
par: Xie, Ming, et autres
Publié: (2025)
Aligned Stable Inpainting: Mitigating Unwanted Object Insertion and Preserving Color Consistency
par: Wang, Yikai, et autres
Publié: (2026)
par: Wang, Yikai, et autres
Publié: (2026)
VCD-Texture: Variance Alignment based 3D-2D Co-Denoising for Text-Guided Texturing
par: Liu, Shang, et autres
Publié: (2024)
par: Liu, Shang, et autres
Publié: (2024)
ActiveVLA: Injecting Active Perception into Vision-Language-Action Models for Precise 3D Robotic Manipulation
par: Liu, Zhenyang, et autres
Publié: (2026)
par: Liu, Zhenyang, et autres
Publié: (2026)
UniMo: Unifying 2D Video and 3D Human Motion with an Autoregressive Framework
par: Pang, Youxin, et autres
Publié: (2025)
par: Pang, Youxin, et autres
Publié: (2025)
Repositioning the Subject within Image
par: Wang, Yikai, et autres
Publié: (2024)
par: Wang, Yikai, et autres
Publié: (2024)
EarthCrafter: Scalable 3D Earth Generation via Dual-Sparse Latent Diffusion
par: Liu, Shang, et autres
Publié: (2025)
par: Liu, Shang, et autres
Publié: (2025)
Enhancing Video Inpainting with Aligned Frame Interval Guidance
par: Xie, Ming, et autres
Publié: (2025)
par: Xie, Ming, et autres
Publié: (2025)
Uni-Inter: Unifying 3D Human Motion Synthesis Across Diverse Interaction Contexts
par: Liu, Sheng, et autres
Publié: (2025)
par: Liu, Sheng, et autres
Publié: (2025)
MVSFormer++: Revealing the Devil in Transformer's Details for Multi-View Stereo
par: Cao, Chenjie, et autres
Publié: (2024)
par: Cao, Chenjie, et autres
Publié: (2024)
VidCRAFT3: Camera, Object, and Lighting Control for Image-to-Video Generation
par: Zheng, Sixiao, et autres
Publié: (2025)
par: Zheng, Sixiao, et autres
Publié: (2025)
I2VControl-Camera: Precise Video Camera Control with Adjustable Motion Strength
par: Feng, Wanquan, et autres
Publié: (2024)
par: Feng, Wanquan, et autres
Publié: (2024)
OCRA: Object-Centric Learning with 3D and Tactile Priors for Human-to-Robot Action Transfer
par: Wang, Kuanning, et autres
Publié: (2026)
par: Wang, Kuanning, et autres
Publié: (2026)
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control
par: Ren, Xuanchi, et autres
Publié: (2025)
par: Ren, Xuanchi, et autres
Publié: (2025)
CamPVG: Camera-Controlled Panoramic Video Generation with Epipolar-Aware Diffusion
par: Ji, Chenhao, et autres
Publié: (2025)
par: Ji, Chenhao, et autres
Publié: (2025)
CAP-Net: A Unified Network for 6D Pose and Size Estimation of Categorical Articulated Parts from a Single RGB-D Image
par: Huang, Jingshun, et autres
Publié: (2025)
par: Huang, Jingshun, et autres
Publié: (2025)
WorldStereo: Bridging Camera-Guided Video Generation and Scene Reconstruction via 3D Geometric Memories
par: Zhang, Yisu, et autres
Publié: (2026)
par: Zhang, Yisu, et autres
Publié: (2026)
UniScene: Multi-Camera Unified Pre-training via 3D Scene Reconstruction for Autonomous Driving
par: Min, Chen, et autres
Publié: (2023)
par: Min, Chen, et autres
Publié: (2023)
A Neural Representation Framework with LLM-Driven Spatial Reasoning for Open-Vocabulary 3D Visual Grounding
par: Liu, Zhenyang, et autres
Publié: (2025)
par: Liu, Zhenyang, et autres
Publié: (2025)
ReasonGrounder: LVLM-Guided Hierarchical Feature Splatting for Open-Vocabulary 3D Visual Grounding and Reasoning
par: Liu, Zhenyang, et autres
Publié: (2025)
par: Liu, Zhenyang, et autres
Publié: (2025)
UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models
par: Jiang, Hong, et autres
Publié: (2026)
par: Jiang, Hong, et autres
Publié: (2026)
Beyond Inpainting: Unleash 3D Understanding for Precise Camera-Controlled Video Generation
par: Chen, Dong-Yu, et autres
Publié: (2026)
par: Chen, Dong-Yu, et autres
Publié: (2026)
TriVLA: A Triple-System-Based Unified Vision-Language-Action Model with Episodic World Modeling for General Robot Control
par: Liu, Zhenyang, et autres
Publié: (2025)
par: Liu, Zhenyang, et autres
Publié: (2025)
3D Skew-Normal Splatting
par: Wu, Xiangru, et autres
Publié: (2026)
par: Wu, Xiangru, et autres
Publié: (2026)
UniDB: A Unified Diffusion Bridge Framework via Stochastic Optimal Control
par: Zhu, Kaizhen, et autres
Publié: (2025)
par: Zhu, Kaizhen, et autres
Publié: (2025)
InfiniHuman: Infinite 3D Human Creation with Precise Control
par: Xue, Yuxuan, et autres
Publié: (2025)
par: Xue, Yuxuan, et autres
Publié: (2025)
You Only Estimate Once: Unified, One-stage, Real-Time Category-level Articulated Object 6D Pose Estimation for Robotic Grasping
par: Huang, Jingshun, et autres
Publié: (2025)
par: Huang, Jingshun, et autres
Publié: (2025)
MoVideo: Motion-Aware Video Generation with Diffusion Models
par: Liang, Jingyun, et autres
Publié: (2023)
par: Liang, Jingyun, et autres
Publié: (2023)
ActCam: Zero-Shot Joint Camera and 3D Motion Control for Video Generation
par: Khalifi, Omar El, et autres
Publié: (2026)
par: Khalifi, Omar El, et autres
Publié: (2026)
UniK3D: Universal Camera Monocular 3D Estimation
par: Piccinelli, Luigi, et autres
Publié: (2025)
par: Piccinelli, Luigi, et autres
Publié: (2025)
Documents similaires
-
RealisMotion: Decomposed Human Motion Control and Video Generation in the World Space
par: Liang, Jingyun, et autres
Publié: (2025) -
MVInpainter: Learning Multi-View Consistent Inpainting to Bridge 2D and 3D Editing
par: Cao, Chenjie, et autres
Publié: (2024) -
MVGenMaster: Scaling Multi-View Generation from Any Image via 3D Priors Enhanced Diffusion Model
par: Cao, Chenjie, et autres
Publié: (2024) -
SC4D: Sparse-Controlled Video-to-4D Generation and Motion Transfer
par: Wu, Zijie, et autres
Publié: (2024) -
Towards 3D-Aware Video Diffusion Models: Render-Free Human Motion Control with Mesh Tokenization
par: Liang, Jingyun, et autres
Publié: (2026)