Beyond Inpainting: Unleash 3D Understanding for Precise Camera-Controlled Video Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Dong-Yu, Guo, Yixin, Yang, Shuojin, Mu, Tai-Jiang, Hu, Shi-Min |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control
par: Ren, Xuanchi, et autres
Publié: (2025)
par: Ren, Xuanchi, et autres
Publié: (2025)
Transformer-Based Inpainting for Real-Time 3D Streaming in Sparse Multi-Camera Setups
par: Van Holland, Leif, et autres
Publié: (2026)
par: Van Holland, Leif, et autres
Publié: (2026)
Taming Video Models for 3D and 4D Generation via Zero-Shot Camera Control
par: Song, Chenxi, et autres
Publié: (2025)
par: Song, Chenxi, et autres
Publié: (2025)
See4D: Pose-Free 4D Generation via Auto-Regressive Video Inpainting
par: Lu, Dongyue, et autres
Publié: (2025)
par: Lu, Dongyue, et autres
Publié: (2025)
Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control
par: Kuang, Zhengfei, et autres
Publié: (2024)
par: Kuang, Zhengfei, et autres
Publié: (2024)
A New Split Algorithm for 3D Gaussian Splatting
par: Feng, Qiyuan, et autres
Publié: (2024)
par: Feng, Qiyuan, et autres
Publié: (2024)
Agentic 3D Scene Generation with Spatially Contextualized VLMs
par: Liu, Xinhang, et autres
Publié: (2025)
par: Liu, Xinhang, et autres
Publié: (2025)
Do Inpainting Yourself: Generative Facial Inpainting Guided by Exemplars
par: Lu, Wanglong, et autres
Publié: (2022)
par: Lu, Wanglong, et autres
Publié: (2022)
Real-time 3D-aware Portrait Video Relighting
par: Cai, Ziqi, et autres
Publié: (2024)
par: Cai, Ziqi, et autres
Publié: (2024)
Instant3dit: Multiview Inpainting for Fast Editing of 3D Objects
par: Barda, Amir, et autres
Publié: (2024)
par: Barda, Amir, et autres
Publié: (2024)
Coin3D: Controllable and Interactive 3D Assets Generation with Proxy-Guided Conditioning
par: Dong, Wenqi, et autres
Publié: (2024)
par: Dong, Wenqi, et autres
Publié: (2024)
Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control
par: Gu, Zekai, et autres
Publié: (2025)
par: Gu, Zekai, et autres
Publié: (2025)
RI3D: Few-Shot Gaussian Splatting With Repair and Inpainting Diffusion Priors
par: Paliwal, Avinash, et autres
Publié: (2025)
par: Paliwal, Avinash, et autres
Publié: (2025)
Image Sculpting: Precise Object Editing with 3D Geometry Control
par: Yenphraphai, Jiraphon, et autres
Publié: (2024)
par: Yenphraphai, Jiraphon, et autres
Publié: (2024)
Motion-2-To-3: Leveraging 2D Motion Data for 3D Motion Generations
par: Guo, Ruoxi, et autres
Publié: (2024)
par: Guo, Ruoxi, et autres
Publié: (2024)
LoD-Structured 3D Gaussian Splatting for Streaming Video Reconstruction
par: Liu, Xinhui, et autres
Publié: (2026)
par: Liu, Xinhui, et autres
Publié: (2026)
Controllable Video Generation: A Survey
par: Ma, Yue, et autres
Publié: (2025)
par: Ma, Yue, et autres
Publié: (2025)
FantasyID: Face Knowledge Enhanced ID-Preserving Video Generation
par: Zhang, Yunpeng, et autres
Publié: (2025)
par: Zhang, Yunpeng, et autres
Publié: (2025)
Content-aware Tile Generation using Exterior Boundary Inpainting
par: Sartor, Sam, et autres
Publié: (2024)
par: Sartor, Sam, et autres
Publié: (2024)
VisionGPT-3D: A Generalized Multimodal Agent for Enhanced 3D Vision Understanding
par: Kelly, Chris, et autres
Publié: (2024)
par: Kelly, Chris, et autres
Publié: (2024)
Generating 360° Video is What You Need For a 3D Scene
par: Zhang, Zhaoyang, et autres
Publié: (2025)
par: Zhang, Zhaoyang, et autres
Publié: (2025)
DragVideo: Interactive Drag-style Video Editing
par: Deng, Yufan, et autres
Publié: (2023)
par: Deng, Yufan, et autres
Publié: (2023)
Sketch3DVE: Sketch-based 3D-Aware Scene Video Editing
par: Liu, Feng-Lin, et autres
Publié: (2025)
par: Liu, Feng-Lin, et autres
Publié: (2025)
Edit360: 2D Image Edits to 3D Assets from Any Angle
par: Huang, Junchao, et autres
Publié: (2025)
par: Huang, Junchao, et autres
Publié: (2025)
iDiT-HOI: Inpainting-based Hand Object Interaction Reenactment via Video Diffusion Transformer
par: Shen, Zhelun, et autres
Publié: (2025)
par: Shen, Zhelun, et autres
Publié: (2025)
MoZoo:Unleashing Video Diffusion power in animal fur and muscle simulation
par: Liu, Dongxia, et autres
Publié: (2026)
par: Liu, Dongxia, et autres
Publié: (2026)
Graph Canvas for Controllable 3D Scene Generation
par: Liu, Libin, et autres
Publié: (2024)
par: Liu, Libin, et autres
Publié: (2024)
LiftImage3D: Lifting Any Single Image to 3D Gaussians with Video Generation Priors
par: Chen, Yabo, et autres
Publié: (2024)
par: Chen, Yabo, et autres
Publié: (2024)
MeshLLM: Empowering Large Language Models to Progressively Understand and Generate 3D Mesh
par: Fang, Shuangkang, et autres
Publié: (2025)
par: Fang, Shuangkang, et autres
Publié: (2025)
EgoForce: Forearm-Guided Camera-Space 3D Hand Pose from a Monocular Egocentric Camera
par: Millerdurai, Christen, et autres
Publié: (2026)
par: Millerdurai, Christen, et autres
Publié: (2026)
Generic 3D Diffusion Adapter Using Controlled Multi-View Editing
par: Chen, Hansheng, et autres
Publié: (2024)
par: Chen, Hansheng, et autres
Publié: (2024)
ROAR-3D: Routing Arbitrary Views for High-Fidelity 3D Generation
par: Sun, Hanxiao, et autres
Publié: (2026)
par: Sun, Hanxiao, et autres
Publié: (2026)
ReCapture: Generative Video Camera Controls for User-Provided Videos using Masked Video Fine-Tuning
par: Zhang, David Junhao, et autres
Publié: (2024)
par: Zhang, David Junhao, et autres
Publié: (2024)
Augmented Radiance Field: A General Framework for Enhanced Gaussian Splatting
par: Yang, Yixin, et autres
Publié: (2026)
par: Yang, Yixin, et autres
Publié: (2026)
RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion
par: Shriram, Jaidev, et autres
Publié: (2024)
par: Shriram, Jaidev, et autres
Publié: (2024)
PrEditor3D: Fast and Precise 3D Shape Editing
par: Erkoç, Ziya, et autres
Publié: (2024)
par: Erkoç, Ziya, et autres
Publié: (2024)
ARM: Appearance Reconstruction Model for Relightable 3D Generation
par: Feng, Xiang, et autres
Publié: (2024)
par: Feng, Xiang, et autres
Publié: (2024)
Portrait Video Editing Empowered by Multimodal Generative Priors
par: Gao, Xuan, et autres
Publié: (2024)
par: Gao, Xuan, et autres
Publié: (2024)
TANGLED: Generating 3D Hair Strands from Images with Arbitrary Styles and Viewpoints
par: Long, Pengyu, et autres
Publié: (2025)
par: Long, Pengyu, et autres
Publié: (2025)
Lyra: Generative 3D Scene Reconstruction via Video Diffusion Model Self-Distillation
par: Bahmani, Sherwin, et autres
Publié: (2025)
par: Bahmani, Sherwin, et autres
Publié: (2025)
Documents similaires
-
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control
par: Ren, Xuanchi, et autres
Publié: (2025) -
Transformer-Based Inpainting for Real-Time 3D Streaming in Sparse Multi-Camera Setups
par: Van Holland, Leif, et autres
Publié: (2026) -
Taming Video Models for 3D and 4D Generation via Zero-Shot Camera Control
par: Song, Chenxi, et autres
Publié: (2025) -
See4D: Pose-Free 4D Generation via Auto-Regressive Video Inpainting
par: Lu, Dongyue, et autres
Publié: (2025) -
Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control
par: Kuang, Zhengfei, et autres
Publié: (2024)