Beyond Inpainting: Unleash 3D Understanding for Precise Camera-Controlled Video Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Dong-Yu, Guo, Yixin, Yang, Shuojin, Mu, Tai-Jiang, Hu, Shi-Min |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control
por: Ren, Xuanchi, et al.
Publicado: (2025)
por: Ren, Xuanchi, et al.
Publicado: (2025)
Transformer-Based Inpainting for Real-Time 3D Streaming in Sparse Multi-Camera Setups
por: Van Holland, Leif, et al.
Publicado: (2026)
por: Van Holland, Leif, et al.
Publicado: (2026)
Taming Video Models for 3D and 4D Generation via Zero-Shot Camera Control
por: Song, Chenxi, et al.
Publicado: (2025)
por: Song, Chenxi, et al.
Publicado: (2025)
See4D: Pose-Free 4D Generation via Auto-Regressive Video Inpainting
por: Lu, Dongyue, et al.
Publicado: (2025)
por: Lu, Dongyue, et al.
Publicado: (2025)
Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control
por: Kuang, Zhengfei, et al.
Publicado: (2024)
por: Kuang, Zhengfei, et al.
Publicado: (2024)
A New Split Algorithm for 3D Gaussian Splatting
por: Feng, Qiyuan, et al.
Publicado: (2024)
por: Feng, Qiyuan, et al.
Publicado: (2024)
Agentic 3D Scene Generation with Spatially Contextualized VLMs
por: Liu, Xinhang, et al.
Publicado: (2025)
por: Liu, Xinhang, et al.
Publicado: (2025)
Do Inpainting Yourself: Generative Facial Inpainting Guided by Exemplars
por: Lu, Wanglong, et al.
Publicado: (2022)
por: Lu, Wanglong, et al.
Publicado: (2022)
Real-time 3D-aware Portrait Video Relighting
por: Cai, Ziqi, et al.
Publicado: (2024)
por: Cai, Ziqi, et al.
Publicado: (2024)
Instant3dit: Multiview Inpainting for Fast Editing of 3D Objects
por: Barda, Amir, et al.
Publicado: (2024)
por: Barda, Amir, et al.
Publicado: (2024)
Coin3D: Controllable and Interactive 3D Assets Generation with Proxy-Guided Conditioning
por: Dong, Wenqi, et al.
Publicado: (2024)
por: Dong, Wenqi, et al.
Publicado: (2024)
Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control
por: Gu, Zekai, et al.
Publicado: (2025)
por: Gu, Zekai, et al.
Publicado: (2025)
RI3D: Few-Shot Gaussian Splatting With Repair and Inpainting Diffusion Priors
por: Paliwal, Avinash, et al.
Publicado: (2025)
por: Paliwal, Avinash, et al.
Publicado: (2025)
Image Sculpting: Precise Object Editing with 3D Geometry Control
por: Yenphraphai, Jiraphon, et al.
Publicado: (2024)
por: Yenphraphai, Jiraphon, et al.
Publicado: (2024)
Motion-2-To-3: Leveraging 2D Motion Data for 3D Motion Generations
por: Guo, Ruoxi, et al.
Publicado: (2024)
por: Guo, Ruoxi, et al.
Publicado: (2024)
LoD-Structured 3D Gaussian Splatting for Streaming Video Reconstruction
por: Liu, Xinhui, et al.
Publicado: (2026)
por: Liu, Xinhui, et al.
Publicado: (2026)
Controllable Video Generation: A Survey
por: Ma, Yue, et al.
Publicado: (2025)
por: Ma, Yue, et al.
Publicado: (2025)
FantasyID: Face Knowledge Enhanced ID-Preserving Video Generation
por: Zhang, Yunpeng, et al.
Publicado: (2025)
por: Zhang, Yunpeng, et al.
Publicado: (2025)
Content-aware Tile Generation using Exterior Boundary Inpainting
por: Sartor, Sam, et al.
Publicado: (2024)
por: Sartor, Sam, et al.
Publicado: (2024)
VisionGPT-3D: A Generalized Multimodal Agent for Enhanced 3D Vision Understanding
por: Kelly, Chris, et al.
Publicado: (2024)
por: Kelly, Chris, et al.
Publicado: (2024)
Generating 360° Video is What You Need For a 3D Scene
por: Zhang, Zhaoyang, et al.
Publicado: (2025)
por: Zhang, Zhaoyang, et al.
Publicado: (2025)
DragVideo: Interactive Drag-style Video Editing
por: Deng, Yufan, et al.
Publicado: (2023)
por: Deng, Yufan, et al.
Publicado: (2023)
Sketch3DVE: Sketch-based 3D-Aware Scene Video Editing
por: Liu, Feng-Lin, et al.
Publicado: (2025)
por: Liu, Feng-Lin, et al.
Publicado: (2025)
Edit360: 2D Image Edits to 3D Assets from Any Angle
por: Huang, Junchao, et al.
Publicado: (2025)
por: Huang, Junchao, et al.
Publicado: (2025)
iDiT-HOI: Inpainting-based Hand Object Interaction Reenactment via Video Diffusion Transformer
por: Shen, Zhelun, et al.
Publicado: (2025)
por: Shen, Zhelun, et al.
Publicado: (2025)
MoZoo:Unleashing Video Diffusion power in animal fur and muscle simulation
por: Liu, Dongxia, et al.
Publicado: (2026)
por: Liu, Dongxia, et al.
Publicado: (2026)
Graph Canvas for Controllable 3D Scene Generation
por: Liu, Libin, et al.
Publicado: (2024)
por: Liu, Libin, et al.
Publicado: (2024)
LiftImage3D: Lifting Any Single Image to 3D Gaussians with Video Generation Priors
por: Chen, Yabo, et al.
Publicado: (2024)
por: Chen, Yabo, et al.
Publicado: (2024)
MeshLLM: Empowering Large Language Models to Progressively Understand and Generate 3D Mesh
por: Fang, Shuangkang, et al.
Publicado: (2025)
por: Fang, Shuangkang, et al.
Publicado: (2025)
EgoForce: Forearm-Guided Camera-Space 3D Hand Pose from a Monocular Egocentric Camera
por: Millerdurai, Christen, et al.
Publicado: (2026)
por: Millerdurai, Christen, et al.
Publicado: (2026)
Generic 3D Diffusion Adapter Using Controlled Multi-View Editing
por: Chen, Hansheng, et al.
Publicado: (2024)
por: Chen, Hansheng, et al.
Publicado: (2024)
ROAR-3D: Routing Arbitrary Views for High-Fidelity 3D Generation
por: Sun, Hanxiao, et al.
Publicado: (2026)
por: Sun, Hanxiao, et al.
Publicado: (2026)
ReCapture: Generative Video Camera Controls for User-Provided Videos using Masked Video Fine-Tuning
por: Zhang, David Junhao, et al.
Publicado: (2024)
por: Zhang, David Junhao, et al.
Publicado: (2024)
Augmented Radiance Field: A General Framework for Enhanced Gaussian Splatting
por: Yang, Yixin, et al.
Publicado: (2026)
por: Yang, Yixin, et al.
Publicado: (2026)
RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion
por: Shriram, Jaidev, et al.
Publicado: (2024)
por: Shriram, Jaidev, et al.
Publicado: (2024)
PrEditor3D: Fast and Precise 3D Shape Editing
por: Erkoç, Ziya, et al.
Publicado: (2024)
por: Erkoç, Ziya, et al.
Publicado: (2024)
ARM: Appearance Reconstruction Model for Relightable 3D Generation
por: Feng, Xiang, et al.
Publicado: (2024)
por: Feng, Xiang, et al.
Publicado: (2024)
Portrait Video Editing Empowered by Multimodal Generative Priors
por: Gao, Xuan, et al.
Publicado: (2024)
por: Gao, Xuan, et al.
Publicado: (2024)
TANGLED: Generating 3D Hair Strands from Images with Arbitrary Styles and Viewpoints
por: Long, Pengyu, et al.
Publicado: (2025)
por: Long, Pengyu, et al.
Publicado: (2025)
Lyra: Generative 3D Scene Reconstruction via Video Diffusion Model Self-Distillation
por: Bahmani, Sherwin, et al.
Publicado: (2025)
por: Bahmani, Sherwin, et al.
Publicado: (2025)
Ejemplares similares
-
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control
por: Ren, Xuanchi, et al.
Publicado: (2025) -
Transformer-Based Inpainting for Real-Time 3D Streaming in Sparse Multi-Camera Setups
por: Van Holland, Leif, et al.
Publicado: (2026) -
Taming Video Models for 3D and 4D Generation via Zero-Shot Camera Control
por: Song, Chenxi, et al.
Publicado: (2025) -
See4D: Pose-Free 4D Generation via Auto-Regressive Video Inpainting
por: Lu, Dongyue, et al.
Publicado: (2025) -
Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control
por: Kuang, Zhengfei, et al.
Publicado: (2024)