CamCtrl3D: Single-Image Scene Exploration with Precise 3D Camera Control
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Popov, Stefan, Raj, Amit, Krainin, Michael, Li, Yuanzhen, Freeman, William T., Rubinstein, Michael |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation
par: Xu, Dejia, et autres
Publié: (2024)
par: Xu, Dejia, et autres
Publié: (2024)
CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models
par: He, Hao, et autres
Publié: (2025)
par: He, Hao, et autres
Publié: (2025)
3D Congealing: 3D-Aware Image Alignment in the Wild
par: Zhang, Yunzhi, et autres
Publié: (2024)
par: Zhang, Yunzhi, et autres
Publié: (2024)
Probing the 3D Awareness of Visual Foundation Models
par: Banani, Mohamed El, et autres
Publié: (2024)
par: Banani, Mohamed El, et autres
Publié: (2024)
DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation
par: Zhang, Hongfei, et autres
Publié: (2025)
par: Zhang, Hongfei, et autres
Publié: (2025)
PreciseCam: Precise Camera Control for Text-to-Image Generation
par: Bernal-Berdun, Edurne, et autres
Publié: (2025)
par: Bernal-Berdun, Edurne, et autres
Publié: (2025)
WonderWorld: Interactive 3D Scene Generation from a Single Image
par: Yu, Hong-Xing, et autres
Publié: (2024)
par: Yu, Hong-Xing, et autres
Publié: (2024)
CameraCtrl: Enabling Camera Control for Text-to-Video Generation
par: He, Hao, et autres
Publié: (2024)
par: He, Hao, et autres
Publié: (2024)
ObjCtrl-2.5D: Training-free Object Control with Camera Poses
par: Wang, Zhouxia, et autres
Publié: (2024)
par: Wang, Zhouxia, et autres
Publié: (2024)
DanceCamAnimator: Keyframe-Based Controllable 3D Dance Camera Synthesis
par: Wang, Zixuan, et autres
Publié: (2024)
par: Wang, Zixuan, et autres
Publié: (2024)
ConfCtrl: Enabling Precise Camera Control in Video Diffusion via Confidence-Aware Interpolation
par: Yang, Liudi, et autres
Publié: (2026)
par: Yang, Liudi, et autres
Publié: (2026)
3D Scene Prompting for Scene-Consistent Camera-Controllable Video Generation
par: Lee, JoungBin, et autres
Publié: (2025)
par: Lee, JoungBin, et autres
Publié: (2025)
3D Scene-Camera Representation with Joint Camera Photometric Optimization
par: Dai, Weichen, et autres
Publié: (2025)
par: Dai, Weichen, et autres
Publié: (2025)
Scene4U: Hierarchical Layered 3D Scene Reconstruction from Single Panoramic Image for Your Immerse Exploration
par: Huang, Zilong, et autres
Publié: (2025)
par: Huang, Zilong, et autres
Publié: (2025)
Ctrl-Room: Controllable Text-to-3D Room Meshes Generation with Layout Constraints
par: Fang, Chuan, et autres
Publié: (2023)
par: Fang, Chuan, et autres
Publié: (2023)
CC-FMO: Camera-Conditioned Zero-Shot Single Image to 3D Scene Generation with Foundation Model Orchestration
par: Tang, Boshi, et autres
Publié: (2025)
par: Tang, Boshi, et autres
Publié: (2025)
Efficient Hybrid Zoom using Camera Fusion on Mobile Phones
par: Wu, Xiaotong, et autres
Publié: (2024)
par: Wu, Xiaotong, et autres
Publié: (2024)
ReCamMaster: Camera-Controlled Generative Rendering from A Single Video
par: Bai, Jianhong, et autres
Publié: (2025)
par: Bai, Jianhong, et autres
Publié: (2025)
ActCam: Zero-Shot Joint Camera and 3D Motion Control for Video Generation
par: Khalifi, Omar El, et autres
Publié: (2026)
par: Khalifi, Omar El, et autres
Publié: (2026)
CamI2V: Camera-Controlled Image-to-Video Diffusion Model
par: Zheng, Guangcong, et autres
Publié: (2024)
par: Zheng, Guangcong, et autres
Publié: (2024)
LiCamPose: Combining Multi-View LiDAR and RGB Cameras for Robust Single-timestamp 3D Human Pose Estimation
par: Pan, Zhiyu, et autres
Publié: (2023)
par: Pan, Zhiyu, et autres
Publié: (2023)
REST3D: Reconstructing Physically Stable 3D Scenes from a Single Image
par: Ma, Xiaoxuan, et autres
Publié: (2026)
par: Ma, Xiaoxuan, et autres
Publié: (2026)
WorldCam: Interactive Autoregressive 3D Gaming Worlds with Camera Pose as a Unifying Geometric Representation
par: Nam, Jisu, et autres
Publié: (2026)
par: Nam, Jisu, et autres
Publié: (2026)
Wonderland: Navigating 3D Scenes from a Single Image
par: Liang, Hanwen, et autres
Publié: (2024)
par: Liang, Hanwen, et autres
Publié: (2024)
VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control
par: Bahmani, Sherwin, et autres
Publié: (2024)
par: Bahmani, Sherwin, et autres
Publié: (2024)
Director3D: Real-world Camera Trajectory and 3D Scene Generation from Text
par: Li, Xinyang, et autres
Publié: (2024)
par: Li, Xinyang, et autres
Publié: (2024)
3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning
par: Yang, Yuncong, et autres
Publié: (2024)
par: Yang, Yuncong, et autres
Publié: (2024)
Uni3C: Unifying Precisely 3D-Enhanced Camera and Human Motion Controls for Video Generation
par: Cao, Chenjie, et autres
Publié: (2025)
par: Cao, Chenjie, et autres
Publié: (2025)
Beyond Inpainting: Unleash 3D Understanding for Precise Camera-Controlled Video Generation
par: Chen, Dong-Yu, et autres
Publié: (2026)
par: Chen, Dong-Yu, et autres
Publié: (2026)
TrafficLoc: Localizing Traffic Surveillance Cameras in 3D Scenes
par: Xia, Yan, et autres
Publié: (2024)
par: Xia, Yan, et autres
Publié: (2024)
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
par: Zeng, Weichao, et autres
Publié: (2024)
par: Zeng, Weichao, et autres
Publié: (2024)
LET-3D-AP: Longitudinal Error Tolerant 3D Average Precision for Camera-Only 3D Detection
par: Hung, Wei-Chih, et autres
Publié: (2022)
par: Hung, Wei-Chih, et autres
Publié: (2022)
Ctrl-Z Sampling: Scaling Diffusion Sampling with Controlled Random Zigzag Explorations
par: Mao, Shunqi, et autres
Publié: (2025)
par: Mao, Shunqi, et autres
Publié: (2025)
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control
par: Ren, Xuanchi, et autres
Publié: (2025)
par: Ren, Xuanchi, et autres
Publié: (2025)
Flash3D: Feed-Forward Generalisable 3D Scene Reconstruction from a Single Image
par: Szymanowicz, Stanislaw, et autres
Publié: (2024)
par: Szymanowicz, Stanislaw, et autres
Publié: (2024)
3D-Fixer: Coarse-to-Fine In-place Completion for 3D Scenes from a Single Image
par: Yin, Ze-Xin, et autres
Publié: (2026)
par: Yin, Ze-Xin, et autres
Publié: (2026)
EmoCtrl: Controllable Emotional Image Content Generation
par: Yang, Jingyuan, et autres
Publié: (2025)
par: Yang, Jingyuan, et autres
Publié: (2025)
Pixel-to-4D: Camera-Controlled Image-to-Video Generation with Dynamic 3D Gaussians
par: de Almeida, Melonie, et autres
Publié: (2026)
par: de Almeida, Melonie, et autres
Publié: (2026)
Pow3R: Empowering Unconstrained 3D Reconstruction with Camera and Scene Priors
par: Jang, Wonbong, et autres
Publié: (2025)
par: Jang, Wonbong, et autres
Publié: (2025)
Efficient Camera-Controlled Video Generation of Static Scenes via Sparse Diffusion and 3D Rendering
par: Chen, Jieying, et autres
Publié: (2026)
par: Chen, Jieying, et autres
Publié: (2026)
Documents similaires
-
CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation
par: Xu, Dejia, et autres
Publié: (2024) -
CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models
par: He, Hao, et autres
Publié: (2025) -
3D Congealing: 3D-Aware Image Alignment in the Wild
par: Zhang, Yunzhi, et autres
Publié: (2024) -
Probing the 3D Awareness of Visual Foundation Models
par: Banani, Mohamed El, et autres
Publié: (2024) -
DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation
par: Zhang, Hongfei, et autres
Publié: (2025)