Guardado en:
| Autores principales: | Popov, Stefan, Raj, Amit, Krainin, Michael, Li, Yuanzhen, Freeman, William T., Rubinstein, Michael |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2501.06006 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Probing the 3D Awareness of Visual Foundation Models
por: Banani, Mohamed El, et al.
Publicado: (2024)
por: Banani, Mohamed El, et al.
Publicado: (2024)
3D Congealing: 3D-Aware Image Alignment in the Wild
por: Zhang, Yunzhi, et al.
Publicado: (2024)
por: Zhang, Yunzhi, et al.
Publicado: (2024)
CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models
por: He, Hao, et al.
Publicado: (2025)
por: He, Hao, et al.
Publicado: (2025)
CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation
por: Xu, Dejia, et al.
Publicado: (2024)
por: Xu, Dejia, et al.
Publicado: (2024)
DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation
por: Zhang, Hongfei, et al.
Publicado: (2025)
por: Zhang, Hongfei, et al.
Publicado: (2025)
PreciseCam: Precise Camera Control for Text-to-Image Generation
por: Bernal-Berdun, Edurne, et al.
Publicado: (2025)
por: Bernal-Berdun, Edurne, et al.
Publicado: (2025)
WonderWorld: Interactive 3D Scene Generation from a Single Image
por: Yu, Hong-Xing, et al.
Publicado: (2024)
por: Yu, Hong-Xing, et al.
Publicado: (2024)
CameraCtrl: Enabling Camera Control for Text-to-Video Generation
por: He, Hao, et al.
Publicado: (2024)
por: He, Hao, et al.
Publicado: (2024)
ObjCtrl-2.5D: Training-free Object Control with Camera Poses
por: Wang, Zhouxia, et al.
Publicado: (2024)
por: Wang, Zhouxia, et al.
Publicado: (2024)
DanceCamAnimator: Keyframe-Based Controllable 3D Dance Camera Synthesis
por: Wang, Zixuan, et al.
Publicado: (2024)
por: Wang, Zixuan, et al.
Publicado: (2024)
ConfCtrl: Enabling Precise Camera Control in Video Diffusion via Confidence-Aware Interpolation
por: Yang, Liudi, et al.
Publicado: (2026)
por: Yang, Liudi, et al.
Publicado: (2026)
3D Scene Prompting for Scene-Consistent Camera-Controllable Video Generation
por: Lee, JoungBin, et al.
Publicado: (2025)
por: Lee, JoungBin, et al.
Publicado: (2025)
Efficient Hybrid Zoom using Camera Fusion on Mobile Phones
por: Wu, Xiaotong, et al.
Publicado: (2024)
por: Wu, Xiaotong, et al.
Publicado: (2024)
3D Scene-Camera Representation with Joint Camera Photometric Optimization
por: Dai, Weichen, et al.
Publicado: (2025)
por: Dai, Weichen, et al.
Publicado: (2025)
Ctrl-Room: Controllable Text-to-3D Room Meshes Generation with Layout Constraints
por: Fang, Chuan, et al.
Publicado: (2023)
por: Fang, Chuan, et al.
Publicado: (2023)
Scene4U: Hierarchical Layered 3D Scene Reconstruction from Single Panoramic Image for Your Immerse Exploration
por: Huang, Zilong, et al.
Publicado: (2025)
por: Huang, Zilong, et al.
Publicado: (2025)
ActCam: Zero-Shot Joint Camera and 3D Motion Control for Video Generation
por: Khalifi, Omar El, et al.
Publicado: (2026)
por: Khalifi, Omar El, et al.
Publicado: (2026)
ReCamMaster: Camera-Controlled Generative Rendering from A Single Video
por: Bai, Jianhong, et al.
Publicado: (2025)
por: Bai, Jianhong, et al.
Publicado: (2025)
CC-FMO: Camera-Conditioned Zero-Shot Single Image to 3D Scene Generation with Foundation Model Orchestration
por: Tang, Boshi, et al.
Publicado: (2025)
por: Tang, Boshi, et al.
Publicado: (2025)
CamI2V: Camera-Controlled Image-to-Video Diffusion Model
por: Zheng, Guangcong, et al.
Publicado: (2024)
por: Zheng, Guangcong, et al.
Publicado: (2024)
LiCamPose: Combining Multi-View LiDAR and RGB Cameras for Robust Single-timestamp 3D Human Pose Estimation
por: Pan, Zhiyu, et al.
Publicado: (2023)
por: Pan, Zhiyu, et al.
Publicado: (2023)
WorldCam: Interactive Autoregressive 3D Gaming Worlds with Camera Pose as a Unifying Geometric Representation
por: Nam, Jisu, et al.
Publicado: (2026)
por: Nam, Jisu, et al.
Publicado: (2026)
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
por: Zeng, Weichao, et al.
Publicado: (2024)
por: Zeng, Weichao, et al.
Publicado: (2024)
Ctrl-Z Sampling: Scaling Diffusion Sampling with Controlled Random Zigzag Explorations
por: Mao, Shunqi, et al.
Publicado: (2025)
por: Mao, Shunqi, et al.
Publicado: (2025)
ChatCam: Empowering Camera Control through Conversational AI
por: Liu, Xinhang, et al.
Publicado: (2024)
por: Liu, Xinhang, et al.
Publicado: (2024)
Improved Single Camera BEV Perception Using Multi-Camera Training
por: Busch, Daniel, et al.
Publicado: (2024)
por: Busch, Daniel, et al.
Publicado: (2024)
EmoCtrl: Controllable Emotional Image Content Generation
por: Yang, Jingyuan, et al.
Publicado: (2025)
por: Yang, Jingyuan, et al.
Publicado: (2025)
VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control
por: Bahmani, Sherwin, et al.
Publicado: (2024)
por: Bahmani, Sherwin, et al.
Publicado: (2024)
Beyond Inpainting: Unleash 3D Understanding for Precise Camera-Controlled Video Generation
por: Chen, Dong-Yu, et al.
Publicado: (2026)
por: Chen, Dong-Yu, et al.
Publicado: (2026)
3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning
por: Yang, Yuncong, et al.
Publicado: (2024)
por: Yang, Yuncong, et al.
Publicado: (2024)
REST3D: Reconstructing Physically Stable 3D Scenes from a Single Image
por: Ma, Xiaoxuan, et al.
Publicado: (2026)
por: Ma, Xiaoxuan, et al.
Publicado: (2026)
Wonderland: Navigating 3D Scenes from a Single Image
por: Liang, Hanwen, et al.
Publicado: (2024)
por: Liang, Hanwen, et al.
Publicado: (2024)
SparseCam4D: Spatio-Temporally Consistent 4D Reconstruction from Sparse Cameras
por: Pan, Weihong, et al.
Publicado: (2026)
por: Pan, Weihong, et al.
Publicado: (2026)
CtrlNeRF: The Generative Neural Radiation Fields for the Controllable Synthesis of High-fidelity 3D-Aware Images
por: Liu, Jian, et al.
Publicado: (2024)
por: Liu, Jian, et al.
Publicado: (2024)
Director3D: Real-world Camera Trajectory and 3D Scene Generation from Text
por: Li, Xinyang, et al.
Publicado: (2024)
por: Li, Xinyang, et al.
Publicado: (2024)
Uni3C: Unifying Precisely 3D-Enhanced Camera and Human Motion Controls for Video Generation
por: Cao, Chenjie, et al.
Publicado: (2025)
por: Cao, Chenjie, et al.
Publicado: (2025)
TrafficLoc: Localizing Traffic Surveillance Cameras in 3D Scenes
por: Xia, Yan, et al.
Publicado: (2024)
por: Xia, Yan, et al.
Publicado: (2024)
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control
por: Ren, Xuanchi, et al.
Publicado: (2025)
por: Ren, Xuanchi, et al.
Publicado: (2025)
LET-3D-AP: Longitudinal Error Tolerant 3D Average Precision for Camera-Only 3D Detection
por: Hung, Wei-Chih, et al.
Publicado: (2022)
por: Hung, Wei-Chih, et al.
Publicado: (2022)
Efficient Camera-Controlled Video Generation of Static Scenes via Sparse Diffusion and 3D Rendering
por: Chen, Jieying, et al.
Publicado: (2026)
por: Chen, Jieying, et al.
Publicado: (2026)
Ejemplares similares
-
Probing the 3D Awareness of Visual Foundation Models
por: Banani, Mohamed El, et al.
Publicado: (2024) -
3D Congealing: 3D-Aware Image Alignment in the Wild
por: Zhang, Yunzhi, et al.
Publicado: (2024) -
CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models
por: He, Hao, et al.
Publicado: (2025) -
CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation
por: Xu, Dejia, et al.
Publicado: (2024) -
DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation
por: Zhang, Hongfei, et al.
Publicado: (2025)