OmniCamera: A Unified Framework for Multi-task Video Generation with Arbitrary Camera Control
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yukun, Li, Ruihuang, Tao, Jiale, Yang, Shiyuan, Chen, Liyi, Yang, Zhantao, Handz, Guo, Yulan, Shao, Shuai, Lu, Qinglin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EffectMaker: Unifying Reasoning and Generation for Customized Visual Effect Creation
par: Yang, Shiyuan, et autres
Publié: (2026)
par: Yang, Shiyuan, et autres
Publié: (2026)
OmniVideo-R1: Reinforcing Audio-visual Reasoning with Query Intention and Modality Attention
par: Chen, Zhangquan, et autres
Publié: (2026)
par: Chen, Zhangquan, et autres
Publié: (2026)
OmniCam: Unified Multimodal Video Generation via Camera Control
par: Yang, Xiaoda, et autres
Publié: (2025)
par: Yang, Xiaoda, et autres
Publié: (2025)
CameraMaster: Unified Camera Semantic-Parameter Control for Photography Retouching
par: Yang, Qirui, et autres
Publié: (2025)
par: Yang, Qirui, et autres
Publié: (2025)
CameraCtrl: Enabling Camera Control for Text-to-Video Generation
par: He, Hao, et autres
Publié: (2024)
par: He, Hao, et autres
Publié: (2024)
Fast Multi-view Consistent 3D Editing with Video Priors
par: Chen, Liyi, et autres
Publié: (2025)
par: Chen, Liyi, et autres
Publié: (2025)
Unified Camera Positional Encoding for Controlled Video Generation
par: Zhang, Cheng, et autres
Publié: (2025)
par: Zhang, Cheng, et autres
Publié: (2025)
UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models
par: Jiang, Hong, et autres
Publié: (2026)
par: Jiang, Hong, et autres
Publié: (2026)
CamPilot: Improving Camera Control in Video Diffusion Model with Efficient Camera Reward Feedback
par: Ge, Wenhang, et autres
Publié: (2026)
par: Ge, Wenhang, et autres
Publié: (2026)
River Camera Image Dataset and Weights for Water Segmentation Model at Four UK Rivers
par: Hu, Shiyuan
Publié: (2026)
par: Hu, Shiyuan
Publié: (2026)
Free-Form Motion Control: Controlling the 6D Poses of Camera and Objects in Video Generation
par: Shuai, Xincheng, et autres
Publié: (2025)
par: Shuai, Xincheng, et autres
Publié: (2025)
Direct-a-Video: Customized Video Generation with User-Directed Camera Movement and Object Motion
par: Yang, Shiyuan, et autres
Publié: (2024)
par: Yang, Shiyuan, et autres
Publié: (2024)
DiffCamera: Arbitrary Refocusing on Images
par: Wang, Yiyang, et autres
Publié: (2025)
par: Wang, Yiyang, et autres
Publié: (2025)
CamLit: Unified Video Diffusion with Explicit Camera and Lighting Control
par: Kuang, Zhiyi, et autres
Publié: (2026)
par: Kuang, Zhiyi, et autres
Publié: (2026)
HR-APR: APR-agnostic Framework with Uncertainty Estimation and Hierarchical Refinement for Camera Relocalisation
par: Liu, Changkun, et autres
Publié: (2024)
par: Liu, Changkun, et autres
Publié: (2024)
MyGo: Consistent and Controllable Multi-View Driving Video Generation with Camera Control
par: Yao, Yining, et autres
Publié: (2024)
par: Yao, Yining, et autres
Publié: (2024)
CameraNoise: Enabling Faithful Camera Control in Video Diffusion through Geometry-Flow-Guided Noise Warping
par: Zhao, Haoyu, et autres
Publié: (2026)
par: Zhao, Haoyu, et autres
Publié: (2026)
CamI2V: Camera-Controlled Image-to-Video Diffusion Model
par: Zheng, Guangcong, et autres
Publié: (2024)
par: Zheng, Guangcong, et autres
Publié: (2024)
Probing into Camera Control of Video Models
par: Hou, Chen, et autres
Publié: (2026)
par: Hou, Chen, et autres
Publié: (2026)
Unify Robot Actions in Camera Frame
par: Xie, Sicheng, et autres
Publié: (2025)
par: Xie, Sicheng, et autres
Publié: (2025)
Omni-Video: Democratizing Unified Video Understanding and Generation
par: Tan, Zhiyu, et autres
Publié: (2025)
par: Tan, Zhiyu, et autres
Publié: (2025)
ShotVerse: Advancing Cinematic Camera Control for Text-Driven Multi-Shot Video Creation
par: Yang, Songlin, et autres
Publié: (2026)
par: Yang, Songlin, et autres
Publié: (2026)
CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models
par: He, Hao, et autres
Publié: (2025)
par: He, Hao, et autres
Publié: (2025)
Arbitrary Generative Video Interpolation
par: Zhang, Guozhen, et autres
Publié: (2025)
par: Zhang, Guozhen, et autres
Publié: (2025)
I2VControl-Camera: Precise Video Camera Control with Adjustable Motion Strength
par: Feng, Wanquan, et autres
Publié: (2024)
par: Feng, Wanquan, et autres
Publié: (2024)
Beyond Inpainting: Unleash 3D Understanding for Precise Camera-Controlled Video Generation
par: Chen, Dong-Yu, et autres
Publié: (2026)
par: Chen, Dong-Yu, et autres
Publié: (2026)
DreamID-Omni: Unified Framework for Controllable Human-Centric Audio-Video Generation
par: Guo, Xu, et autres
Publié: (2026)
par: Guo, Xu, et autres
Publié: (2026)
Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control
par: Kuang, Zhengfei, et autres
Publié: (2024)
par: Kuang, Zhengfei, et autres
Publié: (2024)
Training-free Camera Control for Video Generation
par: Hou, Chen, et autres
Publié: (2024)
par: Hou, Chen, et autres
Publié: (2024)
FaceCam: Portrait Video Camera Control via Scale-Aware Conditioning
par: Lyu, Weijie, et autres
Publié: (2026)
par: Lyu, Weijie, et autres
Publié: (2026)
WorldCraft: From Camera Navigation to Object Manipulation in Interactive Video World Models
par: Gu, Bohai, et autres
Publié: (2026)
par: Gu, Bohai, et autres
Publié: (2026)
CT-1: Vision-Language-Camera Models Transfer Spatial Reasoning Knowledge to Camera-Controllable Video Generation
par: Zhao, Haoyu, et autres
Publié: (2026)
par: Zhao, Haoyu, et autres
Publié: (2026)
Deep Hybrid Camera Deblurring for Smartphone Cameras
par: Rim, Jaesung, et autres
Publié: (2023)
par: Rim, Jaesung, et autres
Publié: (2023)
DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation
par: Zhang, Hongfei, et autres
Publié: (2025)
par: Zhang, Hongfei, et autres
Publié: (2025)
HENet: Hybrid Encoding for End-to-end Multi-task 3D Perception from Multi-view Cameras
par: Xia, Zhongyu, et autres
Publié: (2024)
par: Xia, Zhongyu, et autres
Publié: (2024)
CRePE: Curved Ray Expectation Positional Encoding for Unified-Camera-Controlled Video Generation
par: Jin, Seonghyun, et autres
Publié: (2026)
par: Jin, Seonghyun, et autres
Publié: (2026)
TMP: Temporal Motion Propagation for Online Video Super-Resolution
par: Zhang, Zhengqiang, et autres
Publié: (2023)
par: Zhang, Zhengqiang, et autres
Publié: (2023)
ReRoPE: Repurposing RoPE for Relative Camera Control
par: Li, Chunyang, et autres
Publié: (2026)
par: Li, Chunyang, et autres
Publié: (2026)
BulletTime: Decoupled Control of Time and Camera Pose for Video Generation
par: Wang, Yiming, et autres
Publié: (2025)
par: Wang, Yiming, et autres
Publié: (2025)
MC-NeRF: Multi-Camera Neural Radiance Fields for Multi-Camera Image Acquisition Systems
par: Gao, Yu, et autres
Publié: (2023)
par: Gao, Yu, et autres
Publié: (2023)
Documents similaires
-
EffectMaker: Unifying Reasoning and Generation for Customized Visual Effect Creation
par: Yang, Shiyuan, et autres
Publié: (2026) -
OmniVideo-R1: Reinforcing Audio-visual Reasoning with Query Intention and Modality Attention
par: Chen, Zhangquan, et autres
Publié: (2026) -
OmniCam: Unified Multimodal Video Generation via Camera Control
par: Yang, Xiaoda, et autres
Publié: (2025) -
CameraMaster: Unified Camera Semantic-Parameter Control for Photography Retouching
par: Yang, Qirui, et autres
Publié: (2025) -
CameraCtrl: Enabling Camera Control for Text-to-Video Generation
par: He, Hao, et autres
Publié: (2024)