Unified Camera Positional Encoding for Controlled Video Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Cheng, Li, Boying, Wei, Meng, Cao, Yan-Pei, Gambardella, Camilo Cruz, Phung, Dinh, Cai, Jianfei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PanSplat: 4K Panorama Synthesis with Feed-Forward Gaussian Splatting
por: Zhang, Cheng, et al.
Publicado: (2024)
por: Zhang, Cheng, et al.
Publicado: (2024)
Taming Stable Diffusion for Text to 360° Panorama Image Generation
por: Zhang, Cheng, et al.
Publicado: (2024)
por: Zhang, Cheng, et al.
Publicado: (2024)
PanFlow: Decoupled Motion Control for Panoramic Video Generation
por: Zhang, Cheng, et al.
Publicado: (2025)
por: Zhang, Cheng, et al.
Publicado: (2025)
PaRa: Personalizing Text-to-Image Diffusion via Parameter Rank Reduction
por: Chen, Shangyu, et al.
Publicado: (2024)
por: Chen, Shangyu, et al.
Publicado: (2024)
CRePE: Curved Ray Expectation Positional Encoding for Unified-Camera-Controlled Video Generation
por: Jin, Seonghyun, et al.
Publicado: (2026)
por: Jin, Seonghyun, et al.
Publicado: (2026)
UCM: Unifying Camera Control and Memory with Time-aware Positional Encoding Warping for World Models
por: Xu, Tianxing, et al.
Publicado: (2026)
por: Xu, Tianxing, et al.
Publicado: (2026)
Large-Scale Data-Free Knowledge Distillation for ImageNet via Multi-Resolution Data Generation
por: Tran, Minh-Tuan, et al.
Publicado: (2024)
por: Tran, Minh-Tuan, et al.
Publicado: (2024)
Cameras as Relative Positional Encoding
por: Li, Ruilong, et al.
Publicado: (2025)
por: Li, Ruilong, et al.
Publicado: (2025)
OmniCamera: A Unified Framework for Multi-task Video Generation with Arbitrary Camera Control
por: Wang, Yukun, et al.
Publicado: (2026)
por: Wang, Yukun, et al.
Publicado: (2026)
Stereo World Model: Camera-Guided Stereo Video Generation
por: Sun, Yang-Tian, et al.
Publicado: (2026)
por: Sun, Yang-Tian, et al.
Publicado: (2026)
CalibAnyView: Beyond Single-View Camera Calibration in the Wild
por: Li, Boying, et al.
Publicado: (2026)
por: Li, Boying, et al.
Publicado: (2026)
OmniCam: Unified Multimodal Video Generation via Camera Control
por: Yang, Xiaoda, et al.
Publicado: (2025)
por: Yang, Xiaoda, et al.
Publicado: (2025)
Uni3C: Unifying Precisely 3D-Enhanced Camera and Human Motion Controls for Video Generation
por: Cao, Chenjie, et al.
Publicado: (2025)
por: Cao, Chenjie, et al.
Publicado: (2025)
ControlFoley: Unified and Controllable Video-to-Audio Generation with Cross-Modal Conflict Handling
por: Yang, Jianxuan, et al.
Publicado: (2026)
por: Yang, Jianxuan, et al.
Publicado: (2026)
Light-X: Generative 4D Video Rendering with Camera and Illumination Control
por: Liu, Tianqi, et al.
Publicado: (2025)
por: Liu, Tianqi, et al.
Publicado: (2025)
CameraCtrl: Enabling Camera Control for Text-to-Video Generation
por: He, Hao, et al.
Publicado: (2024)
por: He, Hao, et al.
Publicado: (2024)
BulletTime: Decoupled Control of Time and Camera Pose for Video Generation
por: Wang, Yiming, et al.
Publicado: (2025)
por: Wang, Yiming, et al.
Publicado: (2025)
PosMLP-Video: Spatial and Temporal Relative Position Encoding for Efficient Video Recognition
por: Hao, Yanbin, et al.
Publicado: (2024)
por: Hao, Yanbin, et al.
Publicado: (2024)
ASAP-Textured Gaussians: Enhancing Textured Gaussians with Adaptive Sampling and Anisotropic Parameterization
por: Wei, Meng, et al.
Publicado: (2025)
por: Wei, Meng, et al.
Publicado: (2025)
CamLit: Unified Video Diffusion with Explicit Camera and Lighting Control
por: Kuang, Zhiyi, et al.
Publicado: (2026)
por: Kuang, Zhiyi, et al.
Publicado: (2026)
PuzzleBoard: A New Camera Calibration Pattern with Position Encoding
por: Stelldinger, Peer, et al.
Publicado: (2024)
por: Stelldinger, Peer, et al.
Publicado: (2024)
Training-free Camera Control for Video Generation
por: Hou, Chen, et al.
Publicado: (2024)
por: Hou, Chen, et al.
Publicado: (2024)
CT-1: Vision-Language-Camera Models Transfer Spatial Reasoning Knowledge to Camera-Controllable Video Generation
por: Zhao, Haoyu, et al.
Publicado: (2026)
por: Zhao, Haoyu, et al.
Publicado: (2026)
MyGo: Consistent and Controllable Multi-View Driving Video Generation with Camera Control
por: Yao, Yining, et al.
Publicado: (2024)
por: Yao, Yining, et al.
Publicado: (2024)
Omni2Sound: Towards Unified Video-Text-to-Audio Generation
por: Dai, Yusheng, et al.
Publicado: (2026)
por: Dai, Yusheng, et al.
Publicado: (2026)
Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control
por: Kuang, Zhengfei, et al.
Publicado: (2024)
por: Kuang, Zhengfei, et al.
Publicado: (2024)
ReCamMaster: Camera-Controlled Generative Rendering from A Single Video
por: Bai, Jianhong, et al.
Publicado: (2025)
por: Bai, Jianhong, et al.
Publicado: (2025)
Generated Reality: Human-centric World Simulation using Interactive Video Generation with Hand and Camera Control
por: Xie, Linxi, et al.
Publicado: (2026)
por: Xie, Linxi, et al.
Publicado: (2026)
DragEntity: Trajectory Guided Video Generation using Entity and Positional Relationships
por: Wan, Zhang, et al.
Publicado: (2024)
por: Wan, Zhang, et al.
Publicado: (2024)
Thinking with Camera: A Unified Multimodal Model for Camera-Centric Understanding and Generation
por: Liao, Kang, et al.
Publicado: (2025)
por: Liao, Kang, et al.
Publicado: (2025)
CameraMaster: Unified Camera Semantic-Parameter Control for Photography Retouching
por: Yang, Qirui, et al.
Publicado: (2025)
por: Yang, Qirui, et al.
Publicado: (2025)
GimbalDiffusion: Gravity-Aware Camera Control for Video Generation
por: Fortier-Chouinard, Frédéric, et al.
Publicado: (2025)
por: Fortier-Chouinard, Frédéric, et al.
Publicado: (2025)
Infinite-Homography as Robust Conditioning for Camera-Controlled Video Generation
por: Kim, Min-Jung, et al.
Publicado: (2025)
por: Kim, Min-Jung, et al.
Publicado: (2025)
Taming Camera-Controlled Video Generation with Verifiable Geometry Reward
por: Wang, Zhaoqing, et al.
Publicado: (2025)
por: Wang, Zhaoqing, et al.
Publicado: (2025)
ReDirector: Creating Any-Length Video Retakes with Rotary Camera Encoding
por: Park, Byeongjun, et al.
Publicado: (2025)
por: Park, Byeongjun, et al.
Publicado: (2025)
UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models
por: Jiang, Hong, et al.
Publicado: (2026)
por: Jiang, Hong, et al.
Publicado: (2026)
Marginalized Generalized IoU (MGIoU): A Unified Objective Function for Optimizing Any Convex Parametric Shapes
por: Le, Duy-Tho, et al.
Publicado: (2025)
por: Le, Duy-Tho, et al.
Publicado: (2025)
TIE: Time Interval Encoding for Video Generation over Events
por: Shu, Zhilei, et al.
Publicado: (2026)
por: Shu, Zhilei, et al.
Publicado: (2026)
Enhancing Motion in Text-to-Video Generation with Decomposed Encoding and Conditioning
por: Ruan, Penghui, et al.
Publicado: (2024)
por: Ruan, Penghui, et al.
Publicado: (2024)
CamCloneMaster: Enabling Reference-based Camera Control for Video Generation
por: Luo, Yawen, et al.
Publicado: (2025)
por: Luo, Yawen, et al.
Publicado: (2025)
Ejemplares similares
-
PanSplat: 4K Panorama Synthesis with Feed-Forward Gaussian Splatting
por: Zhang, Cheng, et al.
Publicado: (2024) -
Taming Stable Diffusion for Text to 360° Panorama Image Generation
por: Zhang, Cheng, et al.
Publicado: (2024) -
PanFlow: Decoupled Motion Control for Panoramic Video Generation
por: Zhang, Cheng, et al.
Publicado: (2025) -
PaRa: Personalizing Text-to-Image Diffusion via Parameter Rank Reduction
por: Chen, Shangyu, et al.
Publicado: (2024) -
CRePE: Curved Ray Expectation Positional Encoding for Unified-Camera-Controlled Video Generation
por: Jin, Seonghyun, et al.
Publicado: (2026)