PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Yipeng, Ye, Zhichao, Fang, Zhenzhou, Chen, Xinyu, Zhang, Xiaoyu, Liu, Jialing, Wang, Nan, Zhang, Guofeng, Liu, Haomin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SparseCam4D: Spatio-Temporally Consistent 4D Reconstruction from Sparse Cameras
par: Pan, Weihong, et autres
Publié: (2026)
par: Pan, Weihong, et autres
Publié: (2026)
RealCam: Real-Time Novel-View Video Generation with Interactive Camera Control
par: Xu, Youcan, et autres
Publié: (2026)
par: Xu, Youcan, et autres
Publié: (2026)
Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM
par: Pan, Zirui, et autres
Publié: (2025)
par: Pan, Zirui, et autres
Publié: (2025)
INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling
par: InSpatio Team, et autres
Publié: (2026)
par: InSpatio Team, et autres
Publié: (2026)
CamCloneMaster: Enabling Reference-based Camera Control for Video Generation
par: Luo, Yawen, et autres
Publié: (2025)
par: Luo, Yawen, et autres
Publié: (2025)
StarGen: A Spatiotemporal Autoregression Framework with Video Diffusion Model for Scalable and Controllable Scene Generation
par: Zhai, Shangjin, et autres
Publié: (2025)
par: Zhai, Shangjin, et autres
Publié: (2025)
CamPro: Camera-based Anti-Facial Recognition
par: Zhu, Wenjun, et autres
Publié: (2023)
par: Zhu, Wenjun, et autres
Publié: (2023)
OmniCam: Unified Multimodal Video Generation via Camera Control
par: Yang, Xiaoda, et autres
Publié: (2025)
par: Yang, Xiaoda, et autres
Publié: (2025)
DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation
par: Zhang, Hongfei, et autres
Publié: (2025)
par: Zhang, Hongfei, et autres
Publié: (2025)
CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation
par: Xu, Dejia, et autres
Publié: (2024)
par: Xu, Dejia, et autres
Publié: (2024)
CamPilot: Improving Camera Control in Video Diffusion Model with Efficient Camera Reward Feedback
par: Ge, Wenhang, et autres
Publié: (2026)
par: Ge, Wenhang, et autres
Publié: (2026)
CamGeo: Sparse Camera-Conditioned Image-to-Video Generation with 3D Geometry Priors
par: Liu, Xuanyi, et autres
Publié: (2026)
par: Liu, Xuanyi, et autres
Publié: (2026)
SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints
par: Bai, Jianhong, et autres
Publié: (2024)
par: Bai, Jianhong, et autres
Publié: (2024)
AnyCam: Learning to Recover Camera Poses and Intrinsics from Casual Videos
par: Wimbauer, Felix, et autres
Publié: (2025)
par: Wimbauer, Felix, et autres
Publié: (2025)
ReCamMaster: Camera-Controlled Generative Rendering from A Single Video
par: Bai, Jianhong, et autres
Publié: (2025)
par: Bai, Jianhong, et autres
Publié: (2025)
ReCamDriving: LiDAR-Free Camera-Controlled Novel Trajectory Video Generation
par: Li, Yaokun, et autres
Publié: (2025)
par: Li, Yaokun, et autres
Publié: (2025)
InSpatio-WorldFM: An Open-Source Real-Time Generative Frame Model
par: InSpatio Team, et autres
Publié: (2026)
par: InSpatio Team, et autres
Publié: (2026)
VividCam: Learning Unconventional Camera Motions from Virtual Synthetic Videos
par: Wu, Qiucheng, et autres
Publié: (2025)
par: Wu, Qiucheng, et autres
Publié: (2025)
Cavia: Camera-controllable Multi-view Video Diffusion with View-Integrated Attention
par: Xu, Dejia, et autres
Publié: (2024)
par: Xu, Dejia, et autres
Publié: (2024)
DeltaCam: Differential Intrinsic Camera Modeling for Video Generation
par: Mandal, Debabrata, et autres
Publié: (2026)
par: Mandal, Debabrata, et autres
Publié: (2026)
DriveCamSim: Generalizable Camera Simulation via Explicit Camera Modeling for Autonomous Driving
par: Sun, Wenchao, et autres
Publié: (2025)
par: Sun, Wenchao, et autres
Publié: (2025)
Efficient estimation procedure for failure probability function by an augmented directional sampling
par: Nan Ye, et autres
Publié: (2024)
par: Nan Ye, et autres
Publié: (2024)
Text to Query Plans for Question Answering on Large Tables
par: Zhang, Yipeng, et autres
Publié: (2025)
par: Zhang, Yipeng, et autres
Publié: (2025)
MemCam: Memory-Augmented Camera Control for Consistent Video Generation
par: Gao, Xinhang, et autres
Publié: (2026)
par: Gao, Xinhang, et autres
Publié: (2026)
CamLit: Unified Video Diffusion with Explicit Camera and Lighting Control
par: Kuang, Zhiyi, et autres
Publié: (2026)
par: Kuang, Zhiyi, et autres
Publié: (2026)
MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics
par: Liu, Haofeng, et autres
Publié: (2026)
par: Liu, Haofeng, et autres
Publié: (2026)
CETCAM: Camera-Controllable Video Generation via Consistent and Extensible Tokenization
par: Zhao, Zelin, et autres
Publié: (2025)
par: Zhao, Zelin, et autres
Publié: (2025)
PGSR: Planar-based Gaussian Splatting for Efficient and High-Fidelity Surface Reconstruction
par: Chen, Danpeng, et autres
Publié: (2024)
par: Chen, Danpeng, et autres
Publié: (2024)
ChatCam: Empowering Camera Control through Conversational AI
par: Liu, Xinhang, et autres
Publié: (2024)
par: Liu, Xinhang, et autres
Publié: (2024)
XAttnRes: Cross-Stage Attention Residuals for Medical Image Segmentation
par: Liu, Xinyu, et autres
Publié: (2026)
par: Liu, Xinyu, et autres
Publié: (2026)
Mixture of Distributions Matters: Dynamic Sparse Attention for Efficient Video Diffusion Transformers
par: Liu, Yuxi, et autres
Publié: (2026)
par: Liu, Yuxi, et autres
Publié: (2026)
Query Provenance Analysis: Efficient and Robust Defense against Query-based Black-box Attacks
par: Li, Shaofei, et autres
Publié: (2024)
par: Li, Shaofei, et autres
Publié: (2024)
CamI2V: Camera-Controlled Image-to-Video Diffusion Model
par: Zheng, Guangcong, et autres
Publié: (2024)
par: Zheng, Guangcong, et autres
Publié: (2024)
CamViG: Camera Aware Image-to-Video Generation with Multimodal Transformers
par: Marmon, Andrew, et autres
Publié: (2024)
par: Marmon, Andrew, et autres
Publié: (2024)
FaceCam: Portrait Video Camera Control via Scale-Aware Conditioning
par: Lyu, Weijie, et autres
Publié: (2026)
par: Lyu, Weijie, et autres
Publié: (2026)
CamPVG: Camera-Controlled Panoramic Video Generation with Epipolar-Aware Diffusion
par: Ji, Chenhao, et autres
Publié: (2025)
par: Ji, Chenhao, et autres
Publié: (2025)
Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention
par: Lu, Hannan, et autres
Publié: (2024)
par: Lu, Hannan, et autres
Publié: (2024)
DanceCamAnimator: Keyframe-Based Controllable 3D Dance Camera Synthesis
par: Wang, Zixuan, et autres
Publié: (2024)
par: Wang, Zixuan, et autres
Publié: (2024)
Learnable Query Aggregation with KV Routing for Cross-view Geo-localisation
par: Ye, Hualin, et autres
Publié: (2025)
par: Ye, Hualin, et autres
Publié: (2025)
Large Language Model Aided Multi-objective Evolutionary Algorithm: a Low-cost Adaptive Approach
par: Liu, Wanyi, et autres
Publié: (2024)
par: Liu, Wanyi, et autres
Publié: (2024)
Documents similaires
-
SparseCam4D: Spatio-Temporally Consistent 4D Reconstruction from Sparse Cameras
par: Pan, Weihong, et autres
Publié: (2026) -
RealCam: Real-Time Novel-View Video Generation with Interactive Camera Control
par: Xu, Youcan, et autres
Publié: (2026) -
Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM
par: Pan, Zirui, et autres
Publié: (2025) -
INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling
par: InSpatio Team, et autres
Publié: (2026) -
CamCloneMaster: Enabling Reference-based Camera Control for Video Generation
par: Luo, Yawen, et autres
Publié: (2025)