Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Zhenghong, An, Jie, Luo, Jiebo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Tri-Prompting: Video Diffusion with Unified Control over Scene, Subject, and Motion
por: Zhou, Zhenghong, et al.
Publicado: (2026)
por: Zhou, Zhenghong, et al.
Publicado: (2026)
On Inductive Biases That Enable Generalization of Diffusion Transformers
por: An, Jie, et al.
Publicado: (2024)
por: An, Jie, et al.
Publicado: (2024)
Aurora: Unified Video Editing with a Tool-Using Agent
por: Yu, Yongsheng, et al.
Publicado: (2026)
por: Yu, Yongsheng, et al.
Publicado: (2026)
CameraNoise: Enabling Faithful Camera Control in Video Diffusion through Geometry-Flow-Guided Noise Warping
por: Zhao, Haoyu, et al.
Publicado: (2026)
por: Zhao, Haoyu, et al.
Publicado: (2026)
Ouroboros-Diffusion: Exploring Consistent Content Generation in Tuning-free Long Video Diffusion
por: Chen, Jingyuan, et al.
Publicado: (2025)
por: Chen, Jingyuan, et al.
Publicado: (2025)
PixPerfect: Seamless Latent Diffusion Local Editing with Discriminative Pixel-Space Refinement
por: Zheng, Haitian, et al.
Publicado: (2025)
por: Zheng, Haitian, et al.
Publicado: (2025)
CameraCtrl: Enabling Camera Control for Text-to-Video Generation
por: He, Hao, et al.
Publicado: (2024)
por: He, Hao, et al.
Publicado: (2024)
LiDAR-Camera Fusion for Video Panoptic Segmentation without Video Training
por: Ayar, Fardin, et al.
Publicado: (2024)
por: Ayar, Fardin, et al.
Publicado: (2024)
FloVD: Optical Flow Meets Video Diffusion Model for Enhanced Camera-Controlled Video Synthesis
por: Jin, Wonjoon, et al.
Publicado: (2025)
por: Jin, Wonjoon, et al.
Publicado: (2025)
Training-free Camera Control for Video Generation
por: Hou, Chen, et al.
Publicado: (2024)
por: Hou, Chen, et al.
Publicado: (2024)
Latent Diffusion Model without Variational Autoencoder
por: Shi, Minglei, et al.
Publicado: (2025)
por: Shi, Minglei, et al.
Publicado: (2025)
CamPilot: Improving Camera Control in Video Diffusion Model with Efficient Camera Reward Feedback
por: Ge, Wenhang, et al.
Publicado: (2026)
por: Ge, Wenhang, et al.
Publicado: (2026)
ConfCtrl: Enabling Precise Camera Control in Video Diffusion via Confidence-Aware Interpolation
por: Yang, Liudi, et al.
Publicado: (2026)
por: Yang, Liudi, et al.
Publicado: (2026)
DanceCamAnimator: Keyframe-Based Controllable 3D Dance Camera Synthesis
por: Wang, Zixuan, et al.
Publicado: (2024)
por: Wang, Zixuan, et al.
Publicado: (2024)
Learning Spatial Adaptation and Temporal Coherence in Diffusion Models for Video Super-Resolution
por: Chen, Zhikai, et al.
Publicado: (2024)
por: Chen, Zhikai, et al.
Publicado: (2024)
Bring Metric Functions into Diffusion Models
por: An, Jie, et al.
Publicado: (2024)
por: An, Jie, et al.
Publicado: (2024)
CamCloneMaster: Enabling Reference-based Camera Control for Video Generation
por: Luo, Yawen, et al.
Publicado: (2025)
por: Luo, Yawen, et al.
Publicado: (2025)
Video Diffusion Models are Training-free Motion Interpreter and Controller
por: Xiao, Zeqi, et al.
Publicado: (2024)
por: Xiao, Zeqi, et al.
Publicado: (2024)
CamI2V: Camera-Controlled Image-to-Video Diffusion Model
por: Zheng, Guangcong, et al.
Publicado: (2024)
por: Zheng, Guangcong, et al.
Publicado: (2024)
Drive Any Mesh: 4D Latent Diffusion for Mesh Deformation from Video
por: Shi, Yahao, et al.
Publicado: (2025)
por: Shi, Yahao, et al.
Publicado: (2025)
Probing into Camera Control of Video Models
por: Hou, Chen, et al.
Publicado: (2026)
por: Hou, Chen, et al.
Publicado: (2026)
Enabling Versatile Controls for Video Diffusion Models
por: Zhang, Xu, et al.
Publicado: (2025)
por: Zhang, Xu, et al.
Publicado: (2025)
ZipIR: Latent Pyramid Diffusion Transformer for High-Resolution Image Restoration
por: Yu, Yongsheng, et al.
Publicado: (2025)
por: Yu, Yongsheng, et al.
Publicado: (2025)
GimbalDiffusion: Gravity-Aware Camera Control for Video Generation
por: Fortier-Chouinard, Frédéric, et al.
Publicado: (2025)
por: Fortier-Chouinard, Frédéric, et al.
Publicado: (2025)
DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation
por: Zhang, Hongfei, et al.
Publicado: (2025)
por: Zhang, Hongfei, et al.
Publicado: (2025)
Warp-as-History: Generalizable Camera-Controlled Video Generation from One Training Video
por: Wang, Yifan, et al.
Publicado: (2026)
por: Wang, Yifan, et al.
Publicado: (2026)
CamLit: Unified Video Diffusion with Explicit Camera and Lighting Control
por: Kuang, Zhiyi, et al.
Publicado: (2026)
por: Kuang, Zhiyi, et al.
Publicado: (2026)
RGB Pre-Training Enhanced Unobservable Feature Latent Diffusion Model for Spectral Reconstruction
por: Deng, Keli, et al.
Publicado: (2025)
por: Deng, Keli, et al.
Publicado: (2025)
DanceCamera3D: 3D Camera Movement Synthesis with Music and Dance
por: Wang, Zixuan, et al.
Publicado: (2024)
por: Wang, Zixuan, et al.
Publicado: (2024)
DreamColour: Controllable Video Colour Editing without Training
por: Utintu, Chaitat, et al.
Publicado: (2024)
por: Utintu, Chaitat, et al.
Publicado: (2024)
Motion-aware Latent Diffusion Models for Video Frame Interpolation
por: Huang, Zhilin, et al.
Publicado: (2024)
por: Huang, Zhilin, et al.
Publicado: (2024)
CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models
por: He, Hao, et al.
Publicado: (2025)
por: He, Hao, et al.
Publicado: (2025)
CamPVG: Camera-Controlled Panoramic Video Generation with Epipolar-Aware Diffusion
por: Ji, Chenhao, et al.
Publicado: (2025)
por: Ji, Chenhao, et al.
Publicado: (2025)
Boosting Camera Motion Control for Video Diffusion Transformers
por: Cheong, Soon Yau, et al.
Publicado: (2024)
por: Cheong, Soon Yau, et al.
Publicado: (2024)
End-to-end Open-vocabulary Video Visual Relationship Detection using Multi-modal Prompting
por: Wang, Yongqi, et al.
Publicado: (2024)
por: Wang, Yongqi, et al.
Publicado: (2024)
Corruption-Aware Training of Latent Video Diffusion Models for Robust Text-to-Video Generation
por: Maduabuchi, Chika, et al.
Publicado: (2025)
por: Maduabuchi, Chika, et al.
Publicado: (2025)
Reframe Anything: LLM Agent for Open World Video Reframing
por: Cao, Jiawang, et al.
Publicado: (2024)
por: Cao, Jiawang, et al.
Publicado: (2024)
LaMD: Latent Motion Diffusion for Image-Conditional Video Generation
por: Hu, Yaosi, et al.
Publicado: (2023)
por: Hu, Yaosi, et al.
Publicado: (2023)
Chain-of-Thought Prompting for Demographic Inference with Large Multimodal Models
por: Yu, Yongsheng, et al.
Publicado: (2024)
por: Yu, Yongsheng, et al.
Publicado: (2024)
Delving into Latent Spectral Biasing of Video VAEs for Superior Diffusability
por: Liu, Shizhan, et al.
Publicado: (2025)
por: Liu, Shizhan, et al.
Publicado: (2025)
Ejemplares similares
-
Tri-Prompting: Video Diffusion with Unified Control over Scene, Subject, and Motion
por: Zhou, Zhenghong, et al.
Publicado: (2026) -
On Inductive Biases That Enable Generalization of Diffusion Transformers
por: An, Jie, et al.
Publicado: (2024) -
Aurora: Unified Video Editing with a Tool-Using Agent
por: Yu, Yongsheng, et al.
Publicado: (2026) -
CameraNoise: Enabling Faithful Camera Control in Video Diffusion through Geometry-Flow-Guided Noise Warping
por: Zhao, Haoyu, et al.
Publicado: (2026) -
Ouroboros-Diffusion: Exploring Consistent Content Generation in Tuning-free Long Video Diffusion
por: Chen, Jingyuan, et al.
Publicado: (2025)