Generative Photographic Control for Scene-Consistent Video Cinematic Editing
Fuente:
arXiv
Guardado en:
| Autores principales: | Sun, Huiqiang, Shen, Liao, Peng, Zhan, Wang, Kun, Wu, Size, Zang, Yuhang, Liu, Tianqi, Huang, Zihao, Zeng, Xingyu, Cao, Zhiguo, Li, Wei, Loy, Chen Change |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DoF-Gaussian: Controllable Depth-of-Field for 3D Gaussian Splatting
por: Shen, Liao, et al.
Publicado: (2025)
por: Shen, Liao, et al.
Publicado: (2025)
Free4D: Tuning-free 4D Scene Generation with Spatial-Temporal Consistency
por: Liu, Tianqi, et al.
Publicado: (2025)
por: Liu, Tianqi, et al.
Publicado: (2025)
3D Multi-frame Fusion for Video Stabilization
por: Peng, Zhan, et al.
Publicado: (2024)
por: Peng, Zhan, et al.
Publicado: (2024)
MuGS: Multi-Baseline Generalizable Gaussian Splatting Reconstruction
por: Lou, Yaopeng, et al.
Publicado: (2025)
por: Lou, Yaopeng, et al.
Publicado: (2025)
Controllable Human-centric Keyframe Interpolation with Generative Prior
por: Guo, Zujin, et al.
Publicado: (2025)
por: Guo, Zujin, et al.
Publicado: (2025)
Dynamic Neural Radiance Field From Defocused Monocular Video
por: Luo, Xianrui, et al.
Publicado: (2024)
por: Luo, Xianrui, et al.
Publicado: (2024)
Dynamic View Synthesis from Small Camera Motion Videos
por: Sun, Huiqiang, et al.
Publicado: (2025)
por: Sun, Huiqiang, et al.
Publicado: (2025)
DyBluRF: Dynamic Neural Radiance Fields from Blurry Monocular Video
por: Sun, Huiqiang, et al.
Publicado: (2024)
por: Sun, Huiqiang, et al.
Publicado: (2024)
DreamMover: Leveraging the Prior of Diffusion Models for Image Interpolation with Large Motion
por: Shen, Liao, et al.
Publicado: (2024)
por: Shen, Liao, et al.
Publicado: (2024)
Contextual Object Detection with Multimodal Large Language Models
por: Zang, Yuhang, et al.
Publicado: (2023)
por: Zang, Yuhang, et al.
Publicado: (2023)
Zero-Shot Video Translation and Editing with Frame Spatial-Temporal Correspondence
por: Yang, Shuai, et al.
Publicado: (2025)
por: Yang, Shuai, et al.
Publicado: (2025)
MatAnyone: Stable Video Matting with Consistent Memory Propagation
por: Yang, Peiqing, et al.
Publicado: (2025)
por: Yang, Peiqing, et al.
Publicado: (2025)
MVIP-NeRF: Multi-view 3D Inpainting on NeRF Scenes via Diffusion Prior
por: Chen, Honghua, et al.
Publicado: (2024)
por: Chen, Honghua, et al.
Publicado: (2024)
BokehFlow: Depth-Free Controllable Bokeh Rendering via Flow Matching
por: Huang, Yachuan, et al.
Publicado: (2025)
por: Huang, Yachuan, et al.
Publicado: (2025)
Arbitrary-steps Image Super-resolution via Diffusion Inversion
por: Yue, Zongsheng, et al.
Publicado: (2024)
por: Yue, Zongsheng, et al.
Publicado: (2024)
Generalizable Implicit Motion Modeling for Video Frame Interpolation
por: Guo, Zujin, et al.
Publicado: (2024)
por: Guo, Zujin, et al.
Publicado: (2024)
Kalman-Inspired Feature Propagation for Video Face Super-Resolution
por: Feng, Ruicheng, et al.
Publicado: (2024)
por: Feng, Ruicheng, et al.
Publicado: (2024)
DST-Det: Simple Dynamic Self-Training for Open-Vocabulary Object Detection
por: Xu, Shilin, et al.
Publicado: (2023)
por: Xu, Shilin, et al.
Publicado: (2023)
SmartDirector: Keyframe-Conditioned Cinematic Video Generation with Narrative Pacing Control
por: Zhang, Zhida, et al.
Publicado: (2026)
por: Zhang, Zhida, et al.
Publicado: (2026)
Exposure Completing for Temporally Consistent Neural High Dynamic Range Video Rendering
por: Cui, Jiahao, et al.
Publicado: (2024)
por: Cui, Jiahao, et al.
Publicado: (2024)
WildAvatar: Learning In-the-wild 3D Avatars from the Web
por: Huang, Zihao, et al.
Publicado: (2024)
por: Huang, Zihao, et al.
Publicado: (2024)
DifFace: Blind Face Restoration with Diffused Error Contraction
por: Yue, Zongsheng, et al.
Publicado: (2022)
por: Yue, Zongsheng, et al.
Publicado: (2022)
CineVerse: Consistent Keyframe Synthesis for Cinematic Scene Composition
por: Phung, Quynh, et al.
Publicado: (2025)
por: Phung, Quynh, et al.
Publicado: (2025)
MVSGaussian: Fast Generalizable Gaussian Splatting Reconstruction from Multi-View Stereo
por: Liu, Tianqi, et al.
Publicado: (2024)
por: Liu, Tianqi, et al.
Publicado: (2024)
CLIPSelf: Vision Transformer Distills Itself for Open-Vocabulary Dense Prediction
por: Wu, Size, et al.
Publicado: (2023)
por: Wu, Size, et al.
Publicado: (2023)
F-LMM: Grounding Frozen Large Multimodal Models
por: Wu, Size, et al.
Publicado: (2024)
por: Wu, Size, et al.
Publicado: (2024)
FRESCO: Spatial-Temporal Correspondence for Zero-Shot Video Translation
por: Yang, Shuai, et al.
Publicado: (2024)
por: Yang, Shuai, et al.
Publicado: (2024)
Denoising as Adaptation: Noise-Space Domain Adaptation for Image Restoration
por: Liao, Kang, et al.
Publicado: (2024)
por: Liao, Kang, et al.
Publicado: (2024)
MOWA: Multiple-in-One Image Warping Model
por: Liao, Kang, et al.
Publicado: (2024)
por: Liao, Kang, et al.
Publicado: (2024)
3DEnhancer: Consistent Multi-View Diffusion for 3D Enhancement
por: Luo, Yihang, et al.
Publicado: (2024)
por: Luo, Yihang, et al.
Publicado: (2024)
Thinking with Camera: A Unified Multimodal Model for Camera-Centric Understanding and Generation
por: Liao, Kang, et al.
Publicado: (2025)
por: Liao, Kang, et al.
Publicado: (2025)
Geometry-aware Reconstruction and Fusion-refined Rendering for Generalizable Neural Radiance Fields
por: Liu, Tianqi, et al.
Publicado: (2024)
por: Liu, Tianqi, et al.
Publicado: (2024)
ObjCtrl-2.5D: Training-free Object Control with Camera Poses
por: Wang, Zhouxia, et al.
Publicado: (2024)
por: Wang, Zhouxia, et al.
Publicado: (2024)
CineScene: Implicit 3D as Effective Scene Representation for Cinematic Video Generation
por: Huang, Kaiyi, et al.
Publicado: (2026)
por: Huang, Kaiyi, et al.
Publicado: (2026)
OpenUni: A Simple Baseline for Unified Multimodal Understanding and Generation
por: Wu, Size, et al.
Publicado: (2025)
por: Wu, Size, et al.
Publicado: (2025)
Enhanced Generative Structure Prior for Chinese Text Image Super-resolution
por: Li, Xiaoming, et al.
Publicado: (2025)
por: Li, Xiaoming, et al.
Publicado: (2025)
Learning 3D Garment Animation from Trajectories of A Piece of Cloth
por: Shao, Yidi, et al.
Publicado: (2025)
por: Shao, Yidi, et al.
Publicado: (2025)
Efficient Diffusion Model for Image Restoration by Residual Shifting
por: Yue, Zongsheng, et al.
Publicado: (2024)
por: Yue, Zongsheng, et al.
Publicado: (2024)
AITTI: Learning Adaptive Inclusive Token for Text-to-Image Generation
por: Hou, Xinyu, et al.
Publicado: (2024)
por: Hou, Xinyu, et al.
Publicado: (2024)
Automatic Funny Scene Extraction from Long-form Cinematic Videos
por: Paul, Sibendu, et al.
Publicado: (2026)
por: Paul, Sibendu, et al.
Publicado: (2026)
Ejemplares similares
-
DoF-Gaussian: Controllable Depth-of-Field for 3D Gaussian Splatting
por: Shen, Liao, et al.
Publicado: (2025) -
Free4D: Tuning-free 4D Scene Generation with Spatial-Temporal Consistency
por: Liu, Tianqi, et al.
Publicado: (2025) -
3D Multi-frame Fusion for Video Stabilization
por: Peng, Zhan, et al.
Publicado: (2024) -
MuGS: Multi-Baseline Generalizable Gaussian Splatting Reconstruction
por: Lou, Yaopeng, et al.
Publicado: (2025) -
Controllable Human-centric Keyframe Interpolation with Generative Prior
por: Guo, Zujin, et al.
Publicado: (2025)