MultiShotMaster: A Controllable Multi-Shot Video Generation Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Qinghe, Shi, Xiaoyu, Li, Baolu, Bian, Weikang, Liu, Quande, Lu, Huchuan, Wang, Xintao, Wan, Pengfei, Gai, Kun, Jia, Xu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation
par: Wang, Qinghe, et autres
Publié: (2025)
par: Wang, Qinghe, et autres
Publié: (2025)
RelightMaster: Precise Video Relighting with Multi-plane Light Images
par: Bian, Weikang, et autres
Publié: (2025)
par: Bian, Weikang, et autres
Publié: (2025)
ShotStream: Streaming Multi-Shot Video Generation for Interactive Storytelling
par: Luo, Yawen, et autres
Publié: (2026)
par: Luo, Yawen, et autres
Publié: (2026)
ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning
par: Huang, Yuzhou, et autres
Publié: (2025)
par: Huang, Yuzhou, et autres
Publié: (2025)
VFXMaster: Unlocking Dynamic Visual Effect Generation via In-Context Learning
par: Li, Baolu, et autres
Publié: (2025)
par: Li, Baolu, et autres
Publié: (2025)
FullDiT: Multi-Task Video Generative Foundation Model with Full Attention
par: Ju, Xuan, et autres
Publié: (2025)
par: Ju, Xuan, et autres
Publié: (2025)
CamCloneMaster: Enabling Reference-based Camera Control for Video Generation
par: Luo, Yawen, et autres
Publié: (2025)
par: Luo, Yawen, et autres
Publié: (2025)
UniVideo: Unified Understanding, Generation, and Editing for Videos
par: Wei, Cong, et autres
Publié: (2025)
par: Wei, Cong, et autres
Publié: (2025)
A Reason-then-Describe Instruction Interpreter for Controllable Video Generation
par: Wu, Shengqiong, et autres
Publié: (2025)
par: Wu, Shengqiong, et autres
Publié: (2025)
UniMMVSR: A Unified Multi-Modal Framework for Cascaded Video Super-Resolution
par: Du, Shian, et autres
Publié: (2025)
par: Du, Shian, et autres
Publié: (2025)
SemanticGen: Video Generation in Semantic Space
par: Bai, Jianhong, et autres
Publié: (2025)
par: Bai, Jianhong, et autres
Publié: (2025)
3DTrajMaster: Mastering 3D Trajectory for Multi-Entity Motion in Video Generation
par: Fu, Xiao, et autres
Publié: (2024)
par: Fu, Xiao, et autres
Publié: (2024)
A Survey of Interactive Generative Video
par: Yu, Jiwen, et autres
Publié: (2025)
par: Yu, Jiwen, et autres
Publié: (2025)
Any2Caption:Interpreting Any Condition to Caption for Controllable Video Generation
par: Wu, Shengqiong, et autres
Publié: (2025)
par: Wu, Shengqiong, et autres
Publié: (2025)
UniCustom: Unified Visual Conditioning for Multi-Reference Image Generation
par: Xu, Yiyan, et autres
Publié: (2026)
par: Xu, Yiyan, et autres
Publié: (2026)
VideoCanvas: Unified Video Completion from Arbitrary Spatiotemporal Patches via In-Context Conditioning
par: Cai, Minghong, et autres
Publié: (2025)
par: Cai, Minghong, et autres
Publié: (2025)
CharacterFactory: Sampling Consistent Characters with GANs for Diffusion Models
par: Wang, Qinghe, et autres
Publié: (2024)
par: Wang, Qinghe, et autres
Publié: (2024)
UNIC: Unified In-Context Video Editing
par: Ye, Zixuan, et autres
Publié: (2025)
par: Ye, Zixuan, et autres
Publié: (2025)
FilmWeaver: Weaving Consistent Multi-Shot Videos with Cache-Guided Autoregressive Diffusion
par: Luo, Xiangyang, et autres
Publié: (2025)
par: Luo, Xiangyang, et autres
Publié: (2025)
FullDiT2: Efficient In-Context Conditioning for Video Diffusion Transformers
par: He, Xuanhua, et autres
Publié: (2025)
par: He, Xuanhua, et autres
Publié: (2025)
Video2LoRA: Unified Semantic-Controlled Video Generation via Per-Reference-Video LoRA
par: Wu, Zexi, et autres
Publié: (2026)
par: Wu, Zexi, et autres
Publié: (2026)
Visual-Aware CoT: Achieving High-Fidelity Visual Consistency in Unified Models
par: Ye, Zixuan, et autres
Publié: (2025)
par: Ye, Zixuan, et autres
Publié: (2025)
Rethinking Position Embedding as a Context Controller for Multi-Reference and Multi-Shot Video Generation
par: Huang, Binyuan, et autres
Publié: (2026)
par: Huang, Binyuan, et autres
Publié: (2026)
ShotDirector: Directorially Controllable Multi-Shot Video Generation with Cinematographic Transitions
par: Wu, Xiaoxue, et autres
Publié: (2025)
par: Wu, Xiaoxue, et autres
Publié: (2025)
Scaling Image and Video Generation via Test-Time Evolutionary Search
par: He, Haoran, et autres
Publié: (2025)
par: He, Haoran, et autres
Publié: (2025)
Position: Interactive Generative Video as Next-Generation Game Engine
par: Yu, Jiwen, et autres
Publié: (2025)
par: Yu, Jiwen, et autres
Publié: (2025)
EchoShot: Multi-Shot Portrait Video Generation
par: Wang, Jiahao, et autres
Publié: (2025)
par: Wang, Jiahao, et autres
Publié: (2025)
SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints
par: Bai, Jianhong, et autres
Publié: (2024)
par: Bai, Jianhong, et autres
Publié: (2024)
StyleMaster: Stylize Your Video with Artistic Generation and Translation
par: Ye, Zixuan, et autres
Publié: (2024)
par: Ye, Zixuan, et autres
Publié: (2024)
Context as Memory: Scene-Consistent Interactive Long Video Generation with Memory Retrieval
par: Yu, Jiwen, et autres
Publié: (2025)
par: Yu, Jiwen, et autres
Publié: (2025)
DecMem: Towards Minute-Long Consistent World Generation with Decoupled Memory
par: Yang, Zhenhao, et autres
Publié: (2026)
par: Yang, Zhenhao, et autres
Publié: (2026)
ID-Animator: Zero-Shot Identity-Preserving Human Video Generation
par: He, Xuanhua, et autres
Publié: (2024)
par: He, Xuanhua, et autres
Publié: (2024)
MSVBench: Towards Human-Level Evaluation of Multi-Shot Video Generation
par: Shi, Haoyuan, et autres
Publié: (2026)
par: Shi, Haoyuan, et autres
Publié: (2026)
In-Context Audio Control of Video Diffusion Transformers
par: Liu, Wenze, et autres
Publié: (2025)
par: Liu, Wenze, et autres
Publié: (2025)
ShotAdapter: Text-to-Multi-Shot Video Generation with Diffusion Models
par: Kara, Ozgur, et autres
Publié: (2025)
par: Kara, Ozgur, et autres
Publié: (2025)
ShotVerse: Advancing Cinematic Camera Control for Text-Driven Multi-Shot Video Creation
par: Yang, Songlin, et autres
Publié: (2026)
par: Yang, Songlin, et autres
Publié: (2026)
ReCamMaster: Camera-Controlled Generative Rendering from A Single Video
par: Bai, Jianhong, et autres
Publié: (2025)
par: Bai, Jianhong, et autres
Publié: (2025)
Learning Video Generation for Robotic Manipulation with Collaborative Trajectory Control
par: Fu, Xiao, et autres
Publié: (2025)
par: Fu, Xiao, et autres
Publié: (2025)
High-Performance Few-Shot Segmentation with Foundation Models: An Empirical Study
par: Chang, Shijie, et autres
Publié: (2024)
par: Chang, Shijie, et autres
Publié: (2024)
SKALD: Learning-Based Shot Assembly for Coherent Multi-Shot Video Creation
par: Lu, Chen Yi, et autres
Publié: (2025)
par: Lu, Chen Yi, et autres
Publié: (2025)
Documents similaires
-
CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation
par: Wang, Qinghe, et autres
Publié: (2025) -
RelightMaster: Precise Video Relighting with Multi-plane Light Images
par: Bian, Weikang, et autres
Publié: (2025) -
ShotStream: Streaming Multi-Shot Video Generation for Interactive Storytelling
par: Luo, Yawen, et autres
Publié: (2026) -
ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning
par: Huang, Yuzhou, et autres
Publié: (2025) -
VFXMaster: Unlocking Dynamic Visual Effect Generation via In-Context Learning
par: Li, Baolu, et autres
Publié: (2025)