DreamingComics: A Story Visualization Pipeline via Subject and Layout Customized Generation using Video Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kwon, Patrick, Chen, Chen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DreamVideo-2: Zero-Shot Subject-Driven Video Customization with Precise Motion Control
par: Wei, Yujie, et autres
Publié: (2024)
par: Wei, Yujie, et autres
Publié: (2024)
DreamVideo-Omni: Omni-Motion Controlled Multi-Subject Video Customization with Latent Identity Reinforcement Learning
par: Wei, Yujie, et autres
Publié: (2026)
par: Wei, Yujie, et autres
Publié: (2026)
DreamSwapV: Mask-guided Subject Swapping for Any Customized Video Editing
par: Wang, Weitao, et autres
Publié: (2025)
par: Wang, Weitao, et autres
Publié: (2025)
CustomVideo: Customizing Text-to-Video Generation with Multiple Subjects
par: Wang, Zhao, et autres
Publié: (2024)
par: Wang, Zhao, et autres
Publié: (2024)
DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation
par: Jiang, Xin, et autres
Publié: (2026)
par: Jiang, Xin, et autres
Publié: (2026)
DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion
par: He, Huiguo, et autres
Publié: (2024)
par: He, Huiguo, et autres
Publié: (2024)
StoryTailor:A Zero-Shot Pipeline for Action-Rich Multi-Subject Visual Narratives
par: Hu, Jinghao, et autres
Publié: (2026)
par: Hu, Jinghao, et autres
Publié: (2026)
DreamRelation: Relation-Centric Video Customization
par: Wei, Yujie, et autres
Publié: (2025)
par: Wei, Yujie, et autres
Publié: (2025)
VideoDreamer: Customized Multi-Subject Text-to-Video Generation with Disen-Mix Finetuning on Language-Video Foundation Models
par: Chen, Hong, et autres
Publié: (2023)
par: Chen, Hong, et autres
Publié: (2023)
DreamJourney: Perpetual View Generation with Video Diffusion Models
par: Pan, Bo, et autres
Publié: (2025)
par: Pan, Bo, et autres
Publié: (2025)
DreamRelation: Bridging Customization and Relation Generation
par: Shi, Qingyu, et autres
Publié: (2024)
par: Shi, Qingyu, et autres
Publié: (2024)
SMRABooth: Subject and Motion Representation Alignment for Customized Video Generation
par: Xu, Xuancheng, et autres
Publié: (2025)
par: Xu, Xuancheng, et autres
Publié: (2025)
Bring Your Dreams to Life: Continual Text-to-Video Customization
par: Dong, Jiahua, et autres
Publié: (2025)
par: Dong, Jiahua, et autres
Publié: (2025)
Lay2Story: Extending Diffusion Transformers for Layout-Togglable Story Generation
par: Ma, Ao, et autres
Publié: (2025)
par: Ma, Ao, et autres
Publié: (2025)
StoryAgent: Customized Storytelling Video Generation via Multi-Agent Collaboration
par: Hu, Panwen, et autres
Publié: (2024)
par: Hu, Panwen, et autres
Publié: (2024)
Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models
par: Ren, Yixuan, et autres
Publié: (2024)
par: Ren, Yixuan, et autres
Publié: (2024)
Making Your Dreams A Reality: Decoding the Dreams into a Coherent Video Story from fMRI Signals
par: Fu, Yanwei, et autres
Publié: (2025)
par: Fu, Yanwei, et autres
Publié: (2025)
VideoMage: Multi-Subject and Motion Customization of Text-to-Video Diffusion Models
par: Huang, Chi-Pin, et autres
Publié: (2025)
par: Huang, Chi-Pin, et autres
Publié: (2025)
Towards Long Video Understanding via Fine-detailed Video Story Generation
par: You, Zeng, et autres
Publié: (2024)
par: You, Zeng, et autres
Publié: (2024)
FactorizedHMR: A Hybrid Framework for Video Human Mesh Recovery
par: Kwon, Patrick, et autres
Publié: (2026)
par: Kwon, Patrick, et autres
Publié: (2026)
LEARN: A Story-Driven Layout-to-Image Generation Framework for STEM Instruction
par: Zhang, Maoquan, et autres
Publié: (2025)
par: Zhang, Maoquan, et autres
Publié: (2025)
StoryWeaver: A Unified World Model for Knowledge-Enhanced Story Character Customization
par: Zhang, Jinlu, et autres
Publié: (2024)
par: Zhang, Jinlu, et autres
Publié: (2024)
DreamWorld: Unified World Modeling in Video Generation
par: Tan, Boming, et autres
Publié: (2026)
par: Tan, Boming, et autres
Publié: (2026)
OmniVCus: Feedforward Subject-driven Video Customization with Multimodal Control Conditions
par: Cai, Yuanhao, et autres
Publié: (2025)
par: Cai, Yuanhao, et autres
Publié: (2025)
DreamO: A Unified Framework for Image Customization
par: Mou, Chong, et autres
Publié: (2025)
par: Mou, Chong, et autres
Publié: (2025)
CustomContrast: A Multilevel Contrastive Perspective For Subject-Driven Text-to-Image Customization
par: Chen, Nan, et autres
Publié: (2024)
par: Chen, Nan, et autres
Publié: (2024)
ReDiStory: Region-Disentangled Diffusion for Consistent Visual Story Generation
par: Sarkar, Ayushman, et autres
Publié: (2026)
par: Sarkar, Ayushman, et autres
Publié: (2026)
DreamFrame: Enhancing Video Understanding via Automatically Generated QA and Style-Consistent Keyframes
par: Song, Zhende, et autres
Publié: (2024)
par: Song, Zhende, et autres
Publié: (2024)
AnyStory: Towards Unified Single and Multiple Subject Personalization in Text-to-Image Generation
par: He, Junjie, et autres
Publié: (2025)
par: He, Junjie, et autres
Publié: (2025)
SUGAR: Subject-Driven Video Customization in a Zero-Shot Manner
par: Zhou, Yufan, et autres
Publié: (2024)
par: Zhou, Yufan, et autres
Publié: (2024)
Manga Generation via Layout-controllable Diffusion
par: Chen, Siyu, et autres
Publié: (2024)
par: Chen, Siyu, et autres
Publié: (2024)
SEED-Story: Multimodal Long Story Generation with Large Language Model
par: Yang, Shuai, et autres
Publié: (2024)
par: Yang, Shuai, et autres
Publié: (2024)
SynMotion: Semantic-Visual Adaptation for Motion Customized Video Generation
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
DreamRunner: Fine-Grained Compositional Story-to-Video Generation with Retrieval-Augmented Motion Adaptation
par: Wang, Zun, et autres
Publié: (2024)
par: Wang, Zun, et autres
Publié: (2024)
Still-Moving: Customized Video Generation without Customized Video Data
par: Chefer, Hila, et autres
Publié: (2024)
par: Chefer, Hila, et autres
Publié: (2024)
DreamStyle: A Unified Framework for Video Stylization
par: Li, Mengtian, et autres
Publié: (2026)
par: Li, Mengtian, et autres
Publié: (2026)
DreamDA: Generative Data Augmentation with Diffusion Models
par: Fu, Yunxiang, et autres
Publié: (2024)
par: Fu, Yunxiang, et autres
Publié: (2024)
CustomTTT: Motion and Appearance Customized Video Generation via Test-Time Training
par: Bi, Xiuli, et autres
Publié: (2024)
par: Bi, Xiuli, et autres
Publié: (2024)
Spatial Diffusion for Cell Layout Generation
par: Li, Chen, et autres
Publié: (2024)
par: Li, Chen, et autres
Publié: (2024)
DreamVTON: Customizing 3D Virtual Try-on with Personalized Diffusion Models
par: Xie, Zhenyu, et autres
Publié: (2024)
par: Xie, Zhenyu, et autres
Publié: (2024)
Documents similaires
-
DreamVideo-2: Zero-Shot Subject-Driven Video Customization with Precise Motion Control
par: Wei, Yujie, et autres
Publié: (2024) -
DreamVideo-Omni: Omni-Motion Controlled Multi-Subject Video Customization with Latent Identity Reinforcement Learning
par: Wei, Yujie, et autres
Publié: (2026) -
DreamSwapV: Mask-guided Subject Swapping for Any Customized Video Editing
par: Wang, Weitao, et autres
Publié: (2025) -
CustomVideo: Customizing Text-to-Video Generation with Multiple Subjects
par: Wang, Zhao, et autres
Publié: (2024) -
DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation
par: Jiang, Xin, et autres
Publié: (2026)