StoryWeaver: A Unified World Model for Knowledge-Enhanced Story Character Customization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Jinlu, Tang, Jiji, Zhang, Rongsheng, Lv, Tangjie, Sun, Xiaoshuai |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Persistent Story World Simulation with Continuous Character Customization
par: Zhang, Jinlu, et autres
Publié: (2026)
par: Zhang, Jinlu, et autres
Publié: (2026)
Let Storytelling Tell Vivid Stories: An Expressive and Fluent Multimodal Storyteller
par: Zang, Chuanqi, et autres
Publié: (2024)
par: Zang, Chuanqi, et autres
Publié: (2024)
Character-Adapter: Prompt-Guided Region Control for High-Fidelity Character Customization
par: Ma, Yuhang, et autres
Publié: (2024)
par: Ma, Yuhang, et autres
Publié: (2024)
Beyond First Impressions: Integrating Joint Multi-modal Cues for Comprehensive 3D Representation
par: Wang, Haowei, et autres
Publié: (2023)
par: Wang, Haowei, et autres
Publié: (2023)
StoryImager: A Unified and Efficient Framework for Coherent Story Visualization and Completion
par: Tao, Ming, et autres
Publié: (2024)
par: Tao, Ming, et autres
Publié: (2024)
Towards Efficient Diffusion-Based Image Editing with Instant Attention Masks
par: Zou, Siyu, et autres
Publié: (2024)
par: Zou, Siyu, et autres
Publié: (2024)
InfinityStory: Unlimited Video Generation with World Consistency and Character-Aware Shot Transitions
par: Elmoghany, Mohamed, et autres
Publié: (2026)
par: Elmoghany, Mohamed, et autres
Publié: (2026)
StoryMaker: Towards Holistic Consistent Characters in Text-to-image Generation
par: Zhou, Zhengguang, et autres
Publié: (2024)
par: Zhou, Zhengguang, et autres
Publié: (2024)
TaleDiffusion: Multi-Character Story Generation with Dialogue Rendering
par: Banerjee, Ayan, et autres
Publié: (2025)
par: Banerjee, Ayan, et autres
Publié: (2025)
ViStoryBench: Comprehensive Benchmark Suite for Story Visualization
par: Zhuang, Cailin, et autres
Publié: (2025)
par: Zhuang, Cailin, et autres
Publié: (2025)
Lay2Story: Extending Diffusion Transformers for Layout-Togglable Story Generation
par: Ma, Ao, et autres
Publié: (2025)
par: Ma, Ao, et autres
Publié: (2025)
SEED-Story: Multimodal Long Story Generation with Large Language Model
par: Yang, Shuai, et autres
Publié: (2024)
par: Yang, Shuai, et autres
Publié: (2024)
StoryGPT-V: Large Language Models as Consistent Story Visualizers
par: Shen, Xiaoqian, et autres
Publié: (2023)
par: Shen, Xiaoqian, et autres
Publié: (2023)
ReDiStory: Region-Disentangled Diffusion for Consistent Visual Story Generation
par: Sarkar, Ayushman, et autres
Publié: (2026)
par: Sarkar, Ayushman, et autres
Publié: (2026)
EmoStory: Emotion-Aware Story Generation
par: Yang, Jingyuan, et autres
Publié: (2026)
par: Yang, Jingyuan, et autres
Publié: (2026)
Masked Generative Story Transformer with Character Guidance and Caption Augmentation
par: Papadimitriou, Christos, et autres
Publié: (2024)
par: Papadimitriou, Christos, et autres
Publié: (2024)
Uni-HOI:A Unified framework for Learning the Joint distribution of Text and Human-Object Interaction
par: Zhang, Mengfei, et autres
Publié: (2026)
par: Zhang, Mengfei, et autres
Publié: (2026)
StoryTeller: Improving Long Video Description through Global Audio-Visual Character Identification
par: He, Yichen, et autres
Publié: (2024)
par: He, Yichen, et autres
Publié: (2024)
LEARN: A Story-Driven Layout-to-Image Generation Framework for STEM Instruction
par: Zhang, Maoquan, et autres
Publié: (2025)
par: Zhang, Maoquan, et autres
Publié: (2025)
DreamingComics: A Story Visualization Pipeline via Subject and Layout Customized Generation using Video Models
par: Kwon, Patrick, et autres
Publié: (2025)
par: Kwon, Patrick, et autres
Publié: (2025)
Story-Iter: A Training-free Iterative Paradigm for Long Story Visualization
par: Mao, Jiawei, et autres
Publié: (2024)
par: Mao, Jiawei, et autres
Publié: (2024)
LogiStory: A Logic-Aware Framework for Multi-Image Story Visualization
par: Meng, Chutian, et autres
Publié: (2026)
par: Meng, Chutian, et autres
Publié: (2026)
Lights, Camera, Consistency: A Multistage Pipeline for Character-Stable AI Video Stories
par: Jain, Chayan, et autres
Publié: (2025)
par: Jain, Chayan, et autres
Publié: (2025)
MICON-Bench: Benchmarking and Enhancing Multi-Image Context Image Generation in Unified Multimodal Models
par: Wu, Mingrui, et autres
Publié: (2026)
par: Wu, Mingrui, et autres
Publié: (2026)
From Shots to Stories: LLM-Assisted Video Editing with Unified Language Representations
par: Li, Yuzhi, et autres
Publié: (2025)
par: Li, Yuzhi, et autres
Publié: (2025)
FairyGen: Storied Cartoon Video from a Single Child-Drawn Character
par: Zheng, Jiayi, et autres
Publié: (2025)
par: Zheng, Jiayi, et autres
Publié: (2025)
IdentityStory: Taming Your Identity-Preserving Generator for Human-Centric Story Generation
par: Zhou, Donghao, et autres
Publié: (2025)
par: Zhou, Donghao, et autres
Publié: (2025)
Boosting Consistency in Story Visualization with Rich-Contextual Conditional Diffusion Models
par: Shen, Fei, et autres
Publié: (2024)
par: Shen, Fei, et autres
Publié: (2024)
AnyStory: Towards Unified Single and Multiple Subject Personalization in Text-to-Image Generation
par: He, Junjie, et autres
Publié: (2025)
par: He, Junjie, et autres
Publié: (2025)
Towards Unified Multimodal Editing with Enhanced Knowledge Collaboration
par: Pan, Kaihang, et autres
Publié: (2024)
par: Pan, Kaihang, et autres
Publié: (2024)
StyleTalk++: A Unified Framework for Controlling the Speaking Styles of Talking Heads
par: Wang, Suzhen, et autres
Publié: (2024)
par: Wang, Suzhen, et autres
Publié: (2024)
2K-Characters-10K-Stories: A Quality-Gated Stylized Narrative Dataset with Disentangled Control and Sequence Consistency
par: Yin, Xingxi, et autres
Publié: (2025)
par: Yin, Xingxi, et autres
Publié: (2025)
Fast Text-to-3D-Aware Face Generation and Manipulation via Direct Cross-modal Mapping and Geometric Regularization
par: Zhang, Jinlu, et autres
Publié: (2024)
par: Zhang, Jinlu, et autres
Publié: (2024)
"Previously on ..." From Recaps to Story Summarization
par: Singh, Aditya Kumar, et autres
Publié: (2024)
par: Singh, Aditya Kumar, et autres
Publié: (2024)
A Progressive Framework of Vision-language Knowledge Distillation and Alignment for Multilingual Scene
par: Zhang, Wenbo, et autres
Publié: (2024)
par: Zhang, Wenbo, et autres
Publié: (2024)
Causal-Story: Local Causal Attention Utilizing Parameter-Efficient Tuning For Visual Story Synthesis
par: Song, Tianyi, et autres
Publié: (2023)
par: Song, Tianyi, et autres
Publié: (2023)
Hierarchical Knowledge Graphs for Story Understanding in Visual Narratives
par: Chen, Yi-Chun
Publié: (2025)
par: Chen, Yi-Chun
Publié: (2025)
StoryTailor:A Zero-Shot Pipeline for Action-Rich Multi-Subject Visual Narratives
par: Hu, Jinghao, et autres
Publié: (2026)
par: Hu, Jinghao, et autres
Publié: (2026)
StoryMem: Multi-shot Long Video Storytelling with Memory
par: Zhang, Kaiwen, et autres
Publié: (2025)
par: Zhang, Kaiwen, et autres
Publié: (2025)
WorldWeaver: Generating Long-Horizon Video Worlds via Rich Perception
par: Liu, Zhiheng, et autres
Publié: (2025)
par: Liu, Zhiheng, et autres
Publié: (2025)
Documents similaires
-
Persistent Story World Simulation with Continuous Character Customization
par: Zhang, Jinlu, et autres
Publié: (2026) -
Let Storytelling Tell Vivid Stories: An Expressive and Fluent Multimodal Storyteller
par: Zang, Chuanqi, et autres
Publié: (2024) -
Character-Adapter: Prompt-Guided Region Control for High-Fidelity Character Customization
par: Ma, Yuhang, et autres
Publié: (2024) -
Beyond First Impressions: Integrating Joint Multi-modal Cues for Comprehensive 3D Representation
par: Wang, Haowei, et autres
Publié: (2023) -
StoryImager: A Unified and Efficient Framework for Coherent Story Visualization and Completion
par: Tao, Ming, et autres
Publié: (2024)