STORYANCHORS: Generating Consistent Multi-Scene Story Frames for Long-Form Narratives
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Bo, Huang, Haoyang, Lu, Zhiying, Liu, Fengyuan, Ma, Guoqing, Yuan, Jianlong, Zhang, Yuan, Duan, Nan, Jiang, Daxin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Frame-Level Captions for Long Video Generation with Complex Multi Scenes
par: Zheng, Guangcong, et autres
Publié: (2025)
par: Zheng, Guangcong, et autres
Publié: (2025)
Generative Pre-trained Autoregressive Diffusion Transformer
par: Zhang, Yuan, et autres
Publié: (2025)
par: Zhang, Yuan, et autres
Publié: (2025)
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
par: Guo, Yuxin, et autres
Publié: (2025)
par: Guo, Yuxin, et autres
Publié: (2025)
SceneDecorator: Towards Scene-Oriented Story Generation with Scene Planning and Scene Consistency
par: Song, Quanjian, et autres
Publié: (2025)
par: Song, Quanjian, et autres
Publié: (2025)
Teacher-Feature Drifting: One-Step Diffusion Distillation with Pretrained Diffusion Representations
par: Zhang, Yuan, et autres
Publié: (2026)
par: Zhang, Yuan, et autres
Publié: (2026)
Mask$^2$DiT: Dual Mask-based Diffusion Transformer for Multi-Scene Long Video Generation
par: Qi, Tianhao, et autres
Publié: (2025)
par: Qi, Tianhao, et autres
Publié: (2025)
Storynizor: Consistent Story Generation via Inter-Frame Synchronized and Shuffled ID Injection
par: Ma, Yuhang, et autres
Publié: (2024)
par: Ma, Yuhang, et autres
Publié: (2024)
Narrative Weaver: Towards Controllable Long-Range Visual Consistency with Multi-Modal Conditioning
par: Yao, Zhengjian, et autres
Publié: (2026)
par: Yao, Zhengjian, et autres
Publié: (2026)
DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion
par: He, Huiguo, et autres
Publié: (2024)
par: He, Huiguo, et autres
Publié: (2024)
VideoAuteur: Towards Long Narrative Video Generation
par: Xiao, Junfei, et autres
Publié: (2025)
par: Xiao, Junfei, et autres
Publié: (2025)
Enhancing Train-Free Infinite-Frame Generation for Consistent Long Videos
par: Feng, X., et autres
Publié: (2026)
par: Feng, X., et autres
Publié: (2026)
AutoScape: Geometry-Consistent Long-Horizon Scene Generation
par: Chen, Jiacheng, et autres
Publié: (2025)
par: Chen, Jiacheng, et autres
Publié: (2025)
A Survey on Future Frame Synthesis: Bridging Deterministic and Generative Approaches
par: Ming, Ruibo, et autres
Publié: (2024)
par: Ming, Ruibo, et autres
Publié: (2024)
MV-Adapter: Multi-view Consistent Image Generation Made Easy
par: Huang, Zehuan, et autres
Publié: (2024)
par: Huang, Zehuan, et autres
Publié: (2024)
Focus-Consistent Multi-Level Aggregation for Compositional Zero-Shot Learning
par: Dai, Fengyuan, et autres
Publié: (2024)
par: Dai, Fengyuan, et autres
Publié: (2024)
StoryDiffusion: Consistent Self-Attention for Long-Range Image and Video Generation
par: Zhou, Yupeng, et autres
Publié: (2024)
par: Zhou, Yupeng, et autres
Publié: (2024)
Voyager: Long-Range and World-Consistent Video Diffusion for Explorable 3D Scene Generation
par: Huang, Tianyu, et autres
Publié: (2025)
par: Huang, Tianyu, et autres
Publié: (2025)
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency
par: Xie, Yiming, et autres
Publié: (2024)
par: Xie, Yiming, et autres
Publié: (2024)
SetPO: Set-Level Policy Optimization for Diversity-Preserving LLM Reasoning
par: Li, Chenyi, et autres
Publié: (2026)
par: Li, Chenyi, et autres
Publié: (2026)
Thinking with Frames: Generative Video Distortion Evaluation via Frame Reward Model
par: Wang, Yuan, et autres
Publié: (2026)
par: Wang, Yuan, et autres
Publié: (2026)
StoryMem: Multi-shot Long Video Storytelling with Memory
par: Zhang, Kaiwen, et autres
Publié: (2025)
par: Zhang, Kaiwen, et autres
Publié: (2025)
Pack and Force Your Memory: Long-form and Consistent Video Generation
par: Wu, Xiaofei, et autres
Publié: (2025)
par: Wu, Xiaofei, et autres
Publié: (2025)
Owl-1: Omni World Model for Consistent Long Video Generation
par: Huang, Yuanhui, et autres
Publié: (2024)
par: Huang, Yuanhui, et autres
Publié: (2024)
VideoMV: Consistent Multi-View Generation Based on Large Video Generative Model
par: Zuo, Qi, et autres
Publié: (2024)
par: Zuo, Qi, et autres
Publié: (2024)
Narrative Aligned Long Form Video Question Answering
par: Jain, Rahul, et autres
Publié: (2026)
par: Jain, Rahul, et autres
Publié: (2026)
ScenePainter: Semantically Consistent Perpetual 3D Scene Generation with Concept Relation Alignment
par: Xia, Chong, et autres
Publié: (2025)
par: Xia, Chong, et autres
Publié: (2025)
Enhancing Long Video Question Answering with Scene-Localized Frame Grouping
par: Yang, Xuyi, et autres
Publié: (2025)
par: Yang, Xuyi, et autres
Publié: (2025)
Generative Photography: Scene-Consistent Camera Control for Realistic Text-to-Image Synthesis
par: Yuan, Yu, et autres
Publié: (2024)
par: Yuan, Yu, et autres
Publié: (2024)
Detecting AI-Generated Video via Frame Consistency
par: Ma, Long, et autres
Publié: (2024)
par: Ma, Long, et autres
Publié: (2024)
Elastic Interaction Energy-Informed Real-Time Traffic Scene Perception
par: Feng, Yaxin, et autres
Publié: (2023)
par: Feng, Yaxin, et autres
Publié: (2023)
ReDiStory: Region-Disentangled Diffusion for Consistent Visual Story Generation
par: Sarkar, Ayushman, et autres
Publié: (2026)
par: Sarkar, Ayushman, et autres
Publié: (2026)
Thinking with Novel Views: A Systematic Analysis of Generative-Augmented Spatial Intelligence
par: Zhang, Yanbing, et autres
Publié: (2026)
par: Zhang, Yanbing, et autres
Publié: (2026)
Mango-GS: Enhancing Spatio-Temporal Consistency in Dynamic Scenes Reconstruction using Multi-Frame Node-Guided 4D Gaussian Splatting
par: Huang, Tingxuan, et autres
Publié: (2026)
par: Huang, Tingxuan, et autres
Publié: (2026)
FreePCA: Integrating Consistency Information across Long-short Frames in Training-free Long Video Generation via Principal Component Analysis
par: Tan, Jiangtong, et autres
Publié: (2025)
par: Tan, Jiangtong, et autres
Publié: (2025)
Memory Forcing: Spatio-Temporal Memory for Consistent Scene Generation on Minecraft
par: Huang, Junchao, et autres
Publié: (2025)
par: Huang, Junchao, et autres
Publié: (2025)
SPADE: Spatial-Aware Denoising Network for Open-vocabulary Panoptic Scene Graph Generation with Long- and Local-range Context Reasoning
par: Hu, Xin, et autres
Publié: (2025)
par: Hu, Xin, et autres
Publié: (2025)
Context as Memory: Scene-Consistent Interactive Long Video Generation with Memory Retrieval
par: Yu, Jiwen, et autres
Publié: (2025)
par: Yu, Jiwen, et autres
Publié: (2025)
WithAnyone: Towards Controllable and ID Consistent Image Generation
par: Xu, Hengyuan, et autres
Publié: (2025)
par: Xu, Hengyuan, et autres
Publié: (2025)
FlowNar: Scalable Streaming Narration for Long-Form Videos
par: Zhong, Zeyun, et autres
Publié: (2026)
par: Zhong, Zeyun, et autres
Publié: (2026)
ConsDreamer: Advancing Multi-View Consistency for Zero-Shot Text-to-3D Generation
par: Zhou, Yuan, et autres
Publié: (2025)
par: Zhou, Yuan, et autres
Publié: (2025)
Documents similaires
-
Frame-Level Captions for Long Video Generation with Complex Multi Scenes
par: Zheng, Guangcong, et autres
Publié: (2025) -
Generative Pre-trained Autoregressive Diffusion Transformer
par: Zhang, Yuan, et autres
Publié: (2025) -
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
par: Guo, Yuxin, et autres
Publié: (2025) -
SceneDecorator: Towards Scene-Oriented Story Generation with Scene Planning and Scene Consistency
par: Song, Quanjian, et autres
Publié: (2025) -
Teacher-Feature Drifting: One-Step Diffusion Distillation with Pretrained Diffusion Representations
par: Zhang, Yuan, et autres
Publié: (2026)