STORYANCHORS: Generating Consistent Multi-Scene Story Frames for Long-Form Narratives
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Bo, Huang, Haoyang, Lu, Zhiying, Liu, Fengyuan, Ma, Guoqing, Yuan, Jianlong, Zhang, Yuan, Duan, Nan, Jiang, Daxin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Frame-Level Captions for Long Video Generation with Complex Multi Scenes
di: Zheng, Guangcong, et al.
Pubblicazione: (2025)
di: Zheng, Guangcong, et al.
Pubblicazione: (2025)
Generative Pre-trained Autoregressive Diffusion Transformer
di: Zhang, Yuan, et al.
Pubblicazione: (2025)
di: Zhang, Yuan, et al.
Pubblicazione: (2025)
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
di: Guo, Yuxin, et al.
Pubblicazione: (2025)
di: Guo, Yuxin, et al.
Pubblicazione: (2025)
SceneDecorator: Towards Scene-Oriented Story Generation with Scene Planning and Scene Consistency
di: Song, Quanjian, et al.
Pubblicazione: (2025)
di: Song, Quanjian, et al.
Pubblicazione: (2025)
Teacher-Feature Drifting: One-Step Diffusion Distillation with Pretrained Diffusion Representations
di: Zhang, Yuan, et al.
Pubblicazione: (2026)
di: Zhang, Yuan, et al.
Pubblicazione: (2026)
Mask$^2$DiT: Dual Mask-based Diffusion Transformer for Multi-Scene Long Video Generation
di: Qi, Tianhao, et al.
Pubblicazione: (2025)
di: Qi, Tianhao, et al.
Pubblicazione: (2025)
Storynizor: Consistent Story Generation via Inter-Frame Synchronized and Shuffled ID Injection
di: Ma, Yuhang, et al.
Pubblicazione: (2024)
di: Ma, Yuhang, et al.
Pubblicazione: (2024)
Narrative Weaver: Towards Controllable Long-Range Visual Consistency with Multi-Modal Conditioning
di: Yao, Zhengjian, et al.
Pubblicazione: (2026)
di: Yao, Zhengjian, et al.
Pubblicazione: (2026)
DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion
di: He, Huiguo, et al.
Pubblicazione: (2024)
di: He, Huiguo, et al.
Pubblicazione: (2024)
VideoAuteur: Towards Long Narrative Video Generation
di: Xiao, Junfei, et al.
Pubblicazione: (2025)
di: Xiao, Junfei, et al.
Pubblicazione: (2025)
Enhancing Train-Free Infinite-Frame Generation for Consistent Long Videos
di: Feng, X., et al.
Pubblicazione: (2026)
di: Feng, X., et al.
Pubblicazione: (2026)
AutoScape: Geometry-Consistent Long-Horizon Scene Generation
di: Chen, Jiacheng, et al.
Pubblicazione: (2025)
di: Chen, Jiacheng, et al.
Pubblicazione: (2025)
A Survey on Future Frame Synthesis: Bridging Deterministic and Generative Approaches
di: Ming, Ruibo, et al.
Pubblicazione: (2024)
di: Ming, Ruibo, et al.
Pubblicazione: (2024)
MV-Adapter: Multi-view Consistent Image Generation Made Easy
di: Huang, Zehuan, et al.
Pubblicazione: (2024)
di: Huang, Zehuan, et al.
Pubblicazione: (2024)
Focus-Consistent Multi-Level Aggregation for Compositional Zero-Shot Learning
di: Dai, Fengyuan, et al.
Pubblicazione: (2024)
di: Dai, Fengyuan, et al.
Pubblicazione: (2024)
StoryDiffusion: Consistent Self-Attention for Long-Range Image and Video Generation
di: Zhou, Yupeng, et al.
Pubblicazione: (2024)
di: Zhou, Yupeng, et al.
Pubblicazione: (2024)
Voyager: Long-Range and World-Consistent Video Diffusion for Explorable 3D Scene Generation
di: Huang, Tianyu, et al.
Pubblicazione: (2025)
di: Huang, Tianyu, et al.
Pubblicazione: (2025)
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency
di: Xie, Yiming, et al.
Pubblicazione: (2024)
di: Xie, Yiming, et al.
Pubblicazione: (2024)
SetPO: Set-Level Policy Optimization for Diversity-Preserving LLM Reasoning
di: Li, Chenyi, et al.
Pubblicazione: (2026)
di: Li, Chenyi, et al.
Pubblicazione: (2026)
Thinking with Frames: Generative Video Distortion Evaluation via Frame Reward Model
di: Wang, Yuan, et al.
Pubblicazione: (2026)
di: Wang, Yuan, et al.
Pubblicazione: (2026)
StoryMem: Multi-shot Long Video Storytelling with Memory
di: Zhang, Kaiwen, et al.
Pubblicazione: (2025)
di: Zhang, Kaiwen, et al.
Pubblicazione: (2025)
Pack and Force Your Memory: Long-form and Consistent Video Generation
di: Wu, Xiaofei, et al.
Pubblicazione: (2025)
di: Wu, Xiaofei, et al.
Pubblicazione: (2025)
Owl-1: Omni World Model for Consistent Long Video Generation
di: Huang, Yuanhui, et al.
Pubblicazione: (2024)
di: Huang, Yuanhui, et al.
Pubblicazione: (2024)
VideoMV: Consistent Multi-View Generation Based on Large Video Generative Model
di: Zuo, Qi, et al.
Pubblicazione: (2024)
di: Zuo, Qi, et al.
Pubblicazione: (2024)
Narrative Aligned Long Form Video Question Answering
di: Jain, Rahul, et al.
Pubblicazione: (2026)
di: Jain, Rahul, et al.
Pubblicazione: (2026)
ScenePainter: Semantically Consistent Perpetual 3D Scene Generation with Concept Relation Alignment
di: Xia, Chong, et al.
Pubblicazione: (2025)
di: Xia, Chong, et al.
Pubblicazione: (2025)
Enhancing Long Video Question Answering with Scene-Localized Frame Grouping
di: Yang, Xuyi, et al.
Pubblicazione: (2025)
di: Yang, Xuyi, et al.
Pubblicazione: (2025)
Generative Photography: Scene-Consistent Camera Control for Realistic Text-to-Image Synthesis
di: Yuan, Yu, et al.
Pubblicazione: (2024)
di: Yuan, Yu, et al.
Pubblicazione: (2024)
Detecting AI-Generated Video via Frame Consistency
di: Ma, Long, et al.
Pubblicazione: (2024)
di: Ma, Long, et al.
Pubblicazione: (2024)
Elastic Interaction Energy-Informed Real-Time Traffic Scene Perception
di: Feng, Yaxin, et al.
Pubblicazione: (2023)
di: Feng, Yaxin, et al.
Pubblicazione: (2023)
ReDiStory: Region-Disentangled Diffusion for Consistent Visual Story Generation
di: Sarkar, Ayushman, et al.
Pubblicazione: (2026)
di: Sarkar, Ayushman, et al.
Pubblicazione: (2026)
Thinking with Novel Views: A Systematic Analysis of Generative-Augmented Spatial Intelligence
di: Zhang, Yanbing, et al.
Pubblicazione: (2026)
di: Zhang, Yanbing, et al.
Pubblicazione: (2026)
Mango-GS: Enhancing Spatio-Temporal Consistency in Dynamic Scenes Reconstruction using Multi-Frame Node-Guided 4D Gaussian Splatting
di: Huang, Tingxuan, et al.
Pubblicazione: (2026)
di: Huang, Tingxuan, et al.
Pubblicazione: (2026)
FreePCA: Integrating Consistency Information across Long-short Frames in Training-free Long Video Generation via Principal Component Analysis
di: Tan, Jiangtong, et al.
Pubblicazione: (2025)
di: Tan, Jiangtong, et al.
Pubblicazione: (2025)
Memory Forcing: Spatio-Temporal Memory for Consistent Scene Generation on Minecraft
di: Huang, Junchao, et al.
Pubblicazione: (2025)
di: Huang, Junchao, et al.
Pubblicazione: (2025)
SPADE: Spatial-Aware Denoising Network for Open-vocabulary Panoptic Scene Graph Generation with Long- and Local-range Context Reasoning
di: Hu, Xin, et al.
Pubblicazione: (2025)
di: Hu, Xin, et al.
Pubblicazione: (2025)
Context as Memory: Scene-Consistent Interactive Long Video Generation with Memory Retrieval
di: Yu, Jiwen, et al.
Pubblicazione: (2025)
di: Yu, Jiwen, et al.
Pubblicazione: (2025)
WithAnyone: Towards Controllable and ID Consistent Image Generation
di: Xu, Hengyuan, et al.
Pubblicazione: (2025)
di: Xu, Hengyuan, et al.
Pubblicazione: (2025)
FlowNar: Scalable Streaming Narration for Long-Form Videos
di: Zhong, Zeyun, et al.
Pubblicazione: (2026)
di: Zhong, Zeyun, et al.
Pubblicazione: (2026)
ConsDreamer: Advancing Multi-View Consistency for Zero-Shot Text-to-3D Generation
di: Zhou, Yuan, et al.
Pubblicazione: (2025)
di: Zhou, Yuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Frame-Level Captions for Long Video Generation with Complex Multi Scenes
di: Zheng, Guangcong, et al.
Pubblicazione: (2025) -
Generative Pre-trained Autoregressive Diffusion Transformer
di: Zhang, Yuan, et al.
Pubblicazione: (2025) -
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
di: Guo, Yuxin, et al.
Pubblicazione: (2025) -
SceneDecorator: Towards Scene-Oriented Story Generation with Scene Planning and Scene Consistency
di: Song, Quanjian, et al.
Pubblicazione: (2025) -
Teacher-Feature Drifting: One-Step Diffusion Distillation with Pretrained Diffusion Representations
di: Zhang, Yuan, et al.
Pubblicazione: (2026)