MovieBench: A Hierarchical Movie Level Dataset for Long Video Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Weijia, Liu, Mingyu, Zhu, Zeyu, Xia, Xi, Feng, Haoen, Wang, Wen, Lin, Kevin Qinghong, Shen, Chunhua, Shou, Mike Zheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Automated Movie Generation via Multi-Agent CoT Planning
di: Wu, Weijia, et al.
Pubblicazione: (2025)
di: Wu, Weijia, et al.
Pubblicazione: (2025)
MovieDreamer: Hierarchical Generation for Coherent Long Visual Sequence
di: Zhao, Canyu, et al.
Pubblicazione: (2024)
di: Zhao, Canyu, et al.
Pubblicazione: (2024)
Paper2Video: Automatic Video Generation from Scientific Papers
di: Zhu, Zeyu, et al.
Pubblicazione: (2025)
di: Zhu, Zeyu, et al.
Pubblicazione: (2025)
VLog: Video-Language Models by Generative Retrieval of Narration Vocabulary
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2025)
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2025)
Multi-human Interactive Talking Dataset
di: Zhu, Zeyu, et al.
Pubblicazione: (2025)
di: Zhu, Zeyu, et al.
Pubblicazione: (2025)
Code2Video: A Code-centric Paradigm for Educational Video Generation
di: Chen, Yanzhe, et al.
Pubblicazione: (2025)
di: Chen, Yanzhe, et al.
Pubblicazione: (2025)
MovieSum: An Abstractive Summarization Dataset for Movie Screenplays
di: Saxena, Rohit, et al.
Pubblicazione: (2024)
di: Saxena, Rohit, et al.
Pubblicazione: (2024)
VideoMind: A Chain-of-LoRA Agent for Temporal-Grounded Video Reasoning
di: Liu, Ye, et al.
Pubblicazione: (2025)
di: Liu, Ye, et al.
Pubblicazione: (2025)
Soap2Soap: Long Cinematic Video Remaking via Multi-Agent Collaboration
di: Song, Yiren, et al.
Pubblicazione: (2026)
di: Song, Yiren, et al.
Pubblicazione: (2026)
Long-Context Autoregressive Video Modeling with Next-Frame Prediction
di: Gu, Yuchao, et al.
Pubblicazione: (2025)
di: Gu, Yuchao, et al.
Pubblicazione: (2025)
FocusUI: Efficient UI Grounding via Position-Preserving Visual Token Selection
di: Ouyang, Mingyu, et al.
Pubblicazione: (2026)
di: Ouyang, Mingyu, et al.
Pubblicazione: (2026)
Emotional Movie Clip Dataset
di: Vijaykrishnan, Anirudhan
Pubblicazione: (2026)
di: Vijaykrishnan, Anirudhan
Pubblicazione: (2026)
MovieCORE: COgnitive REasoning in Movies
di: Faure, Gueter Josmy, et al.
Pubblicazione: (2025)
di: Faure, Gueter Josmy, et al.
Pubblicazione: (2025)
Movie Facts and Fibs (MF$^2$): A Benchmark for Long Movie Understanding
di: Zaranis, Emmanouil, et al.
Pubblicazione: (2025)
di: Zaranis, Emmanouil, et al.
Pubblicazione: (2025)
MovieChat+: Question-aware Sparse Memory for Long Video Question Answering
di: Song, Enxin, et al.
Pubblicazione: (2024)
di: Song, Enxin, et al.
Pubblicazione: (2024)
ShowUI-$π$: Flow-based Generative Models as GUI Dexterous Hands
di: Hu, Siyuan, et al.
Pubblicazione: (2025)
di: Hu, Siyuan, et al.
Pubblicazione: (2025)
Learning Long-form Video Prior via Generative Pre-Training
di: Xie, Jinheng, et al.
Pubblicazione: (2024)
di: Xie, Jinheng, et al.
Pubblicazione: (2024)
StoryMovie: A Dataset for Semantic Alignment of Visual Stories with Movie Scripts and Subtitles
di: Oliveira, Daniel, et al.
Pubblicazione: (2026)
di: Oliveira, Daniel, et al.
Pubblicazione: (2026)
GameWorld: Towards Standardized and Verifiable Evaluation of Multimodal Game Agents
di: Ouyang, Mingyu, et al.
Pubblicazione: (2026)
di: Ouyang, Mingyu, et al.
Pubblicazione: (2026)
DiffuMask: Synthesizing Images with Pixel-level Annotations for Semantic Segmentation Using Diffusion Models
di: Wu, Weijia, et al.
Pubblicazione: (2023)
di: Wu, Weijia, et al.
Pubblicazione: (2023)
Maverick Movies
di: Herbert, Daniel
Pubblicazione: (2023)
di: Herbert, Daniel
Pubblicazione: (2023)
The Phonograph Movies
di: Parker, David L., et al.
Pubblicazione: (1975)
di: Parker, David L., et al.
Pubblicazione: (1975)
Librarians in the Movies.
di: Raish, Martin
Pubblicazione: (1998)
di: Raish, Martin
Pubblicazione: (1998)
Monster Movies?
di: Vaughn, Susan
Pubblicazione: (1971)
di: Vaughn, Susan
Pubblicazione: (1971)
Movie Bubble: A Group-Centric Movie Recommendation System
di: Sk. Mujafar Ahmed, et al.
Pubblicazione: (2026)
di: Sk. Mujafar Ahmed, et al.
Pubblicazione: (2026)
Movie101v2: Improved Movie Narration Benchmark
di: Yue, Zihao, et al.
Pubblicazione: (2024)
di: Yue, Zihao, et al.
Pubblicazione: (2024)
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
di: Zheng, Junjie, et al.
Pubblicazione: (2025)
di: Zheng, Junjie, et al.
Pubblicazione: (2025)
MovieCharacter: A Tuning-Free Framework for Controllable Character Video Synthesis
di: Qiu, Di, et al.
Pubblicazione: (2024)
di: Qiu, Di, et al.
Pubblicazione: (2024)
Think or Not? Selective Reasoning via Reinforcement Learning for Vision-Language Models
di: Wang, Jiaqi, et al.
Pubblicazione: (2025)
di: Wang, Jiaqi, et al.
Pubblicazione: (2025)
MovieChat: From Dense Token to Sparse Memory for Long Video Understanding
di: Song, Enxin, et al.
Pubblicazione: (2023)
di: Song, Enxin, et al.
Pubblicazione: (2023)
Movie Recommendation with Poster Attention via Multi-modal Transformer Feature Fusion
di: Xia, Linhan, et al.
Pubblicazione: (2024)
di: Xia, Linhan, et al.
Pubblicazione: (2024)
Chapter 3: Movies
di: Alshahrani, Faraj
Pubblicazione: (2026)
di: Alshahrani, Faraj
Pubblicazione: (2026)
Which Movie To Watch!
di: Rajan, Kohulan
Pubblicazione: (2026)
di: Rajan, Kohulan
Pubblicazione: (2026)
Which Movie To Watch!
di: Rajan, Kohulan
Pubblicazione: (2025)
di: Rajan, Kohulan
Pubblicazione: (2025)
Beyond the Movie Theater
di: Waller, Gregory A.
Pubblicazione: (2023)
di: Waller, Gregory A.
Pubblicazione: (2023)
Positive Microbiology in the Movies
di: Manuel Sánchez‐Angulo
Pubblicazione: (2025)
di: Manuel Sánchez‐Angulo
Pubblicazione: (2025)
MovieTeller: Tool-augmented Movie Synopsis with ID Consistent Progressive Abstraction
di: Li, Yizhi, et al.
Pubblicazione: (2026)
di: Li, Yizhi, et al.
Pubblicazione: (2026)
Sharp Focus on Film; A Brief Guide to Research on Movies and Movie People.
di: Smith, Phil, et al.
Pubblicazione: (1973)
di: Smith, Phil, et al.
Pubblicazione: (1973)
Binge Watch: Reproducible Multimodal Benchmarks Datasets for Large-Scale Movie Recommendation on MovieLens-10M and 20M
di: Spillo, Giuseppe, et al.
Pubblicazione: (2026)
di: Spillo, Giuseppe, et al.
Pubblicazione: (2026)
InfiniBench: A Benchmark for Large Multi-Modal Models in Long-Form Movies and TV Shows
di: Ataallah, Kirolos, et al.
Pubblicazione: (2024)
di: Ataallah, Kirolos, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Automated Movie Generation via Multi-Agent CoT Planning
di: Wu, Weijia, et al.
Pubblicazione: (2025) -
MovieDreamer: Hierarchical Generation for Coherent Long Visual Sequence
di: Zhao, Canyu, et al.
Pubblicazione: (2024) -
Paper2Video: Automatic Video Generation from Scientific Papers
di: Zhu, Zeyu, et al.
Pubblicazione: (2025) -
VLog: Video-Language Models by Generative Retrieval of Narration Vocabulary
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2025) -
Multi-human Interactive Talking Dataset
di: Zhu, Zeyu, et al.
Pubblicazione: (2025)