EvalVerse: Pipeline-Aware and Expert-Calibrated Benchmarking for Professional Cinematic Video Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Songlin, Zhong, Haobin, Zhang, Ruilin, Zhao, Xiaotong, Li, Shuai, Zheng, Kai, Yang, Xuyi, Wang, Zhe, Tang, Zhenchen, Li, Yang, Gu, Bohai, Peng, Zhengwei, Huang, Yidan, Luo, Mengzhou, Bo, Yihang, Feng, Dalu, Zhang, Yujia, Ma, Juntao, Wang, Ruiqi, Zhang, Lvmin, Guo, Yuwei, Guan, Frank, Agrawala, Maneesh, Fu, Hongbo, Zhao, Alan, Rao, Anyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ShotVerse: Advancing Cinematic Camera Control for Text-Driven Multi-Shot Video Creation
di: Yang, Songlin, et al.
Pubblicazione: (2026)
di: Yang, Songlin, et al.
Pubblicazione: (2026)
Transparent Image Layer Diffusion using Latent Transparency
di: Zhang, Lvmin, et al.
Pubblicazione: (2024)
di: Zhang, Lvmin, et al.
Pubblicazione: (2024)
View-oriented Conversation Compiler for Agent Trace Analysis
di: Zhang, Lvmin, et al.
Pubblicazione: (2026)
di: Zhang, Lvmin, et al.
Pubblicazione: (2026)
Taming Flow-based I2V Models for Creative Video Editing
di: Kong, Xianghao, et al.
Pubblicazione: (2025)
di: Kong, Xianghao, et al.
Pubblicazione: (2025)
Frame Context Packing and Drift Prevention in Next-Frame-Prediction Video Diffusion Models
di: Zhang, Lvmin, et al.
Pubblicazione: (2025)
di: Zhang, Lvmin, et al.
Pubblicazione: (2025)
Instance Segmentation of Scene Sketches Using Natural Image Priors
di: Tang, Mia, et al.
Pubblicazione: (2025)
di: Tang, Mia, et al.
Pubblicazione: (2025)
ScriptViz: A Visualization Tool to Aid Scriptwriting based on a Large Movie Database
di: Rao, Anyi, et al.
Pubblicazione: (2024)
di: Rao, Anyi, et al.
Pubblicazione: (2024)
CineVision: An Interactive Pre-visualization Storyboard System for Director-Cinematographer Collaboration
di: Wei, Zheng, et al.
Pubblicazione: (2025)
di: Wei, Zheng, et al.
Pubblicazione: (2025)
Pretraining Frame Preservation for Lightweight Autoregressive Video History Embedding
di: Zhang, Lvmin, et al.
Pubblicazione: (2025)
di: Zhang, Lvmin, et al.
Pubblicazione: (2025)
Captain Cinema: Towards Short Movie Generation
di: Xiao, Junfei, et al.
Pubblicazione: (2025)
di: Xiao, Junfei, et al.
Pubblicazione: (2025)
HandEval: Taking the First Step Towards Hand Quality Evaluation in Generated Images
di: Wang, Zichuan, et al.
Pubblicazione: (2025)
di: Wang, Zichuan, et al.
Pubblicazione: (2025)
MoVer: Motion Verification for Motion Graphics Animations
di: Ma, Jiaju, et al.
Pubblicazione: (2025)
di: Ma, Jiaju, et al.
Pubblicazione: (2025)
Radial Attention: $O(n\log n)$ Sparse Attention with Energy Decay for Long Video Generation
di: Li, Xingyang, et al.
Pubblicazione: (2025)
di: Li, Xingyang, et al.
Pubblicazione: (2025)
Pseudo-Unification: Entropy Probing Reveals Divergent Information Patterns in Unified Multimodal Models
di: Yang, Songlin, et al.
Pubblicazione: (2026)
di: Yang, Songlin, et al.
Pubblicazione: (2026)
Mixture of Contexts for Long Video Generation
di: Cai, Shengqu, et al.
Pubblicazione: (2025)
di: Cai, Shengqu, et al.
Pubblicazione: (2025)
AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning
di: Guo, Yuwei, et al.
Pubblicazione: (2023)
di: Guo, Yuwei, et al.
Pubblicazione: (2023)
CineVerse: Consistent Keyframe Synthesis for Cinematic Scene Composition
di: Phung, Quynh, et al.
Pubblicazione: (2025)
di: Phung, Quynh, et al.
Pubblicazione: (2025)
A timespace of zero‐COVID in Southwest China: Building community, governing time
di: Xuyi Zhao
Pubblicazione: (2024)
di: Xuyi Zhao
Pubblicazione: (2024)
Hollywood Town: Long-Video Generation via Cross-Modal Multi-Agent Orchestration
di: Wei, Zheng, et al.
Pubblicazione: (2025)
di: Wei, Zheng, et al.
Pubblicazione: (2025)
Revisiting MLLM Based Image Quality Assessment: Errors and Remedy
di: Tang, Zhenchen, et al.
Pubblicazione: (2025)
di: Tang, Zhenchen, et al.
Pubblicazione: (2025)
Fast Stochastic Policy Gradient: Negative Momentum for Reinforcement Learning
di: Zhang, Haobin, et al.
Pubblicazione: (2024)
di: Zhang, Haobin, et al.
Pubblicazione: (2024)
StreamDiffusionV2: A Streaming System for Dynamic and Interactive Video Generation
di: Feng, Tianrui, et al.
Pubblicazione: (2025)
di: Feng, Tianrui, et al.
Pubblicazione: (2025)
Mode Seeking meets Mean Seeking for Fast Long Video Generation
di: Cai, Shengqu, et al.
Pubblicazione: (2026)
di: Cai, Shengqu, et al.
Pubblicazione: (2026)
Place-it-R1: Unlocking Environment-aware Reasoning Potential of MLLM for Video Object Insertion
di: Gu, Bohai, et al.
Pubblicazione: (2026)
di: Gu, Bohai, et al.
Pubblicazione: (2026)
TableNet A Large-Scale Table Dataset with LLM-Powered Autonomous
di: Zhang, Ruilin, et al.
Pubblicazione: (2026)
di: Zhang, Ruilin, et al.
Pubblicazione: (2026)
Endogenous Reprompting: Self-Evolving Cognitive Alignment for Unified Multimodal Models
di: Tang, Zhenchen, et al.
Pubblicazione: (2026)
di: Tang, Zhenchen, et al.
Pubblicazione: (2026)
Uncovering Conceptual Blindspots in Generative Image Models Using Sparse Autoencoders
di: Bohacek, Matyas, et al.
Pubblicazione: (2025)
di: Bohacek, Matyas, et al.
Pubblicazione: (2025)
Self-Consistency for LLM-Based Motion Trajectory Generation and Verification
di: Ma, Jiaju, et al.
Pubblicazione: (2026)
di: Ma, Jiaju, et al.
Pubblicazione: (2026)
M-Eval: A Heterogeneity-Based Framework for Multi-evidence Validation in Medical RAG Systems
di: Sun, Mengzhou, et al.
Pubblicazione: (2025)
di: Sun, Mengzhou, et al.
Pubblicazione: (2025)
Block and Detail: Scaffolding Sketch-to-Image Generation
di: Sarukkai, Vishnu, et al.
Pubblicazione: (2024)
di: Sarukkai, Vishnu, et al.
Pubblicazione: (2024)
Functional BART with Shape Priors: A Bayesian Tree Approach to Constrained Functional Regression
di: Cao, Jiahao, et al.
Pubblicazione: (2025)
di: Cao, Jiahao, et al.
Pubblicazione: (2025)
Bridging the Gulf of Envisioning: Cognitive Design Challenges in LLM Interfaces
di: Subramonyam, Hariharan, et al.
Pubblicazione: (2023)
di: Subramonyam, Hariharan, et al.
Pubblicazione: (2023)
EmphasisChecker: A Tool for Guiding Chart and Caption Emphasis
di: Kim, Dae Hyun, et al.
Pubblicazione: (2023)
di: Kim, Dae Hyun, et al.
Pubblicazione: (2023)
WorldCraft: From Camera Navigation to Object Manipulation in Interactive Video World Models
di: Gu, Bohai, et al.
Pubblicazione: (2026)
di: Gu, Bohai, et al.
Pubblicazione: (2026)
TableCenterNet: A one-stage network for table structure recognition
di: Xiao, Anyi, et al.
Pubblicazione: (2025)
di: Xiao, Anyi, et al.
Pubblicazione: (2025)
Dense Semantic Matching with VGGT Prior
di: Yang, Songlin, et al.
Pubblicazione: (2025)
di: Yang, Songlin, et al.
Pubblicazione: (2025)
LouvreSAE: Sparse Autoencoders for Interpretable and Controllable Style Transfer
di: Panda, Raina, et al.
Pubblicazione: (2025)
di: Panda, Raina, et al.
Pubblicazione: (2025)
What makes an action sequence enjoyable to watch?
di: Chou, Jean-Peïc, et al.
Pubblicazione: (2026)
di: Chou, Jean-Peïc, et al.
Pubblicazione: (2026)
Facilitators and Barriers to Standardized Community Hypertension Management in Chinese Older Adults From Service Providers and Recipients: A Qualitative Study
di: Zhiyao Xiong, et al.
Pubblicazione: (2025)
di: Zhiyao Xiong, et al.
Pubblicazione: (2025)
UniVidX: A Unified Multimodal Framework for Versatile Video Generation via Diffusion Priors
di: Chen, Houyuan, et al.
Pubblicazione: (2026)
di: Chen, Houyuan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
ShotVerse: Advancing Cinematic Camera Control for Text-Driven Multi-Shot Video Creation
di: Yang, Songlin, et al.
Pubblicazione: (2026) -
Transparent Image Layer Diffusion using Latent Transparency
di: Zhang, Lvmin, et al.
Pubblicazione: (2024) -
View-oriented Conversation Compiler for Agent Trace Analysis
di: Zhang, Lvmin, et al.
Pubblicazione: (2026) -
Taming Flow-based I2V Models for Creative Video Editing
di: Kong, Xianghao, et al.
Pubblicazione: (2025) -
Frame Context Packing and Drift Prevention in Next-Frame-Prediction Video Diffusion Models
di: Zhang, Lvmin, et al.
Pubblicazione: (2025)