T2V-CompBench: A Comprehensive Benchmark for Compositional Text-to-video Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Kaiyue, Huang, Kaiyi, Liu, Xian, Wu, Yue, Xu, Zihan, Li, Zhenguo, Liu, Xihui |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation
par: Huang, Kaiyi, et autres
Publié: (2023)
par: Huang, Kaiyi, et autres
Publié: (2023)
CompBench: Benchmarking Complex Instruction-guided Image Editing
par: Jia, Bohan, et autres
Publié: (2025)
par: Jia, Bohan, et autres
Publié: (2025)
T2I-ReasonBench: Benchmarking Reasoning-Informed Text-to-Image Generation
par: Sun, Kaiyue, et autres
Publié: (2025)
par: Sun, Kaiyue, et autres
Publié: (2025)
MLLM-CompBench: A Comparative Reasoning Benchmark for Multimodal LLMs
par: Kil, Jihyung, et autres
Publié: (2024)
par: Kil, Jihyung, et autres
Publié: (2024)
Personalized Text-to-Image Generation with Auto-Regressive Models
par: Sun, Kaiyue, et autres
Publié: (2025)
par: Sun, Kaiyue, et autres
Publié: (2025)
GenMAC: Compositional Text-to-Video Generation with Multi-Agent Collaboration
par: Huang, Kaiyi, et autres
Publié: (2024)
par: Huang, Kaiyi, et autres
Publié: (2024)
Divide and Conquer: Language Models can Plan and Self-Correct for Compositional Text-to-Image Generation
par: Wang, Zhenyu, et autres
Publié: (2024)
par: Wang, Zhenyu, et autres
Publié: (2024)
Accelerating Auto-regressive Text-to-Image Generation with Training-free Speculative Jacobi Decoding
par: Teng, Yao, et autres
Publié: (2024)
par: Teng, Yao, et autres
Publié: (2024)
Editing Massive Concepts in Text-to-Image Diffusion Models
par: Xiong, Tianwei, et autres
Publié: (2024)
par: Xiong, Tianwei, et autres
Publié: (2024)
UI2V-Bench: An Understanding-based Image-to-video Generation Benchmark
par: Zhang, Ailing, et autres
Publié: (2025)
par: Zhang, Ailing, et autres
Publié: (2025)
Speculative Jacobi-Denoising Decoding for Accelerating Autoregressive Text-to-image Generation
par: Teng, Yao, et autres
Publié: (2025)
par: Teng, Yao, et autres
Publié: (2025)
FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark
par: Fang, Rongyao, et autres
Publié: (2025)
par: Fang, Rongyao, et autres
Publié: (2025)
GenArtist: Multimodal LLM as an Agent for Unified Image Generation and Editing
par: Wang, Zhenyu, et autres
Publié: (2024)
par: Wang, Zhenyu, et autres
Publié: (2024)
SJD++: Improved Speculative Jacobi Decoding for Training-free Acceleration of Discrete Auto-regressive Text-to-Image Generation
par: Teng, Yao, et autres
Publié: (2025)
par: Teng, Yao, et autres
Publié: (2025)
DreamCube: 3D Panorama Generation via Multi-plane Synchronization
par: Huang, Yukun, et autres
Publié: (2025)
par: Huang, Yukun, et autres
Publié: (2025)
OCRGenBench: A Comprehensive Benchmark for Evaluating OCR Generative Capabilities
par: Zhang, Peirong, et autres
Publié: (2025)
par: Zhang, Peirong, et autres
Publié: (2025)
PunchBench: Benchmarking MLLMs in Multimodal Punchline Comprehension
par: Ouyang, Kun, et autres
Publié: (2024)
par: Ouyang, Kun, et autres
Publié: (2024)
3DGen-Bench: Comprehensive Benchmark Suite for 3D Generative Models
par: Zhang, Yuhan, et autres
Publié: (2025)
par: Zhang, Yuhan, et autres
Publié: (2025)
HumanGaussian: Text-Driven 3D Human Generation with Gaussian Splatting
par: Liu, Xian, et autres
Publié: (2023)
par: Liu, Xian, et autres
Publié: (2023)
GT23D-Bench: A Comprehensive General Text-to-3D Generation Benchmark
par: Cai, Xiao, et autres
Publié: (2024)
par: Cai, Xiao, et autres
Publié: (2024)
FilMaster: Bridging Cinematic Principles and Generative AI for Automated Film Generation
par: Huang, Kaiyi, et autres
Publié: (2025)
par: Huang, Kaiyi, et autres
Publié: (2025)
SafeGen-Bench: Benchmarking Safety in Image-Conditioned Text-to-Video Generation
par: Ma, Yingzi, et autres
Publié: (2026)
par: Ma, Yingzi, et autres
Publié: (2026)
PredBench: Benchmarking Spatio-Temporal Prediction across Diverse Disciplines
par: Wang, ZiDong, et autres
Publié: (2024)
par: Wang, ZiDong, et autres
Publié: (2024)
"PhyWorldBench": A Comprehensive Evaluation of Physical Realism in Text-to-Video Models
par: Gu, Jing, et autres
Publié: (2025)
par: Gu, Jing, et autres
Publié: (2025)
ViStoryBench: Comprehensive Benchmark Suite for Story Visualization
par: Zhuang, Cailin, et autres
Publié: (2025)
par: Zhuang, Cailin, et autres
Publié: (2025)
IGenBench: Benchmarking the Reliability of Text-to-Infographic Generation
par: Tang, Yinghao, et autres
Publié: (2026)
par: Tang, Yinghao, et autres
Publié: (2026)
7Bench: a Comprehensive Benchmark for Layout-guided Text-to-image Models
par: Izzo, Elena, et autres
Publié: (2025)
par: Izzo, Elena, et autres
Publié: (2025)
FTII-Bench: A Comprehensive Multimodal Benchmark for Flow Text with Image Insertion
par: Ruan, Jiacheng, et autres
Publié: (2024)
par: Ruan, Jiacheng, et autres
Publié: (2024)
BackdoorBench: A Comprehensive Benchmark and Analysis of Backdoor Learning
par: Wu, Baoyuan, et autres
Publié: (2024)
par: Wu, Baoyuan, et autres
Publié: (2024)
DiM: Diffusion Mamba for Efficient High-Resolution Image Synthesis
par: Teng, Yao, et autres
Publié: (2024)
par: Teng, Yao, et autres
Publié: (2024)
LoCoT2V-Bench: Benchmarking Long-Form and Complex Text-to-Video Generation
par: Zheng, Xiangqing, et autres
Publié: (2025)
par: Zheng, Xiangqing, et autres
Publié: (2025)
VP-Bench: A Comprehensive Benchmark for Visual Prompting in Multimodal Large Language Models
par: Xu, Mingjie, et autres
Publié: (2025)
par: Xu, Mingjie, et autres
Publié: (2025)
EventBench: Towards Comprehensive Benchmarking of Event-based MLLMs
par: Liu, Shaoyu, et autres
Publié: (2025)
par: Liu, Shaoyu, et autres
Publié: (2025)
PAI-Bench: A Comprehensive Benchmark For Physical AI
par: Zhou, Fengzhe, et autres
Publié: (2025)
par: Zhou, Fengzhe, et autres
Publié: (2025)
UAL-Bench: The First Comprehensive Unusual Activity Localization Benchmark
par: Abdullah, Hasnat Md, et autres
Publié: (2024)
par: Abdullah, Hasnat Md, et autres
Publié: (2024)
OIG-Bench: A Multi-Agent Annotated Benchmark for Multimodal One-Image Guides Understanding
par: Xie, Jiancong, et autres
Publié: (2025)
par: Xie, Jiancong, et autres
Publié: (2025)
MICON-Bench: Benchmarking and Enhancing Multi-Image Context Image Generation in Unified Multimodal Models
par: Wu, Mingrui, et autres
Publié: (2026)
par: Wu, Mingrui, et autres
Publié: (2026)
Harmonizing Visual Text Comprehension and Generation
par: Zhao, Zhen, et autres
Publié: (2024)
par: Zhao, Zhen, et autres
Publié: (2024)
ChronoMagic-Bench: A Benchmark for Metamorphic Evaluation of Text-to-Time-lapse Video Generation
par: Yuan, Shenghai, et autres
Publié: (2024)
par: Yuan, Shenghai, et autres
Publié: (2024)
CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback
par: Wan, Yixin, et autres
Publié: (2025)
par: Wan, Yixin, et autres
Publié: (2025)
Documents similaires
-
T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation
par: Huang, Kaiyi, et autres
Publié: (2023) -
CompBench: Benchmarking Complex Instruction-guided Image Editing
par: Jia, Bohan, et autres
Publié: (2025) -
T2I-ReasonBench: Benchmarking Reasoning-Informed Text-to-Image Generation
par: Sun, Kaiyue, et autres
Publié: (2025) -
MLLM-CompBench: A Comparative Reasoning Benchmark for Multimodal LLMs
par: Kil, Jihyung, et autres
Publié: (2024) -
Personalized Text-to-Image Generation with Auto-Regressive Models
par: Sun, Kaiyue, et autres
Publié: (2025)