LongT2IBench: A Benchmark for Evaluating Long Text-to-Image Generation with Graph-structured Annotations
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yang, Zhichao, Gu, Tianjiao, Wang, Jianjie, Lin, Feiyu, Sheng, Xiangfei, Chen, Pengfei, Li, Leida |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Fine-grained Image Aesthetic Assessment: Learning Discriminative Scores from Relative Ranks
von: Yang, Zhichao, et al.
Veröffentlicht: (2026)
von: Yang, Zhichao, et al.
Veröffentlicht: (2026)
Fine-grained Image Quality Assessment for Perceptual Image Restoration
von: Sheng, Xiangfei, et al.
Veröffentlicht: (2025)
von: Sheng, Xiangfei, et al.
Veröffentlicht: (2025)
AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception
von: Huang, Yipo, et al.
Veröffentlicht: (2024)
von: Huang, Yipo, et al.
Veröffentlicht: (2024)
AesExpert: Towards Multi-modality Foundation Model for Image Aesthetics Perception
von: Huang, Yipo, et al.
Veröffentlicht: (2024)
von: Huang, Yipo, et al.
Veröffentlicht: (2024)
TuningIQA: Fine-Grained Blind Image Quality Assessment for Livestreaming Camera Tuning
von: Sheng, Xiangfei, et al.
Veröffentlicht: (2025)
von: Sheng, Xiangfei, et al.
Veröffentlicht: (2025)
Language-Guided Visual Perception Disentanglement for Image Quality Assessment and Conditional Image Generation
von: Yang, Zhichao, et al.
Veröffentlicht: (2025)
von: Yang, Zhichao, et al.
Veröffentlicht: (2025)
M$^{3}$T2IBench: A Large-Scale Multi-Category, Multi-Instance, Multi-Relation Text-to-Image Benchmark
von: Zhang, Huixuan, et al.
Veröffentlicht: (2025)
von: Zhang, Huixuan, et al.
Veröffentlicht: (2025)
The Devil is in Fine-tuning and Long-tailed Problems:A New Benchmark for Scene Text Detection
von: Cao, Tianjiao, et al.
Veröffentlicht: (2025)
von: Cao, Tianjiao, et al.
Veröffentlicht: (2025)
FTII-Bench: A Comprehensive Multimodal Benchmark for Flow Text with Image Insertion
von: Ruan, Jiacheng, et al.
Veröffentlicht: (2024)
von: Ruan, Jiacheng, et al.
Veröffentlicht: (2024)
SLVMEval: Synthetic Meta Evaluation Benchmark for Text-to-Long Video Generation
von: Matsuda, Ryosuke, et al.
Veröffentlicht: (2026)
von: Matsuda, Ryosuke, et al.
Veröffentlicht: (2026)
Skill-Aligned Annotation for Reliable Evaluation in Text-to-Image Generation
von: Eldesokey, Abdelrahman, et al.
Veröffentlicht: (2026)
von: Eldesokey, Abdelrahman, et al.
Veröffentlicht: (2026)
Long-Text-to-Image Generation via Compositional Prompt Decomposition
von: Huang, Jen-Yuan, et al.
Veröffentlicht: (2026)
von: Huang, Jen-Yuan, et al.
Veröffentlicht: (2026)
TIT-Score: Evaluating Long-Prompt Based Text-to-Image Alignment via Text-to-Image-to-Text Consistency
von: Wang, Juntong, et al.
Veröffentlicht: (2025)
von: Wang, Juntong, et al.
Veröffentlicht: (2025)
Text to Image Generation and Editing: A Survey
von: Yang, Pengfei, et al.
Veröffentlicht: (2025)
von: Yang, Pengfei, et al.
Veröffentlicht: (2025)
Beyond Words: Advancing Long-Text Image Generation via Multimodal Autoregressive Models
von: Wang, Alex Jinpeng, et al.
Veröffentlicht: (2025)
von: Wang, Alex Jinpeng, et al.
Veröffentlicht: (2025)
TextVidBench: A Benchmark for Long Video Scene Text Understanding
von: Zhong, Yangyang, et al.
Veröffentlicht: (2025)
von: Zhong, Yangyang, et al.
Veröffentlicht: (2025)
LongInsightBench: A Comprehensive Benchmark for Evaluating Omni-Modal Models on Human-Centric Long-Video Understanding
von: Han, ZhaoYang, et al.
Veröffentlicht: (2025)
von: Han, ZhaoYang, et al.
Veröffentlicht: (2025)
HyperAlign: Hyperbolic Entailment Cones for Adaptive Text-to-Image Alignment Assessment
von: Chen, Wenzhi, et al.
Veröffentlicht: (2026)
von: Chen, Wenzhi, et al.
Veröffentlicht: (2026)
SG-Adapter: Enhancing Text-to-Image Generation with Scene Graph Guidance
von: Shen, Guibao, et al.
Veröffentlicht: (2024)
von: Shen, Guibao, et al.
Veröffentlicht: (2024)
Knowledge Visualization: A Benchmark and Method for Knowledge-Intensive Text-to-Image Generation
von: Zhao, Ran, et al.
Veröffentlicht: (2026)
von: Zhao, Ran, et al.
Veröffentlicht: (2026)
NYC-Indoor-VPR: A Long-Term Indoor Visual Place Recognition Dataset with Semi-Automatic Annotation
von: Sheng, Diwei, et al.
Veröffentlicht: (2024)
von: Sheng, Diwei, et al.
Veröffentlicht: (2024)
Content-Adaptive Image Retouching Guided by Attribute-Based Text Representation
von: Zhu, Hancheng, et al.
Veröffentlicht: (2025)
von: Zhu, Hancheng, et al.
Veröffentlicht: (2025)
Long Context Tuning for Video Generation
von: Guo, Yuwei, et al.
Veröffentlicht: (2025)
von: Guo, Yuwei, et al.
Veröffentlicht: (2025)
Text-guided Foundation Model Adaptation for Long-Tailed Medical Image Classification
von: Li, Sirui, et al.
Veröffentlicht: (2024)
von: Li, Sirui, et al.
Veröffentlicht: (2024)
MTV-Inpaint: Multi-Task Long Video Inpainting
von: Yang, Shiyuan, et al.
Veröffentlicht: (2025)
von: Yang, Shiyuan, et al.
Veröffentlicht: (2025)
VISTAR:A User-Centric and Role-Driven Benchmark for Text-to-Image Evaluation
von: Jiang, Kaiyuan, et al.
Veröffentlicht: (2025)
von: Jiang, Kaiyuan, et al.
Veröffentlicht: (2025)
EvalMuse-40K: A Reliable and Fine-Grained Benchmark with Comprehensive Human Annotations for Text-to-Image Generation Model Evaluation
von: Han, Shuhao, et al.
Veröffentlicht: (2024)
von: Han, Shuhao, et al.
Veröffentlicht: (2024)
MULAN: A Multi Layer Annotated Dataset for Controllable Text-to-Image Generation
von: Tudosiu, Petru-Daniel, et al.
Veröffentlicht: (2024)
von: Tudosiu, Petru-Daniel, et al.
Veröffentlicht: (2024)
LOVE: Benchmarking and Evaluating Text-to-Video Generation and Video-to-Text Interpretation
von: Wang, Jiarui, et al.
Veröffentlicht: (2025)
von: Wang, Jiarui, et al.
Veröffentlicht: (2025)
Long-CLIP: Unlocking the Long-Text Capability of CLIP
von: Zhang, Beichen, et al.
Veröffentlicht: (2024)
von: Zhang, Beichen, et al.
Veröffentlicht: (2024)
OpenING: A Comprehensive Benchmark for Judging Open-ended Interleaved Image-Text Generation
von: Zhou, Pengfei, et al.
Veröffentlicht: (2024)
von: Zhou, Pengfei, et al.
Veröffentlicht: (2024)
Text-Guided Mixup Towards Long-Tailed Image Categorization
von: Franklin, Richard, et al.
Veröffentlicht: (2024)
von: Franklin, Richard, et al.
Veröffentlicht: (2024)
UniGenBench++: A Unified Semantic Evaluation Benchmark for Text-to-Image Generation
von: Wang, Yibin, et al.
Veröffentlicht: (2025)
von: Wang, Yibin, et al.
Veröffentlicht: (2025)
GenColorBench: A Color Evaluation Benchmark for Text-to-Image Generation Models
von: Butt, Muhammad Atif, et al.
Veröffentlicht: (2025)
von: Butt, Muhammad Atif, et al.
Veröffentlicht: (2025)
Towards Long-Horizon Vision-Language Navigation: Platform, Benchmark and Method
von: Song, Xinshuai, et al.
Veröffentlicht: (2024)
von: Song, Xinshuai, et al.
Veröffentlicht: (2024)
SceneVTG++: Controllable Multilingual Visual Text Generation in the Wild
von: Liu, Jiawei, et al.
Veröffentlicht: (2025)
von: Liu, Jiawei, et al.
Veröffentlicht: (2025)
PhyBench: A Physical Commonsense Benchmark for Evaluating Text-to-Image Models
von: Meng, Fanqing, et al.
Veröffentlicht: (2024)
von: Meng, Fanqing, et al.
Veröffentlicht: (2024)
CuRe: Cultural Gaps in the Long Tail of Text-to-Image Systems
von: Rege, Aniket, et al.
Veröffentlicht: (2025)
von: Rege, Aniket, et al.
Veröffentlicht: (2025)
Long-RVOS: A Comprehensive Benchmark for Long-term Referring Video Object Segmentation
von: Liang, Tianming, et al.
Veröffentlicht: (2025)
von: Liang, Tianming, et al.
Veröffentlicht: (2025)
Deep Shape-Texture Statistics for Completely Blind Image Quality Evaluation
von: Li, Yixuan, et al.
Veröffentlicht: (2024)
von: Li, Yixuan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Fine-grained Image Aesthetic Assessment: Learning Discriminative Scores from Relative Ranks
von: Yang, Zhichao, et al.
Veröffentlicht: (2026) -
Fine-grained Image Quality Assessment for Perceptual Image Restoration
von: Sheng, Xiangfei, et al.
Veröffentlicht: (2025) -
AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception
von: Huang, Yipo, et al.
Veröffentlicht: (2024) -
AesExpert: Towards Multi-modality Foundation Model for Image Aesthetics Perception
von: Huang, Yipo, et al.
Veröffentlicht: (2024) -
TuningIQA: Fine-Grained Blind Image Quality Assessment for Livestreaming Camera Tuning
von: Sheng, Xiangfei, et al.
Veröffentlicht: (2025)