Can Vision Language Models Assess Graphic Design Aesthetics? A Benchmark, Evaluation, and Dataset Perspective
Fuente:
arXiv
Salvato in:
| Autori principali: | An, Arctanx, Sun, Shizhao, Huang, Danqing, Cheng, Mingxi, Gao, Yan, Li, Ji, Qiao, Yu, Bian, Jiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
From Elements to Design: A Layered Approach for Automatic Graphic Design Composition
di: Lin, Jiawei, et al.
Pubblicazione: (2024)
di: Lin, Jiawei, et al.
Pubblicazione: (2024)
DesignAsCode: Bridging Structural Editability and Visual Fidelity in Graphic Design Generation
di: Liu, Ziyuan, et al.
Pubblicazione: (2026)
di: Liu, Ziyuan, et al.
Pubblicazione: (2026)
ReLayout: Versatile and Structure-Preserving Design Layout Editing via Relation-Aware Design Reconstruction
di: Lin, Jiawei, et al.
Pubblicazione: (2026)
di: Lin, Jiawei, et al.
Pubblicazione: (2026)
DesignProbe: A Graphic Design Benchmark for Multimodal Large Language Models
di: Lin, Jieru, et al.
Pubblicazione: (2024)
di: Lin, Jieru, et al.
Pubblicazione: (2024)
Text-to-CAD Generation Through Infusing Visual Feedback in Large Language Models
di: Wang, Ruiyu, et al.
Pubblicazione: (2025)
di: Wang, Ruiyu, et al.
Pubblicazione: (2025)
AnalogXpert: Automating Analog Topology Synthesis by Incorporating Circuit Design Expertise into Large Language Models
di: Zhang, Haoyi, et al.
Pubblicazione: (2024)
di: Zhang, Haoyi, et al.
Pubblicazione: (2024)
Thinking with Blueprints: Assisting Vision-Language Models in Spatial Reasoning via Structured Object Representation
di: Ma, Weijian, et al.
Pubblicazione: (2026)
di: Ma, Weijian, et al.
Pubblicazione: (2026)
Oedipus and the Sphinx: Benchmarking and Improving Visual Language Models for Complex Graphic Reasoning
di: Zhang, Jianyi, et al.
Pubblicazione: (2025)
di: Zhang, Jianyi, et al.
Pubblicazione: (2025)
CAD-Editor: A Locate-then-Infill Framework with Automated Training Data Synthesis for Text-Based CAD Editing
di: Yuan, Yu, et al.
Pubblicazione: (2025)
di: Yuan, Yu, et al.
Pubblicazione: (2025)
SongEval: A Benchmark Dataset for Song Aesthetics Evaluation
di: Yao, Jixun, et al.
Pubblicazione: (2025)
di: Yao, Jixun, et al.
Pubblicazione: (2025)
FlexCAD: Unified and Versatile Controllable CAD Generation with Fine-tuned Large Language Models
di: Zhang, Zhanwei, et al.
Pubblicazione: (2024)
di: Zhang, Zhanwei, et al.
Pubblicazione: (2024)
On the Evaluation and Refinement of Vision-Language Instruction Tuning Datasets
di: Liao, Ning, et al.
Pubblicazione: (2023)
di: Liao, Ning, et al.
Pubblicazione: (2023)
CAD-Tokenizer: Towards Text-based CAD Prototyping via Modality-Specific Tokenization
di: Wang, Ruiyu, et al.
Pubblicazione: (2025)
di: Wang, Ruiyu, et al.
Pubblicazione: (2025)
CADMorph: Geometry-Driven Parametric CAD Editing via a Plan-Generate-Verify Loop
di: Ma, Weijian, et al.
Pubblicazione: (2025)
di: Ma, Weijian, et al.
Pubblicazione: (2025)
CAPTURE: A Benchmark and Evaluation for LVLMs in CAPTCHA Resolving
di: Zhang, Jianyi, et al.
Pubblicazione: (2025)
di: Zhang, Jianyi, et al.
Pubblicazione: (2025)
SceneReVis: A Self-Reflective Vision-Grounded Framework for 3D Indoor Scene Synthesis via Multi-turn RL
di: Zhao, Yang, et al.
Pubblicazione: (2026)
di: Zhao, Yang, et al.
Pubblicazione: (2026)
Can GPTs Evaluate Graphic Design Based on Design Principles?
di: Haraguchi, Daichi, et al.
Pubblicazione: (2024)
di: Haraguchi, Daichi, et al.
Pubblicazione: (2024)
Graphic-Design-Bench: A Comprehensive Benchmark for Evaluating AI on Graphic Design Tasks
di: Deganutti, Adrienne, et al.
Pubblicazione: (2026)
di: Deganutti, Adrienne, et al.
Pubblicazione: (2026)
GraphicBench: A Planning Benchmark for Graphic Design with Language Agents
di: Ki, Dayeon, et al.
Pubblicazione: (2025)
di: Ki, Dayeon, et al.
Pubblicazione: (2025)
Orchestrating Spatial Semantics via a Zone-Graph Paradigm for Intricate Indoor Scene Generation
di: Zhang, Meisheng, et al.
Pubblicazione: (2026)
di: Zhang, Meisheng, et al.
Pubblicazione: (2026)
Visual Aesthetic Benchmark: Can Frontier Models Judge Beauty?
di: Feng, Yichen, et al.
Pubblicazione: (2026)
di: Feng, Yichen, et al.
Pubblicazione: (2026)
CVLUE: A New Benchmark Dataset for Chinese Vision-Language Understanding Evaluation
di: Wang, Yuxuan, et al.
Pubblicazione: (2024)
di: Wang, Yuxuan, et al.
Pubblicazione: (2024)
Aligning Vision Models with Human Aesthetics in Retrieval: Benchmarks and Algorithms
di: Zhang, Miaosen, et al.
Pubblicazione: (2024)
di: Zhang, Miaosen, et al.
Pubblicazione: (2024)
DEAR: Dataset for Evaluating the Aesthetics of Rendering
di: Plohotnuk, Vsevolod, et al.
Pubblicazione: (2025)
di: Plohotnuk, Vsevolod, et al.
Pubblicazione: (2025)
APDDv2: Aesthetics of Paintings and Drawings Dataset with Artist Labeled Scores and Comments
di: Jin, Xin, et al.
Pubblicazione: (2024)
di: Jin, Xin, et al.
Pubblicazione: (2024)
VGA-Bench: A Unified Benchmark and Multi-Model Framework for Video Aesthetics and Generation Quality Evaluation
di: Jiang, Longteng, et al.
Pubblicazione: (2026)
di: Jiang, Longteng, et al.
Pubblicazione: (2026)
Moonworks Lunara Aesthetic Dataset
di: Wang, Yan, et al.
Pubblicazione: (2026)
di: Wang, Yan, et al.
Pubblicazione: (2026)
Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization
di: Liang, Zhanhao, et al.
Pubblicazione: (2024)
di: Liang, Zhanhao, et al.
Pubblicazione: (2024)
Assessing the Aesthetic Evaluation Capabilities of GPT-4 with Vision: Insights from Group and Individual Assessments
di: Abe, Yoshia, et al.
Pubblicazione: (2024)
di: Abe, Yoshia, et al.
Pubblicazione: (2024)
Seeing Across Views: Benchmarking Spatial Reasoning of Vision-Language Models in Robotic Scenes
di: Feng, Zhiyuan, et al.
Pubblicazione: (2025)
di: Feng, Zhiyuan, et al.
Pubblicazione: (2025)
Spot the Error: Non-autoregressive Graphic Layout Generation with Wireframe Locator
di: Lin, Jieru, et al.
Pubblicazione: (2024)
di: Lin, Jieru, et al.
Pubblicazione: (2024)
Textual Aesthetics in Large Language Models
di: Jiang, Lingjie, et al.
Pubblicazione: (2024)
di: Jiang, Lingjie, et al.
Pubblicazione: (2024)
AesthetiQ: Enhancing Graphic Layout Design via Aesthetic-Aware Preference Alignment of Multi-modal Large Language Models
di: Patnaik, Sohan, et al.
Pubblicazione: (2025)
di: Patnaik, Sohan, et al.
Pubblicazione: (2025)
Can Large Language Models Analyze Graphs like Professionals? A Benchmark, Datasets and Models
di: Li, Xin, et al.
Pubblicazione: (2024)
di: Li, Xin, et al.
Pubblicazione: (2024)
Evolving to the Aesthetics of a Vision-Language Model
di: Krol, Stephen James, et al.
Pubblicazione: (2026)
di: Krol, Stephen James, et al.
Pubblicazione: (2026)
DDFAV: Remote Sensing Large Vision Language Models Dataset and Evaluation Benchmark
di: Li, Haodong, et al.
Pubblicazione: (2024)
di: Li, Haodong, et al.
Pubblicazione: (2024)
Multimodal LLMs Can Reason about Aesthetics in Zero-Shot
di: Jiang, Ruixiang, et al.
Pubblicazione: (2025)
di: Jiang, Ruixiang, et al.
Pubblicazione: (2025)
Can Deception Detection Go Deeper? Dataset, Evaluation, and Benchmark for Deception Reasoning
di: Chen, Kang, et al.
Pubblicazione: (2024)
di: Chen, Kang, et al.
Pubblicazione: (2024)
Photography Perspective Composition: Towards Aesthetic Perspective Recommendation
di: Yao, Lujian, et al.
Pubblicazione: (2025)
di: Yao, Lujian, et al.
Pubblicazione: (2025)
Spatial-DISE: A Unified Benchmark for Evaluating Spatial Reasoning in Vision-Language Models
di: Huang, Xinmiao, et al.
Pubblicazione: (2025)
di: Huang, Xinmiao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
From Elements to Design: A Layered Approach for Automatic Graphic Design Composition
di: Lin, Jiawei, et al.
Pubblicazione: (2024) -
DesignAsCode: Bridging Structural Editability and Visual Fidelity in Graphic Design Generation
di: Liu, Ziyuan, et al.
Pubblicazione: (2026) -
ReLayout: Versatile and Structure-Preserving Design Layout Editing via Relation-Aware Design Reconstruction
di: Lin, Jiawei, et al.
Pubblicazione: (2026) -
DesignProbe: A Graphic Design Benchmark for Multimodal Large Language Models
di: Lin, Jieru, et al.
Pubblicazione: (2024) -
Text-to-CAD Generation Through Infusing Visual Feedback in Large Language Models
di: Wang, Ruiyu, et al.
Pubblicazione: (2025)