AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Yipo, Yuan, Quan, Sheng, Xiangfei, Yang, Zhichao, Wu, Haoning, Chen, Pengfei, Yang, Yuzhe, Li, Leida, Lin, Weisi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AesExpert: Towards Multi-modality Foundation Model for Image Aesthetics Perception
por: Huang, Yipo, et al.
Publicado: (2024)
por: Huang, Yipo, et al.
Publicado: (2024)
TuningIQA: Fine-Grained Blind Image Quality Assessment for Livestreaming Camera Tuning
por: Sheng, Xiangfei, et al.
Publicado: (2025)
por: Sheng, Xiangfei, et al.
Publicado: (2025)
VideoAesBench: Benchmarking the Video Aesthetics Perception Capabilities of Large Multimodal Models
por: Li, Yunhao, et al.
Publicado: (2026)
por: Li, Yunhao, et al.
Publicado: (2026)
Fine-grained Image Aesthetic Assessment: Learning Discriminative Scores from Relative Ranks
por: Yang, Zhichao, et al.
Publicado: (2026)
por: Yang, Zhichao, et al.
Publicado: (2026)
AesBiasBench: Evaluating Bias and Alignment in Multimodal Language Models for Personalized Image Aesthetic Assessment
por: Li, Kun, et al.
Publicado: (2025)
por: Li, Kun, et al.
Publicado: (2025)
Fine-grained Image Quality Assessment for Perceptual Image Restoration
por: Sheng, Xiangfei, et al.
Publicado: (2025)
por: Sheng, Xiangfei, et al.
Publicado: (2025)
LongT2IBench: A Benchmark for Evaluating Long Text-to-Image Generation with Graph-structured Annotations
por: Yang, Zhichao, et al.
Publicado: (2025)
por: Yang, Zhichao, et al.
Publicado: (2025)
HumanAesExpert: Advancing a Multi-Modality Foundation Model for Human Image Aesthetic Assessment
por: Liao, Zhichao, et al.
Publicado: (2025)
por: Liao, Zhichao, et al.
Publicado: (2025)
FakeScope: Large Multimodal Expert Model for Transparent AI-Generated Image Forensics
por: Li, Yixuan, et al.
Publicado: (2025)
por: Li, Yixuan, et al.
Publicado: (2025)
Language-Guided Visual Perception Disentanglement for Image Quality Assessment and Conditional Image Generation
por: Yang, Zhichao, et al.
Publicado: (2025)
por: Yang, Zhichao, et al.
Publicado: (2025)
AesRM: Improving Video Aesthetics with Expert-Level Feedback
por: Han, Yujin, et al.
Publicado: (2026)
por: Han, Yujin, et al.
Publicado: (2026)
AesTest: Measuring Aesthetic Intelligence from Perception to Production
por: Wang, Guolong, et al.
Publicado: (2025)
por: Wang, Guolong, et al.
Publicado: (2025)
Q-Bench+: A Benchmark for Multi-modal Foundation Models on Low-level Vision from Single Images to Pairs
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
AesCrop: Aesthetic-driven Cropping Guided by Composition
por: Wong, Yen-Hong, et al.
Publicado: (2025)
por: Wong, Yen-Hong, et al.
Publicado: (2025)
AesFA: An Aesthetic Feature-Aware Arbitrary Neural Style Transfer
por: Kwon, Joonwoo, et al.
Publicado: (2023)
por: Kwon, Joonwoo, et al.
Publicado: (2023)
AccelAes: Accelerating Diffusion Transformers for Training-Free Aesthetic-Enhanced Image Generation
por: Yin, Xuanhua, et al.
Publicado: (2026)
por: Yin, Xuanhua, et al.
Publicado: (2026)
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
Res-Bench: Benchmarking the Robustness of Multimodal Large Language Models to Dynamic Resolution Input
por: Li, Chenxu, et al.
Publicado: (2025)
por: Li, Chenxu, et al.
Publicado: (2025)
Aes3D: Aesthetic Assessment in 3D Gaussian Splatting
por: Xu, Chuanzhi, et al.
Publicado: (2026)
por: Xu, Chuanzhi, et al.
Publicado: (2026)
Q-Bench-Portrait: Benchmarking Multimodal Large Language Models on Portrait Image Quality Perception
por: Wu, Sijing, et al.
Publicado: (2026)
por: Wu, Sijing, et al.
Publicado: (2026)
II-Bench: An Image Implication Understanding Benchmark for Multimodal Large Language Models
por: Liu, Ziqiang, et al.
Publicado: (2024)
por: Liu, Ziqiang, et al.
Publicado: (2024)
ProBench: Judging Multimodal Foundation Models on Open-ended Multi-domain Expert Tasks
por: Yang, Yan, et al.
Publicado: (2025)
por: Yang, Yan, et al.
Publicado: (2025)
BrainBench: Exposing the Commonsense Reasoning Gap in Large Language Models
por: Tang, Yuzhe
Publicado: (2026)
por: Tang, Yuzhe
Publicado: (2026)
IV-Bench: A Benchmark for Image-Grounded Video Perception and Reasoning in Multimodal LLMs
por: Ma, David, et al.
Publicado: (2025)
por: Ma, David, et al.
Publicado: (2025)
FakeBench: Probing Explainable Fake Image Detection via Large Multimodal Models
por: Li, Yixuan, et al.
Publicado: (2024)
por: Li, Yixuan, et al.
Publicado: (2024)
Enhancing Image Aesthetics with Dual-Conditioned Diffusion Models Guided by Multimodal Perception
por: Nan, Xinyu, et al.
Publicado: (2026)
por: Nan, Xinyu, et al.
Publicado: (2026)
Teaching LMMs for Image Quality Scoring and Interpreting
por: Zhang, Zicheng, et al.
Publicado: (2025)
por: Zhang, Zicheng, et al.
Publicado: (2025)
Q-Bench-Video: Benchmarking the Video Quality Understanding of LMMs
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
LongVideoBench: A Benchmark for Long-context Interleaved Video-Language Understanding
por: Wu, Haoning, et al.
Publicado: (2024)
por: Wu, Haoning, et al.
Publicado: (2024)
MFC-Bench: Benchmarking Multimodal Fact-Checking with Large Vision-Language Models
por: Wang, Shengkang, et al.
Publicado: (2024)
por: Wang, Shengkang, et al.
Publicado: (2024)
Q-Ground: Image Quality Grounding with Large Multi-modality Models
por: Chen, Chaofeng, et al.
Publicado: (2024)
por: Chen, Chaofeng, et al.
Publicado: (2024)
A-Bench: Are LMMs Masters at Evaluating AI-generated Images?
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
Adaptive Image Quality Assessment via Teaching Large Multimodal Model to Compare
por: Zhu, Hanwei, et al.
Publicado: (2024)
por: Zhu, Hanwei, et al.
Publicado: (2024)
MISC: Ultra-low Bitrate Image Semantic Compression Driven by Large Multimodal Model
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
The Photographer Eye: Teaching Multimodal Large Language Models to Understand Image Aesthetics like Photographers
por: Qi, Daiqing, et al.
Publicado: (2025)
por: Qi, Daiqing, et al.
Publicado: (2025)
Venus: Benchmarking and Empowering Multimodal Large Language Models for Aesthetic Guidance and Cropping
por: Du, Tianxiang, et al.
Publicado: (2026)
por: Du, Tianxiang, et al.
Publicado: (2026)
Explore the Hallucination on Low-level Perception for MLLMs
por: Sun, Yinan, et al.
Publicado: (2024)
por: Sun, Yinan, et al.
Publicado: (2024)
ExpertPrompting: Instructing Large Language Models to be Distinguished Experts
por: Xu, Benfeng, et al.
Publicado: (2023)
por: Xu, Benfeng, et al.
Publicado: (2023)
MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models
por: Liu, Xin, et al.
Publicado: (2023)
por: Liu, Xin, et al.
Publicado: (2023)
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
por: Wu, Haoning, et al.
Publicado: (2023)
por: Wu, Haoning, et al.
Publicado: (2023)
Ejemplares similares
-
AesExpert: Towards Multi-modality Foundation Model for Image Aesthetics Perception
por: Huang, Yipo, et al.
Publicado: (2024) -
TuningIQA: Fine-Grained Blind Image Quality Assessment for Livestreaming Camera Tuning
por: Sheng, Xiangfei, et al.
Publicado: (2025) -
VideoAesBench: Benchmarking the Video Aesthetics Perception Capabilities of Large Multimodal Models
por: Li, Yunhao, et al.
Publicado: (2026) -
Fine-grained Image Aesthetic Assessment: Learning Discriminative Scores from Relative Ranks
por: Yang, Zhichao, et al.
Publicado: (2026) -
AesBiasBench: Evaluating Bias and Alignment in Multimodal Language Models for Personalized Image Aesthetic Assessment
por: Li, Kun, et al.
Publicado: (2025)