Revisiting MLLM Based Image Quality Assessment: Errors and Remedy
Fuente:
arXiv
Saved in:
| Main Authors: | Tang, Zhenchen, Yang, Songlin, Peng, Bo, Wang, Zichuan, Dong, Jing |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
HandEval: Taking the First Step Towards Hand Quality Evaluation in Generated Images
by: Wang, Zichuan, et al.
Published: (2025)
by: Wang, Zichuan, et al.
Published: (2025)
CLIP-AGIQA: Boosting the Performance of AI-Generated Image Quality Assessment with CLIP
by: Tang, Zhenchen, et al.
Published: (2024)
by: Tang, Zhenchen, et al.
Published: (2024)
DREAM: A Benchmark Study for Deepfake photoREalism AssessMent
by: Peng, Bo, et al.
Published: (2025)
by: Peng, Bo, et al.
Published: (2025)
Counterfactual Explanations for Face Forgery Detection via Adversarial Removal of Artifacts
by: Li, Yang, et al.
Published: (2024)
by: Li, Yang, et al.
Published: (2024)
Revisiting Video Quality Assessment from the Perspective of Generalization
by: Yue, Xinli, et al.
Published: (2024)
by: Yue, Xinli, et al.
Published: (2024)
Revisiting Vision Language Foundations for No-Reference Image Quality Assessment
by: Yadav, Ankit, et al.
Published: (2025)
by: Yadav, Ankit, et al.
Published: (2025)
Beyond Inserting: Learning Identity Embedding for Semantic-Fidelity Personalized Diffusion Generation
by: Li, Yang, et al.
Published: (2024)
by: Li, Yang, et al.
Published: (2024)
RetouchIQ: MLLM Agents for Instruction-Based Image Retouching with Generalist Reward
by: Wu, Qiucheng, et al.
Published: (2026)
by: Wu, Qiucheng, et al.
Published: (2026)
GT-PCQA: Geometry-Texture Decoupled Point Cloud Quality Assessment with MLLM
by: Zhang, Guohua, et al.
Published: (2026)
by: Zhang, Guohua, et al.
Published: (2026)
Revisiting MLLM Token Technology through the Lens of Classical Visual Coding
by: Liu, Jinming, et al.
Published: (2025)
by: Liu, Jinming, et al.
Published: (2025)
Beyond Filtering: Adaptive Image-Text Quality Enhancement for MLLM Pretraining
by: Huang, Han, et al.
Published: (2024)
by: Huang, Han, et al.
Published: (2024)
Enhancing Remote Sensing Vision-Language Models Through MLLM and LLM-Based High-Quality Image-Text Dataset Generation
by: He, Yiguo, et al.
Published: (2025)
by: He, Yiguo, et al.
Published: (2025)
Dog-IQA: Standard-guided Zero-shot MLLM for Mix-grained Image Quality Assessment
by: Liu, Kai, et al.
Published: (2024)
by: Liu, Kai, et al.
Published: (2024)
Probing Unlearned Diffusion Models: A Transferable Adversarial Attack Perspective
by: Han, Xiaoxuan, et al.
Published: (2024)
by: Han, Xiaoxuan, et al.
Published: (2024)
Is It Possible to Backdoor Face Forgery Detection with Natural Triggers?
by: Han, Xiaoxuan, et al.
Published: (2023)
by: Han, Xiaoxuan, et al.
Published: (2023)
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
by: Sun, Shangkun, et al.
Published: (2024)
by: Sun, Shangkun, et al.
Published: (2024)
Quality Assessment and Distortion-aware Saliency Prediction for AI-Generated Omnidirectional Images
by: Yang, Liu, et al.
Published: (2025)
by: Yang, Liu, et al.
Published: (2025)
EVM-Fusion: An Explainable Vision Mamba Architecture with Neural Algorithmic Fusion
by: Yang, Zichuan, et al.
Published: (2025)
by: Yang, Zichuan, et al.
Published: (2025)
Artifact Feature Purification for Cross-domain Detection of AI-generated Images
by: Meng, Zheling, et al.
Published: (2024)
by: Meng, Zheling, et al.
Published: (2024)
ReasonX: MLLM-Guided Intrinsic Image Decomposition
by: Dirik, Alara, et al.
Published: (2025)
by: Dirik, Alara, et al.
Published: (2025)
HEIE: MLLM-Based Hierarchical Explainable AIGC Image Implausibility Evaluator
by: Yang, Fan, et al.
Published: (2024)
by: Yang, Fan, et al.
Published: (2024)
DeQA-Doc: Adapting DeQA-Score to Document Image Quality Assessment
by: Gao, Junjie, et al.
Published: (2025)
by: Gao, Junjie, et al.
Published: (2025)
Revisiting Adversarial Training under Hyperspectral Image
by: Zhang, Weihua, et al.
Published: (2025)
by: Zhang, Weihua, et al.
Published: (2025)
Instant Preference Alignment for Text-to-Image Diffusion Models
by: Li, Yang, et al.
Published: (2025)
by: Li, Yang, et al.
Published: (2025)
Efficient Motion-Aware Video MLLM
by: Zhao, Zijia, et al.
Published: (2025)
by: Zhao, Zijia, et al.
Published: (2025)
NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment
by: Han, Shuhao, et al.
Published: (2025)
by: Han, Shuhao, et al.
Published: (2025)
ReCALL: Recalibrating Capability Degradation for MLLM-based Composed Image Retrieval
by: Yang, Tianyu, et al.
Published: (2026)
by: Yang, Tianyu, et al.
Published: (2026)
CAD-MLLM: Unifying Multimodality-Conditioned CAD Generation With MLLM
by: Xu, Jingwei, et al.
Published: (2024)
by: Xu, Jingwei, et al.
Published: (2024)
New Dataset and Methods for Fine-Grained Compositional Referring Expression Comprehension via Specialist-MLLM Collaboration
by: Yang, Xuzheng, et al.
Published: (2025)
by: Yang, Xuzheng, et al.
Published: (2025)
What You See Is What Matters: A Novel Visual and Physics-Based Metric for Evaluating Video Generation Quality
by: Wang, Zihan, et al.
Published: (2024)
by: Wang, Zihan, et al.
Published: (2024)
Demystifying Numerosity in Diffusion Models -- Limitations and Remedies
by: Zhao, Yaqi, et al.
Published: (2025)
by: Zhao, Yaqi, et al.
Published: (2025)
Deep Tiny Network for Recognition-Oriented Face Image Quality Assessment
by: Peng, Baoyun, et al.
Published: (2021)
by: Peng, Baoyun, et al.
Published: (2021)
LVAgent: Long Video Understanding by Multi-Round Dynamical Collaboration of MLLM Agents
by: Chen, Boyu, et al.
Published: (2025)
by: Chen, Boyu, et al.
Published: (2025)
Noise-Informed Diffusion-Generated Image Detection with Anomaly Attention
by: Guan, Weinan, et al.
Published: (2025)
by: Guan, Weinan, et al.
Published: (2025)
Stochasticity-aware No-Reference Point Cloud Quality Assessment
by: Fan, Songlin, et al.
Published: (2024)
by: Fan, Songlin, et al.
Published: (2024)
Moodifier: MLLM-Enhanced Emotion-Driven Image Editing
by: Ye, Jiarong, et al.
Published: (2025)
by: Ye, Jiarong, et al.
Published: (2025)
Re-purposing SAM into Efficient Visual Projectors for MLLM-Based Referring Image Segmentation
by: Yang, Xiaobo, et al.
Published: (2025)
by: Yang, Xiaobo, et al.
Published: (2025)
Quality Assessment for AI Generated Images with Instruction Tuning
by: Wang, Jiarui, et al.
Published: (2024)
by: Wang, Jiarui, et al.
Published: (2024)
UniQA: Unified Vision-Language Pre-training for Image Quality and Aesthetic Assessment
by: Zhou, Hantao, et al.
Published: (2024)
by: Zhou, Hantao, et al.
Published: (2024)
Self-Evolving Vision-Language Models for Image Quality Assessment via Voting and Ranking
by: Wen, Wen, et al.
Published: (2025)
by: Wen, Wen, et al.
Published: (2025)
Similar Items
-
HandEval: Taking the First Step Towards Hand Quality Evaluation in Generated Images
by: Wang, Zichuan, et al.
Published: (2025) -
CLIP-AGIQA: Boosting the Performance of AI-Generated Image Quality Assessment with CLIP
by: Tang, Zhenchen, et al.
Published: (2024) -
DREAM: A Benchmark Study for Deepfake photoREalism AssessMent
by: Peng, Bo, et al.
Published: (2025) -
Counterfactual Explanations for Face Forgery Detection via Adversarial Removal of Artifacts
by: Li, Yang, et al.
Published: (2024) -
Revisiting Video Quality Assessment from the Perspective of Generalization
by: Yue, Xinli, et al.
Published: (2024)