Teaching LMMs for Image Quality Scoring and Interpreting
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Zicheng, Wu, Haoning, Jia, Ziheng, Lin, Weisi, Zhai, Guangtao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Q-Bench-Video: Benchmarking the Video Quality Understanding of LMMs
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
Q-Bench+: A Benchmark for Multi-modal Foundation Models on Low-level Vision from Single Images to Pairs
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
A-Bench: Are LMMs Masters at Evaluating AI-generated Images?
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
Adaptive Image Quality Assessment via Teaching Large Multimodal Model to Compare
di: Zhu, Hanwei, et al.
Pubblicazione: (2024)
di: Zhu, Hanwei, et al.
Pubblicazione: (2024)
VQA$^2$: Visual Question Answering for Video Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2024)
di: Jia, Ziheng, et al.
Pubblicazione: (2024)
VITAL: Vision-Encoder-centered Pre-training for LMMs in Visual Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2025)
di: Jia, Ziheng, et al.
Pubblicazione: (2025)
Dual-Branch Network for Portrait Image Quality Assessment
di: Sun, Wei, et al.
Pubblicazione: (2024)
di: Sun, Wei, et al.
Pubblicazione: (2024)
Enhancing Image Quality Assessment Ability of LMMs via Retrieval-Augmented Generation
di: Fu, Kang, et al.
Pubblicazione: (2026)
di: Fu, Kang, et al.
Pubblicazione: (2026)
Image Quality Assessment: From Human to Machine Preference
di: Li, Chunyi, et al.
Pubblicazione: (2025)
di: Li, Chunyi, et al.
Pubblicazione: (2025)
Towards Explainable Partial-AIGC Image Quality Assessment
di: Qian, Jiaying, et al.
Pubblicazione: (2025)
di: Qian, Jiaying, et al.
Pubblicazione: (2025)
G-Refine: A General Quality Refiner for Text-to-Image Generation
di: Li, Chunyi, et al.
Pubblicazione: (2024)
di: Li, Chunyi, et al.
Pubblicazione: (2024)
Explore the Hallucination on Low-level Perception for MLLMs
di: Sun, Yinan, et al.
Pubblicazione: (2024)
di: Sun, Yinan, et al.
Pubblicazione: (2024)
Q-Refine: A Perceptual Quality Refiner for AI-Generated Image
di: Li, Chunyi, et al.
Pubblicazione: (2024)
di: Li, Chunyi, et al.
Pubblicazione: (2024)
LMM-PCQA: Assisting Point Cloud Quality Assessment with LMM
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs
di: Xu, Zitong, et al.
Pubblicazione: (2025)
di: Xu, Zitong, et al.
Pubblicazione: (2025)
TDVE-Assessor: Benchmarking and Evaluating the Quality of Text-Driven Video Editing with LMMs
di: Wang, Juntong, et al.
Pubblicazione: (2025)
di: Wang, Juntong, et al.
Pubblicazione: (2025)
Q-Ground: Image Quality Grounding with Large Multi-modality Models
di: Chen, Chaofeng, et al.
Pubblicazione: (2024)
di: Chen, Chaofeng, et al.
Pubblicazione: (2024)
Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment
di: Kou, Tengchuan, et al.
Pubblicazione: (2024)
di: Kou, Tengchuan, et al.
Pubblicazione: (2024)
MISC: Ultra-low Bitrate Image Semantic Compression Driven by Large Multimodal Model
di: Li, Chunyi, et al.
Pubblicazione: (2024)
di: Li, Chunyi, et al.
Pubblicazione: (2024)
TIT-Score: Evaluating Long-Prompt Based Text-to-Image Alignment via Text-to-Image-to-Text Consistency
di: Wang, Juntong, et al.
Pubblicazione: (2025)
di: Wang, Juntong, et al.
Pubblicazione: (2025)
Towards Open-ended Visual Quality Comparison
di: Wu, Haoning, et al.
Pubblicazione: (2024)
di: Wu, Haoning, et al.
Pubblicazione: (2024)
Image Quality Assessment for Embodied AI
di: Li, Chunyi, et al.
Pubblicazione: (2025)
di: Li, Chunyi, et al.
Pubblicazione: (2025)
DyCoRM: Dynamic Criterion-Aware Reward Modeling for Text-to-Image Generation
di: Qian, Jiaying, et al.
Pubblicazione: (2026)
di: Qian, Jiaying, et al.
Pubblicazione: (2026)
LMM4LMM: Benchmarking and Evaluating Large-multimodal Image Generation with LMMs
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
Light-VQA+: A Video Quality Assessment Model for Exposure Correction with Vision-Language Guidance
di: Zhou, Xunchu, et al.
Pubblicazione: (2024)
di: Zhou, Xunchu, et al.
Pubblicazione: (2024)
GMS-3DQA: Projection-based Grid Mini-patch Sampling for 3D Model Quality Assessment
di: Zhang, Zicheng, et al.
Pubblicazione: (2023)
di: Zhang, Zicheng, et al.
Pubblicazione: (2023)
CMC-Bench: Towards a New Paradigm of Visual Signal Compression
di: Li, Chunyi, et al.
Pubblicazione: (2024)
di: Li, Chunyi, et al.
Pubblicazione: (2024)
Q-Bench-Portrait: Benchmarking Multimodal Large Language Models on Portrait Image Quality Perception
di: Wu, Sijing, et al.
Pubblicazione: (2026)
di: Wu, Sijing, et al.
Pubblicazione: (2026)
Exploring the Naturalness of AI-Generated Images
di: Chen, Zijian, et al.
Pubblicazione: (2023)
di: Chen, Zijian, et al.
Pubblicazione: (2023)
Large Multi-modality Model Assisted AI-Generated Image Quality Assessment
di: Wang, Puyi, et al.
Pubblicazione: (2024)
di: Wang, Puyi, et al.
Pubblicazione: (2024)
OBI-Bench: Can LMMs Aid in Study of Ancient Script on Oracle Bones?
di: Chen, Zijian, et al.
Pubblicazione: (2024)
di: Chen, Zijian, et al.
Pubblicazione: (2024)
AIGIQA-20K: A Large Database for AI-Generated Image Quality Assessment
di: Li, Chunyi, et al.
Pubblicazione: (2024)
di: Li, Chunyi, et al.
Pubblicazione: (2024)
Exploring Instruction Data Quality for Explainable Image Quality Assessment
di: Li, Yunhao, et al.
Pubblicazione: (2025)
di: Li, Yunhao, et al.
Pubblicazione: (2025)
Scaling-up Perceptual Video Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2025)
di: Jia, Ziheng, et al.
Pubblicazione: (2025)
DHQA-4D: Perceptual Quality Assessment of Dynamic 4D Digital Human
di: Li, Yunhao, et al.
Pubblicazione: (2025)
di: Li, Yunhao, et al.
Pubblicazione: (2025)
Using GUI Agent for Electronic Design Automation
di: Li, Chunyi, et al.
Pubblicazione: (2025)
di: Li, Chunyi, et al.
Pubblicazione: (2025)
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
di: Wu, Haoning, et al.
Pubblicazione: (2023)
di: Wu, Haoning, et al.
Pubblicazione: (2023)
Embodied Image Compression
di: Li, Chunyi, et al.
Pubblicazione: (2025)
di: Li, Chunyi, et al.
Pubblicazione: (2025)
LOVE: Benchmarking and Evaluating Text-to-Video Generation and Video-to-Text Interpretation
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
Multi-Dimensional Quality Assessment for Text-to-3D Assets: Dataset and Model
di: Fu, Kang, et al.
Pubblicazione: (2025)
di: Fu, Kang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Q-Bench-Video: Benchmarking the Video Quality Understanding of LMMs
di: Zhang, Zicheng, et al.
Pubblicazione: (2024) -
Q-Bench+: A Benchmark for Multi-modal Foundation Models on Low-level Vision from Single Images to Pairs
di: Zhang, Zicheng, et al.
Pubblicazione: (2024) -
A-Bench: Are LMMs Masters at Evaluating AI-generated Images?
di: Zhang, Zicheng, et al.
Pubblicazione: (2024) -
Adaptive Image Quality Assessment via Teaching Large Multimodal Model to Compare
di: Zhu, Hanwei, et al.
Pubblicazione: (2024) -
VQA$^2$: Visual Question Answering for Video Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2024)