Teaching Large Language Models to Regress Accurate Image Quality Scores using Score Distribution
Fuente:
arXiv
Saved in:
| Main Authors: | You, Zhiyuan, Cai, Xin, Gu, Jinjin, Xue, Tianfan, Dong, Chao |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Depicting Beyond Scores: Advancing Image Quality Assessment through Multi-modal Language Models
by: You, Zhiyuan, et al.
Published: (2023)
by: You, Zhiyuan, et al.
Published: (2023)
Enhancing Descriptive Image Quality Assessment with A Large-scale Multi-modal Dataset
by: You, Zhiyuan, et al.
Published: (2024)
by: You, Zhiyuan, et al.
Published: (2024)
Revisiting the Generalization Problem of Low-level Vision Models Through the Lens of Image Deraining
by: Hu, Jinfan, et al.
Published: (2025)
by: Hu, Jinfan, et al.
Published: (2025)
PhotoFramer: Multi-modal Image Composition Instruction
by: You, Zhiyuan, et al.
Published: (2025)
by: You, Zhiyuan, et al.
Published: (2025)
Harnessing Diffusion-Yielded Score Priors for Image Restoration
by: Lin, Xinqi, et al.
Published: (2025)
by: Lin, Xinqi, et al.
Published: (2025)
DA-VAE: Plug-in Latent Compression for Diffusion via Detail Alignment
by: Cai, Xin, et al.
Published: (2026)
by: Cai, Xin, et al.
Published: (2026)
An Intelligent Agentic System for Complex Image Restoration Problems
by: Zhu, Kaiwen, et al.
Published: (2024)
by: Zhu, Kaiwen, et al.
Published: (2024)
Teaching LMMs for Image Quality Scoring and Interpreting
by: Zhang, Zicheng, et al.
Published: (2025)
by: Zhang, Zicheng, et al.
Published: (2025)
UltraFusion: Ultra High Dynamic Imaging using Exposure Fusion
by: Chen, Zixuan, et al.
Published: (2025)
by: Chen, Zixuan, et al.
Published: (2025)
PhoCoLens: Photorealistic and Consistent Reconstruction in Lensless Imaging
by: Cai, Xin, et al.
Published: (2024)
by: Cai, Xin, et al.
Published: (2024)
LM4LV: A Frozen Large Language Model for Low-level Vision Tasks
by: Zheng, Boyang, et al.
Published: (2024)
by: Zheng, Boyang, et al.
Published: (2024)
DeQA-Doc: Adapting DeQA-Score to Document Image Quality Assessment
by: Gao, Junjie, et al.
Published: (2025)
by: Gao, Junjie, et al.
Published: (2025)
How far have we gone in Generative Image Restoration? A study on its capability, limitations and evaluation practices
by: Yin, Xiang, et al.
Published: (2026)
by: Yin, Xiang, et al.
Published: (2026)
Next Token Is Enough: Realistic Image Quality and Aesthetic Scoring with Multimodal Large Language Model
by: Li, Mingxing, et al.
Published: (2025)
by: Li, Mingxing, et al.
Published: (2025)
Interpreting Low-level Vision Models with Causal Effect Maps
by: Hu, Jinfan, et al.
Published: (2024)
by: Hu, Jinfan, et al.
Published: (2024)
HDRFlow: Real-Time HDR Video Reconstruction with Large Motions
by: Xu, Gangwei, et al.
Published: (2024)
by: Xu, Gangwei, et al.
Published: (2024)
UniCon: Unidirectional Information Flow for Effective Control of Large-Scale Diffusion Models
by: Yu, Fanghua, et al.
Published: (2025)
by: Yu, Fanghua, et al.
Published: (2025)
Quality-Driven Curation of Remote Sensing Vision-Language Data via Learned Scoring Models
by: Muhtar, Dilxat, et al.
Published: (2025)
by: Muhtar, Dilxat, et al.
Published: (2025)
MSD-Score: Multi-Scale Distributional Scoring for Reference-Free Image Caption Evaluation
by: Kan, Shichao, et al.
Published: (2026)
by: Kan, Shichao, et al.
Published: (2026)
Position: Agentic Systems Constitute a Key Component of Next-Generation Intelligent Image Processing
by: Gu, Jinjin
Published: (2025)
by: Gu, Jinjin
Published: (2025)
Position: Evaluation of Visual Processing Should Be Human-Centered, Not Metric-Centered
by: Hu, Jinfan, et al.
Published: (2026)
by: Hu, Jinfan, et al.
Published: (2026)
AutoDIR: Automatic All-in-One Image Restoration with Latent Diffusion
by: Jiang, Yitong, et al.
Published: (2023)
by: Jiang, Yitong, et al.
Published: (2023)
Score2Instruct: Scaling Up Video Quality-Centric Instructions via Automated Dimension Scoring
by: Xie, Qizhi, et al.
Published: (2025)
by: Xie, Qizhi, et al.
Published: (2025)
PhotoAgent: Agentic Photo Editing with Exploratory Visual Aesthetic Planning
by: Yao, Mingde, et al.
Published: (2026)
by: Yao, Mingde, et al.
Published: (2026)
Redefining Quality Criteria and Distance-Aware Score Modeling for Image Editing Assessment
by: Zhang, Xinjie, et al.
Published: (2026)
by: Zhang, Xinjie, et al.
Published: (2026)
Efficient Denoising using Score Embedding in Score-based Diffusion Models
by: Na, Andrew S., et al.
Published: (2024)
by: Na, Andrew S., et al.
Published: (2024)
LenslessFace: An End-to-End Optimized Lensless System for Privacy-Preserving Face Verification
by: Cai, Xin, et al.
Published: (2024)
by: Cai, Xin, et al.
Published: (2024)
CrossScore: Towards Multi-View Image Evaluation and Scoring
by: Wang, Zirui, et al.
Published: (2024)
by: Wang, Zirui, et al.
Published: (2024)
A Physics-Informed Blur Learning Framework for Imaging Systems
by: Chen, Liqun, et al.
Published: (2025)
by: Chen, Liqun, et al.
Published: (2025)
AdaptiveISP: Learning an Adaptive Image Signal Processor for Object Detection
by: Wang, Yujin, et al.
Published: (2024)
by: Wang, Yujin, et al.
Published: (2024)
Towards Generalized Image Manipulation Localization via Score-based Model
by: Wang, Yunfei, et al.
Published: (2026)
by: Wang, Yunfei, et al.
Published: (2026)
EditScore: Unlocking Online RL for Image Editing via High-Fidelity Reward Modeling
by: Luo, Xin, et al.
Published: (2025)
by: Luo, Xin, et al.
Published: (2025)
FaithScore: Fine-grained Evaluations of Hallucinations in Large Vision-Language Models
by: Jing, Liqiang, et al.
Published: (2023)
by: Jing, Liqiang, et al.
Published: (2023)
Acquire Precise and Comparable Fundus Image Quality Score: FTHNet and FQS Dataset
by: Gong, Zheng, et al.
Published: (2024)
by: Gong, Zheng, et al.
Published: (2024)
Global-Local Image Perceptual Score (GLIPS): Evaluating Photorealistic Quality of AI-Generated Images
by: Aziz, Memoona, et al.
Published: (2024)
by: Aziz, Memoona, et al.
Published: (2024)
QPT V2: Masked Image Modeling Advances Visual Scoring
by: Xie, Qizhi, et al.
Published: (2024)
by: Xie, Qizhi, et al.
Published: (2024)
Think, then Score: Decoupled Reasoning and Scoring for Video Reward Modeling
by: Wang, Yuan, et al.
Published: (2026)
by: Wang, Yuan, et al.
Published: (2026)
Reasoning as Representation: Rethinking Visual Reinforcement Learning in Image Quality Assessment
by: Zhao, Shijie, et al.
Published: (2025)
by: Zhao, Shijie, et al.
Published: (2025)
Score-Based Turbo Message Passing for Plug-and-Play Compressive Imaging
by: Cai, Chang, et al.
Published: (2025)
by: Cai, Chang, et al.
Published: (2025)
Images Speak Louder Than Scores: Failure Mode Escape for Enhancing Generative Quality
by: Shao, Jie, et al.
Published: (2025)
by: Shao, Jie, et al.
Published: (2025)
Similar Items
-
Depicting Beyond Scores: Advancing Image Quality Assessment through Multi-modal Language Models
by: You, Zhiyuan, et al.
Published: (2023) -
Enhancing Descriptive Image Quality Assessment with A Large-scale Multi-modal Dataset
by: You, Zhiyuan, et al.
Published: (2024) -
Revisiting the Generalization Problem of Low-level Vision Models Through the Lens of Image Deraining
by: Hu, Jinfan, et al.
Published: (2025) -
PhotoFramer: Multi-modal Image Composition Instruction
by: You, Zhiyuan, et al.
Published: (2025) -
Harnessing Diffusion-Yielded Score Priors for Image Restoration
by: Lin, Xinqi, et al.
Published: (2025)