Q-Agent: Quality-Driven Chain-of-Thought Image Restoration Agent through Robust Multimodal Large Language Model
Fuente:
arXiv
Saved in:
| Main Authors: | Zhou, Yingjie, Cao, Jiezhang, Wen, Farong, Zhang, Zicheng, Zhou, Yu, Shi, Yue, Liu, Xiaohong, Timofte, Radu, Van Gool, Luc, Zhai, Guangtao |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
by: Zhou, Yingjie, et al.
Published: (2025)
by: Zhou, Yingjie, et al.
Published: (2025)
3DGCQA: A Quality Assessment Database for 3D AI-Generated Contents
by: Zhou, Yingjie, et al.
Published: (2024)
by: Zhou, Yingjie, et al.
Published: (2024)
Deep Equilibrium Diffusion Restoration with Parallel Sampling
by: Cao, Jiezhang, et al.
Published: (2023)
by: Cao, Jiezhang, et al.
Published: (2023)
THQA: A Perceptual Quality Assessment Database for Talking Heads
by: Zhou, Yingjie, et al.
Published: (2024)
by: Zhou, Yingjie, et al.
Published: (2024)
MEMO-Bench: A Multiple Benchmark for Text-to-Image and Multimodal Large Language Models on Human Emotion Analysis
by: Zhou, Yingjie, et al.
Published: (2024)
by: Zhou, Yingjie, et al.
Published: (2024)
MoVideo: Motion-Aware Video Generation with Diffusion Models
by: Liang, Jingyun, et al.
Published: (2023)
by: Liang, Jingyun, et al.
Published: (2023)
InstructIR: High-Quality Image Restoration Following Human Instructions
by: Conde, Marcos V., et al.
Published: (2024)
by: Conde, Marcos V., et al.
Published: (2024)
Q-Refine: A Perceptual Quality Refiner for AI-Generated Image
by: Li, Chunyi, et al.
Published: (2024)
by: Li, Chunyi, et al.
Published: (2024)
AU-IQA: A Benchmark Dataset for Perceptual Quality Assessment of AI-Enhanced User-Generated Content
by: Wang, Shushi, et al.
Published: (2025)
by: Wang, Shushi, et al.
Published: (2025)
GMS-3DQA: Projection-based Grid Mini-patch Sampling for 3D Model Quality Assessment
by: Zhang, Zicheng, et al.
Published: (2023)
by: Zhang, Zicheng, et al.
Published: (2023)
Efficient One-Step Diffusion Restoration Model with Compact Token Compression and Linear Attention
by: Qiao, Bingtian, et al.
Published: (2026)
by: Qiao, Bingtian, et al.
Published: (2026)
MISC: Ultra-low Bitrate Image Semantic Compression Driven by Large Multimodal Model
by: Li, Chunyi, et al.
Published: (2024)
by: Li, Chunyi, et al.
Published: (2024)
Toward Efficient Deep Blind RAW Image Restoration
by: Conde, Marcos V., et al.
Published: (2024)
by: Conde, Marcos V., et al.
Published: (2024)
Ultrasound-QBench: Can LLMs Aid in Quality Assessment of Ultrasound Imaging?
by: Miao, Hongyi, et al.
Published: (2025)
by: Miao, Hongyi, et al.
Published: (2025)
Charting the Path Forward: CT Image Quality Assessment -- An In-Depth Review
by: Xun, Siyi, et al.
Published: (2024)
by: Xun, Siyi, et al.
Published: (2024)
Enhancing Blind Video Quality Assessment with Rich Quality-aware Features
by: Sun, Wei, et al.
Published: (2024)
by: Sun, Wei, et al.
Published: (2024)
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
by: Li, Chunyi, et al.
Published: (2024)
by: Li, Chunyi, et al.
Published: (2024)
MatIR: A Hybrid Mamba-Transformer Image Restoration Model
by: Wen, Juan, et al.
Published: (2025)
by: Wen, Juan, et al.
Published: (2025)
Resolution-Agnostic Neural Compression for High-Fidelity Portrait Video Conferencing via Implicit Radiance Fields
by: Li, Yifei, et al.
Published: (2024)
by: Li, Yifei, et al.
Published: (2024)
Assessing UHD Image Quality from Aesthetics, Distortions, and Saliency
by: Sun, Wei, et al.
Published: (2024)
by: Sun, Wei, et al.
Published: (2024)
Higher fidelity perceptual image and video compression with a latent conditioned residual denoising diffusion model
by: Brenig, Jonas, et al.
Published: (2025)
by: Brenig, Jonas, et al.
Published: (2025)
Adaptive Image Quality Assessment via Teaching Large Multimodal Model to Compare
by: Zhu, Hanwei, et al.
Published: (2024)
by: Zhu, Hanwei, et al.
Published: (2024)
LocalViT: Analyzing Locality in Vision Transformers
by: Li, Yawei, et al.
Published: (2021)
by: Li, Yawei, et al.
Published: (2021)
Compression-Realized Deep Structural Network for Video Quality Enhancement
by: Sun, Hanchi, et al.
Published: (2024)
by: Sun, Hanchi, et al.
Published: (2024)
Just Noticeable Difference for Large Multimodal Models
by: Chen, Zijian, et al.
Published: (2025)
by: Chen, Zijian, et al.
Published: (2025)
Quality Assessment in the Era of Large Models: A Survey
by: Zhang, Zicheng, et al.
Published: (2024)
by: Zhang, Zicheng, et al.
Published: (2024)
Language-Free Generative Editing from One Visual Example
by: Elezabi, Omar, et al.
Published: (2026)
by: Elezabi, Omar, et al.
Published: (2026)
Key-Graph Transformer for Image Restoration
by: Ren, Bin, et al.
Published: (2024)
by: Ren, Bin, et al.
Published: (2024)
Image Quality Assessment: From Human to Machine Preference
by: Li, Chunyi, et al.
Published: (2025)
by: Li, Chunyi, et al.
Published: (2025)
Exploring Image Quality Assessment from a New Perspective: Pupil Size
by: Gao, Yixuan, et al.
Published: (2025)
by: Gao, Yixuan, et al.
Published: (2025)
Surveillance Facial Image Quality Assessment: A Multi-dimensional Dataset and Lightweight Model
by: Jiang, Yanwei, et al.
Published: (2026)
by: Jiang, Yanwei, et al.
Published: (2026)
Compressed Depth Map Super-Resolution and Restoration: AIM 2024 Challenge Results
by: Conde, Marcos V., et al.
Published: (2024)
by: Conde, Marcos V., et al.
Published: (2024)
Who is a Better Player: LLM against LLM
by: Zhou, Yingjie, et al.
Published: (2025)
by: Zhou, Yingjie, et al.
Published: (2025)
Audio-Visual Quality Assessment for User Generated Content: Database and Method
by: Cao, Yuqin, et al.
Published: (2023)
by: Cao, Yuqin, et al.
Published: (2023)
Enhanced Super-Resolution Training via Mimicked Alignment for Real-World Scenes
by: Elezabi, Omar, et al.
Published: (2024)
by: Elezabi, Omar, et al.
Published: (2024)
AdaptSR: Low-Rank Adaptation for Efficient and Scalable Real-World Super-Resolution
by: Korkmaz, Cansu, et al.
Published: (2025)
by: Korkmaz, Cansu, et al.
Published: (2025)
Embodied Image Compression
by: Li, Chunyi, et al.
Published: (2025)
by: Li, Chunyi, et al.
Published: (2025)
Dual-Representation Interaction Driven Image Quality Assessment with Restoration Assistance
by: Yue, Jingtong, et al.
Published: (2024)
by: Yue, Jingtong, et al.
Published: (2024)
EvalTalker: Learning to Evaluate Real-Portrait-Driven Multi-Subject Talking Humans
by: Zhou, Yingjie, et al.
Published: (2025)
by: Zhou, Yingjie, et al.
Published: (2025)
No-Reference Point Cloud Quality Assessment via Graph Convolutional Network
by: Chen, Wu, et al.
Published: (2024)
by: Chen, Wu, et al.
Published: (2024)
Similar Items
-
Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
by: Zhou, Yingjie, et al.
Published: (2025) -
3DGCQA: A Quality Assessment Database for 3D AI-Generated Contents
by: Zhou, Yingjie, et al.
Published: (2024) -
Deep Equilibrium Diffusion Restoration with Parallel Sampling
by: Cao, Jiezhang, et al.
Published: (2023) -
THQA: A Perceptual Quality Assessment Database for Talking Heads
by: Zhou, Yingjie, et al.
Published: (2024) -
MEMO-Bench: A Multiple Benchmark for Text-to-Image and Multimodal Large Language Models on Human Emotion Analysis
by: Zhou, Yingjie, et al.
Published: (2024)