QualiRAG: Retrieval-Augmented Generation for Visual Quality Understanding
Fuente:
arXiv
Saved in:
| Main Authors: | Cao, Linhan, Sun, Wei, Zhang, Weixia, Zhu, Xiangyang, Zhang, Kaiwei, Jia, Jun, Zhu, Dandan, Zhai, Guangtao, Min, Xiongkuo |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
VQAThinker: Exploring Generalizable and Explainable Video Quality Assessment via Reinforcement Learning
by: Cao, Linhan, et al.
Published: (2025)
by: Cao, Linhan, et al.
Published: (2025)
Efficient Face Image Quality Assessment via Self-training and Knowledge Distillation
by: Sun, Wei, et al.
Published: (2025)
by: Sun, Wei, et al.
Published: (2025)
Generalizable Video Quality Assessment via Weak-to-Strong Learning
by: Cao, Linhan, et al.
Published: (2025)
by: Cao, Linhan, et al.
Published: (2025)
Textured Mesh Saliency: Bridging Geometry and Texture for Human Perception in 3D Graphics
by: Zhang, Kaiwei, et al.
Published: (2024)
by: Zhang, Kaiwei, et al.
Published: (2024)
Mesh Mamba: A Unified State Space Model for Saliency Prediction in Non-Textured and Textured Meshes
by: Zhang, Kaiwei, et al.
Published: (2025)
by: Zhang, Kaiwei, et al.
Published: (2025)
CompressedVQA-HDR: Generalized Full-reference and No-reference Quality Assessment Models for Compressed High Dynamic Range Videos
by: Sun, Wei, et al.
Published: (2025)
by: Sun, Wei, et al.
Published: (2025)
Assessing UHD Image Quality from Aesthetics, Distortions, and Saliency
by: Sun, Wei, et al.
Published: (2024)
by: Sun, Wei, et al.
Published: (2024)
Enhancing Blind Video Quality Assessment with Rich Quality-aware Features
by: Sun, Wei, et al.
Published: (2024)
by: Sun, Wei, et al.
Published: (2024)
Engagement Prediction of Short Videos with Large Multimodal Models
by: Sun, Wei, et al.
Published: (2025)
by: Sun, Wei, et al.
Published: (2025)
Audio-Visual Quality Assessment for User Generated Content: Database and Method
by: Cao, Yuqin, et al.
Published: (2023)
by: Cao, Yuqin, et al.
Published: (2023)
Enhancing Image Quality Assessment Ability of LMMs via Retrieval-Augmented Generation
by: Fu, Kang, et al.
Published: (2026)
by: Fu, Kang, et al.
Published: (2026)
AGAV-Rater: Adapting Large Multimodal Model for AI-Generated Audio-Visual Quality Assessment
by: Cao, Yuqin, et al.
Published: (2025)
by: Cao, Yuqin, et al.
Published: (2025)
Adapter Shield: A Unified Framework with Built-in Authentication for Preventing Unauthorized Zero-Shot Image-to-Image Generation
by: Jia, Jun, et al.
Published: (2025)
by: Jia, Jun, et al.
Published: (2025)
Sycophancy under Pressure: Evaluating and Mitigating Sycophantic Bias via Adversarial Dialogues in Scientific QA
by: Zhang, Kaiwei, et al.
Published: (2025)
by: Zhang, Kaiwei, et al.
Published: (2025)
VITAL: Vision-Encoder-centered Pre-training for LMMs in Visual Quality Assessment
by: Jia, Ziheng, et al.
Published: (2025)
by: Jia, Ziheng, et al.
Published: (2025)
KidVis: Do Multimodal Large Language Models Possess the Visual Perceptual Capabilities of a 6-Year-Old?
by: Wang, Xianfeng, et al.
Published: (2026)
by: Wang, Xianfeng, et al.
Published: (2026)
Perceptual Video Quality Assessment: A Survey
by: Min, Xiongkuo, et al.
Published: (2024)
by: Min, Xiongkuo, et al.
Published: (2024)
How Does Audio Influence Visual Attention in Omnidirectional Videos? Database and Model
by: Zhu, Yuxin, et al.
Published: (2024)
by: Zhu, Yuxin, et al.
Published: (2024)
UNQA: Unified No-Reference Quality Assessment for Audio, Image, Video, and Audio-Visual Content
by: Cao, Yuqin, et al.
Published: (2024)
by: Cao, Yuqin, et al.
Published: (2024)
fMRI Exploration of Visual Quality Assessment
by: Zhang, Yiming, et al.
Published: (2024)
by: Zhang, Yiming, et al.
Published: (2024)
DLADiff: A Dual-Layer Defense Framework against Fine-Tuning and Zero-Shot Customization of Diffusion Models
by: Jia, Jun, et al.
Published: (2025)
by: Jia, Jun, et al.
Published: (2025)
Large Multi-modality Model Assisted AI-Generated Image Quality Assessment
by: Wang, Puyi, et al.
Published: (2024)
by: Wang, Puyi, et al.
Published: (2024)
XGC-AVis: Towards Audio-Visual Content Understanding with a Multi-Agent Collaborative System
by: Cao, Yuqin, et al.
Published: (2025)
by: Cao, Yuqin, et al.
Published: (2025)
SafetyFlow: An Agent-Flow System for Automated LLM Safety Benchmarking
by: Zhu, Xiangyang, et al.
Published: (2025)
by: Zhu, Xiangyang, et al.
Published: (2025)
Dual-Branch Network for Portrait Image Quality Assessment
by: Sun, Wei, et al.
Published: (2024)
by: Sun, Wei, et al.
Published: (2024)
LifeEval: A Multimodal Benchmark for Assistive AI in Egocentric Daily Life Tasks
by: Gao, Hengjian, et al.
Published: (2026)
by: Gao, Hengjian, et al.
Published: (2026)
VQualA 2025 Challenge on Visual Quality Comparison for Large Multimodal Models: Methods and Results
by: Zhu, Hanwei, et al.
Published: (2025)
by: Zhu, Hanwei, et al.
Published: (2025)
Exploring Image Quality Assessment from a New Perspective: Pupil Size
by: Gao, Yixuan, et al.
Published: (2025)
by: Gao, Yixuan, et al.
Published: (2025)
Quality Assessment for AI Generated Images with Instruction Tuning
by: Wang, Jiarui, et al.
Published: (2024)
by: Wang, Jiarui, et al.
Published: (2024)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
by: Zhang, Yiming, et al.
Published: (2025)
by: Zhang, Yiming, et al.
Published: (2025)
Surveillance Facial Image Quality Assessment: A Multi-dimensional Dataset and Lightweight Model
by: Jiang, Yanwei, et al.
Published: (2026)
by: Jiang, Yanwei, et al.
Published: (2026)
SG-JND: Semantic-Guided Just Noticeable Distortion Predictor For Image Compression
by: Cao, Linhan, et al.
Published: (2024)
by: Cao, Linhan, et al.
Published: (2024)
How is Visual Attention Influenced by Text Guidance? Database and Model
by: Sun, Yinan, et al.
Published: (2024)
by: Sun, Yinan, et al.
Published: (2024)
GOBench: Benchmarking Geometric Optics Generation and Understanding of MLLMs
by: Zhu, Xiaorong, et al.
Published: (2025)
by: Zhu, Xiaorong, et al.
Published: (2025)
Towards Explainable Partial-AIGC Image Quality Assessment
by: Qian, Jiaying, et al.
Published: (2025)
by: Qian, Jiaying, et al.
Published: (2025)
AIGIQA-20K: A Large Database for AI-Generated Image Quality Assessment
by: Li, Chunyi, et al.
Published: (2024)
by: Li, Chunyi, et al.
Published: (2024)
Mitigating Low-Level Visual Hallucinations Requires Self-Awareness: Database, Model and Training Strategy
by: Sun, Yinan, et al.
Published: (2025)
by: Sun, Yinan, et al.
Published: (2025)
GAIA: Rethinking Action Quality Assessment for AI-Generated Videos
by: Chen, Zijian, et al.
Published: (2024)
by: Chen, Zijian, et al.
Published: (2024)
Task-Specific Normalization for Continual Learning of Blind Image Quality Models
by: Zhang, Weixia, et al.
Published: (2021)
by: Zhang, Weixia, et al.
Published: (2021)
Subjective and Objective Quality-of-Experience Evaluation Study for Live Video Streaming
by: Zhu, Zehao, et al.
Published: (2024)
by: Zhu, Zehao, et al.
Published: (2024)
Similar Items
-
VQAThinker: Exploring Generalizable and Explainable Video Quality Assessment via Reinforcement Learning
by: Cao, Linhan, et al.
Published: (2025) -
Efficient Face Image Quality Assessment via Self-training and Knowledge Distillation
by: Sun, Wei, et al.
Published: (2025) -
Generalizable Video Quality Assessment via Weak-to-Strong Learning
by: Cao, Linhan, et al.
Published: (2025) -
Textured Mesh Saliency: Bridging Geometry and Texture for Human Perception in 3D Graphics
by: Zhang, Kaiwei, et al.
Published: (2024) -
Mesh Mamba: A Unified State Space Model for Saliency Prediction in Non-Textured and Textured Meshes
by: Zhang, Kaiwei, et al.
Published: (2025)