Q-Bench+: A Benchmark for Multi-modal Foundation Models on Low-level Vision from Single Images to Pairs
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Zicheng, Wu, Haoning, Zhang, Erli, Zhai, Guangtao, Lin, Weisi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
por: Wu, Haoning, et al.
Publicado: (2023)
por: Wu, Haoning, et al.
Publicado: (2023)
Teaching LMMs for Image Quality Scoring and Interpreting
por: Zhang, Zicheng, et al.
Publicado: (2025)
por: Zhang, Zicheng, et al.
Publicado: (2025)
Q-Bench-Video: Benchmarking the Video Quality Understanding of LMMs
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
Q-Ground: Image Quality Grounding with Large Multi-modality Models
por: Chen, Chaofeng, et al.
Publicado: (2024)
por: Chen, Chaofeng, et al.
Publicado: (2024)
Explore the Hallucination on Low-level Perception for MLLMs
por: Sun, Yinan, et al.
Publicado: (2024)
por: Sun, Yinan, et al.
Publicado: (2024)
A-Bench: Are LMMs Masters at Evaluating AI-generated Images?
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
Q-Bench-Portrait: Benchmarking Multimodal Large Language Models on Portrait Image Quality Perception
por: Wu, Sijing, et al.
Publicado: (2026)
por: Wu, Sijing, et al.
Publicado: (2026)
Q-Refine: A Perceptual Quality Refiner for AI-Generated Image
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
por: Zhang, Yiming, et al.
Publicado: (2025)
por: Zhang, Yiming, et al.
Publicado: (2025)
CMC-Bench: Towards a New Paradigm of Visual Signal Compression
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
MISC: Ultra-low Bitrate Image Semantic Compression Driven by Large Multimodal Model
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
G-Refine: A General Quality Refiner for Text-to-Image Generation
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
Adaptive Image Quality Assessment via Teaching Large Multimodal Model to Compare
por: Zhu, Hanwei, et al.
Publicado: (2024)
por: Zhu, Hanwei, et al.
Publicado: (2024)
Large Multi-modality Model Assisted AI-Generated Image Quality Assessment
por: Wang, Puyi, et al.
Publicado: (2024)
por: Wang, Puyi, et al.
Publicado: (2024)
Dual-Branch Network for Portrait Image Quality Assessment
por: Sun, Wei, et al.
Publicado: (2024)
por: Sun, Wei, et al.
Publicado: (2024)
Towards Open-ended Visual Quality Comparison
por: Wu, Haoning, et al.
Publicado: (2024)
por: Wu, Haoning, et al.
Publicado: (2024)
VideoAesBench: Benchmarking the Video Aesthetics Perception Capabilities of Large Multimodal Models
por: Li, Yunhao, et al.
Publicado: (2026)
por: Li, Yunhao, et al.
Publicado: (2026)
Light-VQA+: A Video Quality Assessment Model for Exposure Correction with Vision-Language Guidance
por: Zhou, Xunchu, et al.
Publicado: (2024)
por: Zhou, Xunchu, et al.
Publicado: (2024)
AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception
por: Huang, Yipo, et al.
Publicado: (2024)
por: Huang, Yipo, et al.
Publicado: (2024)
LMM-PCQA: Assisting Point Cloud Quality Assessment with LMM
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
VQA$^2$: Visual Question Answering for Video Quality Assessment
por: Jia, Ziheng, et al.
Publicado: (2024)
por: Jia, Ziheng, et al.
Publicado: (2024)
AesExpert: Towards Multi-modality Foundation Model for Image Aesthetics Perception
por: Huang, Yipo, et al.
Publicado: (2024)
por: Huang, Yipo, et al.
Publicado: (2024)
I2I-Bench: A Comprehensive Benchmark Suite for Image-to-Image Editing Models
por: Wang, Juntong, et al.
Publicado: (2025)
por: Wang, Juntong, et al.
Publicado: (2025)
Image Quality Assessment: From Human to Machine Preference
por: Li, Chunyi, et al.
Publicado: (2025)
por: Li, Chunyi, et al.
Publicado: (2025)
Embodied Image Compression
por: Li, Chunyi, et al.
Publicado: (2025)
por: Li, Chunyi, et al.
Publicado: (2025)
Just Noticeable Difference for Large Multimodal Models
por: Chen, Zijian, et al.
Publicado: (2025)
por: Chen, Zijian, et al.
Publicado: (2025)
Using GUI Agent for Electronic Design Automation
por: Li, Chunyi, et al.
Publicado: (2025)
por: Li, Chunyi, et al.
Publicado: (2025)
GMS-3DQA: Projection-based Grid Mini-patch Sampling for 3D Model Quality Assessment
por: Zhang, Zicheng, et al.
Publicado: (2023)
por: Zhang, Zicheng, et al.
Publicado: (2023)
Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment
por: Kou, Tengchuan, et al.
Publicado: (2024)
por: Kou, Tengchuan, et al.
Publicado: (2024)
Exploring the Naturalness of AI-Generated Images
por: Chen, Zijian, et al.
Publicado: (2023)
por: Chen, Zijian, et al.
Publicado: (2023)
GeoX-Bench: Benchmarking Cross-View Geo-Localization and Pose Estimation Capabilities of Large Multimodal Models
por: Zheng, Yushuo, et al.
Publicado: (2025)
por: Zheng, Yushuo, et al.
Publicado: (2025)
Q-Adapt: Adapting LMM for Visual Quality Assessment with Progressive Instruction Tuning
por: Lu, Yiting, et al.
Publicado: (2025)
por: Lu, Yiting, et al.
Publicado: (2025)
LL-Bench: Rethinking Low-Level Vision Evaluation in the Era of Large-Scale Generative Models
por: Liu, Lu, et al.
Publicado: (2026)
por: Liu, Lu, et al.
Publicado: (2026)
Mitigating Low-Level Visual Hallucinations Requires Self-Awareness: Database, Model and Training Strategy
por: Sun, Yinan, et al.
Publicado: (2025)
por: Sun, Yinan, et al.
Publicado: (2025)
Image Quality Assessment for Embodied AI
por: Li, Chunyi, et al.
Publicado: (2025)
por: Li, Chunyi, et al.
Publicado: (2025)
Vision-Language Consistency Guided Multi-modal Prompt Learning for Blind AI Generated Image Quality Assessment
por: Fu, Jun, et al.
Publicado: (2024)
por: Fu, Jun, et al.
Publicado: (2024)
FUMO: Prior-Modulated Diffusion for Single Image Reflection Removal
por: Xu, Telang, et al.
Publicado: (2026)
por: Xu, Telang, et al.
Publicado: (2026)
ProBench: Judging Multimodal Foundation Models on Open-ended Multi-domain Expert Tasks
por: Yang, Yan, et al.
Publicado: (2025)
por: Yang, Yan, et al.
Publicado: (2025)
UniProcessor: A Text-induced Unified Low-level Image Processor
por: Duan, Huiyu, et al.
Publicado: (2024)
por: Duan, Huiyu, et al.
Publicado: (2024)
Ejemplares similares
-
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
por: Wu, Haoning, et al.
Publicado: (2023) -
Teaching LMMs for Image Quality Scoring and Interpreting
por: Zhang, Zicheng, et al.
Publicado: (2025) -
Q-Bench-Video: Benchmarking the Video Quality Understanding of LMMs
por: Zhang, Zicheng, et al.
Publicado: (2024) -
Q-Ground: Image Quality Grounding with Large Multi-modality Models
por: Chen, Chaofeng, et al.
Publicado: (2024) -
Explore the Hallucination on Low-level Perception for MLLMs
por: Sun, Yinan, et al.
Publicado: (2024)