Q-REAL: Towards Realism and Plausibility Evaluation for AI-Generated Content
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Shushi, Zhang, Zicheng, Li, Chunyi, Wang, Wei, Ma, Liya, Chen, Fengjiao, Li, Xiaoyu, Cao, Xuezhi, Zhai, Guangtao, Liu, Xiaohong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Q-Eval-100K: Evaluating Visual Quality and Alignment Level for Text-to-Vision Content
por: Zhang, Zicheng, et al.
Publicado: (2025)
por: Zhang, Zicheng, et al.
Publicado: (2025)
AU-IQA: A Benchmark Dataset for Perceptual Quality Assessment of AI-Enhanced User-Generated Content
por: Wang, Shushi, et al.
Publicado: (2025)
por: Wang, Shushi, et al.
Publicado: (2025)
Q-Save: Towards Scoring and Attribution for Generated Video Evaluation
por: Wu, Xiele, et al.
Publicado: (2025)
por: Wu, Xiele, et al.
Publicado: (2025)
Learning Hazing to Dehazing: Towards Realistic Haze Generation for Real-World Image Dehazing
por: Wang, Ruiyi, et al.
Publicado: (2025)
por: Wang, Ruiyi, et al.
Publicado: (2025)
HazeCLIP: Towards Language Guided Real-World Image Dehazing
por: Wang, Ruiyi, et al.
Publicado: (2024)
por: Wang, Ruiyi, et al.
Publicado: (2024)
Q-Refine: A Perceptual Quality Refiner for AI-Generated Image
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
A-Bench: Are LMMs Masters at Evaluating AI-generated Images?
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
Using GUI Agent for Electronic Design Automation
por: Li, Chunyi, et al.
Publicado: (2025)
por: Li, Chunyi, et al.
Publicado: (2025)
Q-Bench-Video: Benchmarking the Video Quality Understanding of LMMs
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
EvalTalker: Learning to Evaluate Real-Portrait-Driven Multi-Subject Talking Humans
por: Zhou, Yingjie, et al.
Publicado: (2025)
por: Zhou, Yingjie, et al.
Publicado: (2025)
3DGCQA: A Quality Assessment Database for 3D AI-Generated Contents
por: Zhou, Yingjie, et al.
Publicado: (2024)
por: Zhou, Yingjie, et al.
Publicado: (2024)
AIGIQA-20K: A Large Database for AI-Generated Image Quality Assessment
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment
por: Kou, Tengchuan, et al.
Publicado: (2024)
por: Kou, Tengchuan, et al.
Publicado: (2024)
SIQA: Toward Reliable Scientific Image Quality Assessment
por: Li, Wenzhe, et al.
Publicado: (2026)
por: Li, Wenzhe, et al.
Publicado: (2026)
GeoX-Bench: Benchmarking Cross-View Geo-Localization and Pose Estimation Capabilities of Large Multimodal Models
por: Zheng, Yushuo, et al.
Publicado: (2025)
por: Zheng, Yushuo, et al.
Publicado: (2025)
G-Refine: A General Quality Refiner for Text-to-Image Generation
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
CMC-Bench: Towards a New Paradigm of Visual Signal Compression
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
por: Wu, Haoning, et al.
Publicado: (2023)
por: Wu, Haoning, et al.
Publicado: (2023)
Image Quality Assessment for Embodied AI
por: Li, Chunyi, et al.
Publicado: (2025)
por: Li, Chunyi, et al.
Publicado: (2025)
PuzzleBench: A Fully Dynamic Evaluation Framework for Large Multimodal Models on Puzzle Solving
por: Zhang, Zeyu, et al.
Publicado: (2025)
por: Zhang, Zeyu, et al.
Publicado: (2025)
Light-VQA+: A Video Quality Assessment Model for Exposure Correction with Vision-Language Guidance
por: Zhou, Xunchu, et al.
Publicado: (2024)
por: Zhou, Xunchu, et al.
Publicado: (2024)
Towards Open-ended Visual Quality Comparison
por: Wu, Haoning, et al.
Publicado: (2024)
por: Wu, Haoning, et al.
Publicado: (2024)
Embodied Image Compression
por: Li, Chunyi, et al.
Publicado: (2025)
por: Li, Chunyi, et al.
Publicado: (2025)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
por: Zhang, Yiming, et al.
Publicado: (2025)
por: Zhang, Yiming, et al.
Publicado: (2025)
LMM-PCQA: Assisting Point Cloud Quality Assessment with LMM
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
VQA$^2$: Visual Question Answering for Video Quality Assessment
por: Jia, Ziheng, et al.
Publicado: (2024)
por: Jia, Ziheng, et al.
Publicado: (2024)
Towards All-in-One Medical Image Re-Identification
por: Tian, Yuan, et al.
Publicado: (2025)
por: Tian, Yuan, et al.
Publicado: (2025)
Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
por: Zhou, Yingjie, et al.
Publicado: (2025)
por: Zhou, Yingjie, et al.
Publicado: (2025)
MISC: Ultra-low Bitrate Image Semantic Compression Driven by Large Multimodal Model
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
Q-Bench+: A Benchmark for Multi-modal Foundation Models on Low-level Vision from Single Images to Pairs
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
DehazeDCT: Towards Effective Non-Homogeneous Dehazing via Deformable Convolutional Transformer
por: Dong, Wei, et al.
Publicado: (2024)
por: Dong, Wei, et al.
Publicado: (2024)
GMS-3DQA: Projection-based Grid Mini-patch Sampling for 3D Model Quality Assessment
por: Zhang, Zicheng, et al.
Publicado: (2023)
por: Zhang, Zicheng, et al.
Publicado: (2023)
Large Multi-modality Model Assisted AI-Generated Image Quality Assessment
por: Wang, Puyi, et al.
Publicado: (2024)
por: Wang, Puyi, et al.
Publicado: (2024)
Audio-Visual Quality Assessment for User Generated Content: Database and Method
por: Cao, Yuqin, et al.
Publicado: (2023)
por: Cao, Yuqin, et al.
Publicado: (2023)
Quality Assessment in the Era of Large Models: A Survey
por: Zhang, Zicheng, et al.
Publicado: (2024)
por: Zhang, Zicheng, et al.
Publicado: (2024)
GeoR-Bench: Evaluating Geoscience Visual Reasoning
por: Zheng, Yushuo, et al.
Publicado: (2026)
por: Zheng, Yushuo, et al.
Publicado: (2026)
LARY: A Latent Action Representation Yielding Benchmark for Generalizable Vision-to-Action Alignment
por: Nie, Dujun, et al.
Publicado: (2026)
por: Nie, Dujun, et al.
Publicado: (2026)
Multi-Dimensional Quality Assessment for Text-to-3D Assets: Dataset and Model
por: Fu, Kang, et al.
Publicado: (2025)
por: Fu, Kang, et al.
Publicado: (2025)
AttentionLut: Attention Fusion-based Canonical Polyadic LUT for Real-time Image Enhancement
por: Fu, Kang, et al.
Publicado: (2024)
por: Fu, Kang, et al.
Publicado: (2024)
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
Ejemplares similares
-
Q-Eval-100K: Evaluating Visual Quality and Alignment Level for Text-to-Vision Content
por: Zhang, Zicheng, et al.
Publicado: (2025) -
AU-IQA: A Benchmark Dataset for Perceptual Quality Assessment of AI-Enhanced User-Generated Content
por: Wang, Shushi, et al.
Publicado: (2025) -
Q-Save: Towards Scoring and Attribution for Generated Video Evaluation
por: Wu, Xiele, et al.
Publicado: (2025) -
Learning Hazing to Dehazing: Towards Realistic Haze Generation for Real-World Image Dehazing
por: Wang, Ruiyi, et al.
Publicado: (2025) -
HazeCLIP: Towards Language Guided Real-World Image Dehazing
por: Wang, Ruiyi, et al.
Publicado: (2024)