DyCoRM: Dynamic Criterion-Aware Reward Modeling for Text-to-Image Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Qian, Jiaying, Jia, Ziheng, Zhang, Qian, Zhang, Zicheng, Guo, Jiayi, Zhang, Junqi, Zhai, Guangtao, Min, Xiongkuo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Explainable Partial-AIGC Image Quality Assessment
di: Qian, Jiaying, et al.
Pubblicazione: (2025)
di: Qian, Jiaying, et al.
Pubblicazione: (2025)
Refine-IQA: Multi-Stage Reinforcement Finetuning for Perceptual Image Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2025)
di: Jia, Ziheng, et al.
Pubblicazione: (2025)
VITAL: Vision-Encoder-centered Pre-training for LMMs in Visual Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2025)
di: Jia, Ziheng, et al.
Pubblicazione: (2025)
TIT-Score: Evaluating Long-Prompt Based Text-to-Image Alignment via Text-to-Image-to-Text Consistency
di: Wang, Juntong, et al.
Pubblicazione: (2025)
di: Wang, Juntong, et al.
Pubblicazione: (2025)
VQA$^2$: Visual Question Answering for Video Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2024)
di: Jia, Ziheng, et al.
Pubblicazione: (2024)
GOBench: Benchmarking Geometric Optics Generation and Understanding of MLLMs
di: Zhu, Xiaorong, et al.
Pubblicazione: (2025)
di: Zhu, Xiaorong, et al.
Pubblicazione: (2025)
Teaching LMMs for Image Quality Scoring and Interpreting
di: Zhang, Zicheng, et al.
Pubblicazione: (2025)
di: Zhang, Zicheng, et al.
Pubblicazione: (2025)
Large Multi-modality Model Assisted AI-Generated Image Quality Assessment
di: Wang, Puyi, et al.
Pubblicazione: (2024)
di: Wang, Puyi, et al.
Pubblicazione: (2024)
Multi-Dimensional Quality Assessment for Text-to-3D Assets: Dataset and Model
di: Fu, Kang, et al.
Pubblicazione: (2025)
di: Fu, Kang, et al.
Pubblicazione: (2025)
LOVE: Benchmarking and Evaluating Text-to-Video Generation and Video-to-Text Interpretation
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
Mitigating Low-Level Visual Hallucinations Requires Self-Awareness: Database, Model and Training Strategy
di: Sun, Yinan, et al.
Pubblicazione: (2025)
di: Sun, Yinan, et al.
Pubblicazione: (2025)
Enhancing Image Quality Assessment Ability of LMMs via Retrieval-Augmented Generation
di: Fu, Kang, et al.
Pubblicazione: (2026)
di: Fu, Kang, et al.
Pubblicazione: (2026)
PuzzleBench: A Fully Dynamic Evaluation Framework for Large Multimodal Models on Puzzle Solving
di: Zhang, Zeyu, et al.
Pubblicazione: (2025)
di: Zhang, Zeyu, et al.
Pubblicazione: (2025)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
Quality Assessment for AI Generated Images with Instruction Tuning
di: Wang, Jiarui, et al.
Pubblicazione: (2024)
di: Wang, Jiarui, et al.
Pubblicazione: (2024)
Exploring Image Quality Assessment from a New Perspective: Pupil Size
di: Gao, Yixuan, et al.
Pubblicazione: (2025)
di: Gao, Yixuan, et al.
Pubblicazione: (2025)
HazeCLIP: Towards Language Guided Real-World Image Dehazing
di: Wang, Ruiyi, et al.
Pubblicazione: (2024)
di: Wang, Ruiyi, et al.
Pubblicazione: (2024)
DFBench: Benchmarking Deepfake Image Detection Capability of Large Multimodal Models
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
Q-Bench-Portrait: Benchmarking Multimodal Large Language Models on Portrait Image Quality Perception
di: Wu, Sijing, et al.
Pubblicazione: (2026)
di: Wu, Sijing, et al.
Pubblicazione: (2026)
DynT2I-Eval: A Dynamic Evaluation Framework for Text-to-Image Models
di: Wang, Juntong, et al.
Pubblicazione: (2026)
di: Wang, Juntong, et al.
Pubblicazione: (2026)
Enhancing Blind Video Quality Assessment with Rich Quality-aware Features
di: Sun, Wei, et al.
Pubblicazione: (2024)
di: Sun, Wei, et al.
Pubblicazione: (2024)
Exploring the Naturalness of AI-Generated Images
di: Chen, Zijian, et al.
Pubblicazione: (2023)
di: Chen, Zijian, et al.
Pubblicazione: (2023)
AGHI-QA: A Subjective-Aligned Dataset and Metric for AI-Generated Human Images
di: Li, Yunhao, et al.
Pubblicazione: (2025)
di: Li, Yunhao, et al.
Pubblicazione: (2025)
How is Visual Attention Influenced by Text Guidance? Database and Model
di: Sun, Yinan, et al.
Pubblicazione: (2024)
di: Sun, Yinan, et al.
Pubblicazione: (2024)
Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment
di: Kou, Tengchuan, et al.
Pubblicazione: (2024)
di: Kou, Tengchuan, et al.
Pubblicazione: (2024)
UniProcessor: A Text-induced Unified Low-level Image Processor
di: Duan, Huiyu, et al.
Pubblicazione: (2024)
di: Duan, Huiyu, et al.
Pubblicazione: (2024)
EEmo-Logic: A Unified Dataset and Multi-Stage Framework for Comprehensive Image-Evoked Emotion Assessment
di: Gao, Lancheng, et al.
Pubblicazione: (2026)
di: Gao, Lancheng, et al.
Pubblicazione: (2026)
AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM
di: Wang, Jiarui, et al.
Pubblicazione: (2024)
di: Wang, Jiarui, et al.
Pubblicazione: (2024)
Mesh Mamba: A Unified State Space Model for Saliency Prediction in Non-Textured and Textured Meshes
di: Zhang, Kaiwei, et al.
Pubblicazione: (2025)
di: Zhang, Kaiwei, et al.
Pubblicazione: (2025)
Assessing UHD Image Quality from Aesthetics, Distortions, and Saliency
di: Sun, Wei, et al.
Pubblicazione: (2024)
di: Sun, Wei, et al.
Pubblicazione: (2024)
Textured Mesh Saliency: Bridging Geometry and Texture for Human Perception in 3D Graphics
di: Zhang, Kaiwei, et al.
Pubblicazione: (2024)
di: Zhang, Kaiwei, et al.
Pubblicazione: (2024)
3DGCQA: A Quality Assessment Database for 3D AI-Generated Contents
di: Zhou, Yingjie, et al.
Pubblicazione: (2024)
di: Zhou, Yingjie, et al.
Pubblicazione: (2024)
GeoR-Bench: Evaluating Geoscience Visual Reasoning
di: Zheng, Yushuo, et al.
Pubblicazione: (2026)
di: Zheng, Yushuo, et al.
Pubblicazione: (2026)
Image Quality Assessment: From Human to Machine Preference
di: Li, Chunyi, et al.
Pubblicazione: (2025)
di: Li, Chunyi, et al.
Pubblicazione: (2025)
Q-Refine: A Perceptual Quality Refiner for AI-Generated Image
di: Li, Chunyi, et al.
Pubblicazione: (2024)
di: Li, Chunyi, et al.
Pubblicazione: (2024)
GAIA: Rethinking Action Quality Assessment for AI-Generated Videos
di: Chen, Zijian, et al.
Pubblicazione: (2024)
di: Chen, Zijian, et al.
Pubblicazione: (2024)
VideoAesBench: Benchmarking the Video Aesthetics Perception Capabilities of Large Multimodal Models
di: Li, Yunhao, et al.
Pubblicazione: (2026)
di: Li, Yunhao, et al.
Pubblicazione: (2026)
Audio-Visual Quality Assessment for User Generated Content: Database and Method
di: Cao, Yuqin, et al.
Pubblicazione: (2023)
di: Cao, Yuqin, et al.
Pubblicazione: (2023)
TDVE-Assessor: Benchmarking and Evaluating the Quality of Text-Driven Video Editing with LMMs
di: Wang, Juntong, et al.
Pubblicazione: (2025)
di: Wang, Juntong, et al.
Pubblicazione: (2025)
Explore the Hallucination on Low-level Perception for MLLMs
di: Sun, Yinan, et al.
Pubblicazione: (2024)
di: Sun, Yinan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Towards Explainable Partial-AIGC Image Quality Assessment
di: Qian, Jiaying, et al.
Pubblicazione: (2025) -
Refine-IQA: Multi-Stage Reinforcement Finetuning for Perceptual Image Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2025) -
VITAL: Vision-Encoder-centered Pre-training for LMMs in Visual Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2025) -
TIT-Score: Evaluating Long-Prompt Based Text-to-Image Alignment via Text-to-Image-to-Text Consistency
di: Wang, Juntong, et al.
Pubblicazione: (2025) -
VQA$^2$: Visual Question Answering for Video Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2024)