IE-Critic-R1: Advancing the Explanatory Measurement of Text-Driven Image Editing for Human Perception Alignment
Fuente:
arXiv
Salvato in:
| Autori principali: | Qu, Bowen, Sun, Shangkun, Liang, Xiaoyu, Gao, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
IE-Bench: Advancing the Measurement of Text-Driven Image Editing for Human Perception Alignment
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
Exploring AIGC Video Quality: A Focus on Visual Harmony, Video-Text Consistency and Domain Distribution Gap
di: Qu, Bowen, et al.
Pubblicazione: (2024)
di: Qu, Bowen, et al.
Pubblicazione: (2024)
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
di: Sun, Shangkun, et al.
Pubblicazione: (2024)
di: Sun, Shangkun, et al.
Pubblicazione: (2024)
Perception-R1: Pioneering Perception Policy with Reinforcement Learning
di: Yu, En, et al.
Pubblicazione: (2025)
di: Yu, En, et al.
Pubblicazione: (2025)
BIMCV-R: A Landmark Dataset for 3D CT Text-Image Retrieval
di: Chen, Yinda, et al.
Pubblicazione: (2024)
di: Chen, Yinda, et al.
Pubblicazione: (2024)
R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation
di: Chen, Kaijie, et al.
Pubblicazione: (2025)
di: Chen, Kaijie, et al.
Pubblicazione: (2025)
Fast Prompt Alignment for Text-to-Image Generation
di: Mrini, Khalil, et al.
Pubblicazione: (2024)
di: Mrini, Khalil, et al.
Pubblicazione: (2024)
Multimodal Representation Alignment for Image Generation: Text-Image Interleaved Control Is Easier Than You Think
di: Chen, Liang, et al.
Pubblicazione: (2025)
di: Chen, Liang, et al.
Pubblicazione: (2025)
Quality-Aware Image-Text Alignment for Opinion-Unaware Image Quality Assessment
di: Agnolucci, Lorenzo, et al.
Pubblicazione: (2024)
di: Agnolucci, Lorenzo, et al.
Pubblicazione: (2024)
Re-Thinking the Automatic Evaluation of Image-Text Alignment in Text-to-Image Models
di: Zhang, Huixuan, et al.
Pubblicazione: (2025)
di: Zhang, Huixuan, et al.
Pubblicazione: (2025)
Advanced Multimodal Deep Learning Architecture for Image-Text Matching
di: Wang, Jinyin, et al.
Pubblicazione: (2024)
di: Wang, Jinyin, et al.
Pubblicazione: (2024)
Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs
di: Gao, Xin, et al.
Pubblicazione: (2026)
di: Gao, Xin, et al.
Pubblicazione: (2026)
MULTITEXTEDIT: Benchmarking Cross-Lingual Degradation in Text-in-Image Editing
di: Cheng, Liwei, et al.
Pubblicazione: (2026)
di: Cheng, Liwei, et al.
Pubblicazione: (2026)
Integrating Chain-of-Thought for Multimodal Alignment: A Study on 3D Vision-Language Learning
di: Chen, Yanjun, et al.
Pubblicazione: (2025)
di: Chen, Yanjun, et al.
Pubblicazione: (2025)
Composition and Deformance: Measuring Imageability with a Text-to-Image Model
di: Wu, Si, et al.
Pubblicazione: (2023)
di: Wu, Si, et al.
Pubblicazione: (2023)
Medical Image Synthesis via Fine-Grained Image-Text Alignment and Anatomy-Pathology Prompting
di: Chen, Wenting, et al.
Pubblicazione: (2024)
di: Chen, Wenting, et al.
Pubblicazione: (2024)
Open-Source Image Editing Models Are Zero-Shot Vision Learners
di: Liu, Wei, et al.
Pubblicazione: (2026)
di: Liu, Wei, et al.
Pubblicazione: (2026)
Retrieval-Augmented Perception: High-Resolution Image Perception Meets Visual RAG
di: Wang, Wenbin, et al.
Pubblicazione: (2025)
di: Wang, Wenbin, et al.
Pubblicazione: (2025)
Human-Aligned MLLM Judges for Fine-Grained Image Editing Evaluation: A Benchmark, Framework, and Analysis
di: Liu, Runzhou, et al.
Pubblicazione: (2026)
di: Liu, Runzhou, et al.
Pubblicazione: (2026)
DreamArtist++: Controllable One-Shot Text-to-Image Generation via Positive-Negative Adapter
di: Dong, Ziyi, et al.
Pubblicazione: (2022)
di: Dong, Ziyi, et al.
Pubblicazione: (2022)
Optimizing Prompts for Text-to-Image Generation
di: Hao, Yaru, et al.
Pubblicazione: (2022)
di: Hao, Yaru, et al.
Pubblicazione: (2022)
Step-Video-TI2V Technical Report: A State-of-the-Art Text-Driven Image-to-Video Generation Model
di: Huang, Haoyang, et al.
Pubblicazione: (2025)
di: Huang, Haoyang, et al.
Pubblicazione: (2025)
MedCLIP-SAMv2: Towards Universal Text-Driven Medical Image Segmentation
di: Koleilat, Taha, et al.
Pubblicazione: (2024)
di: Koleilat, Taha, et al.
Pubblicazione: (2024)
How Control Information Influences Multilingual Text Image Generation and Editing?
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
Universal Prompt Optimizer for Safe Text-to-Image Generation
di: Wu, Zongyu, et al.
Pubblicazione: (2024)
di: Wu, Zongyu, et al.
Pubblicazione: (2024)
Hierarchical Visual Agent: Managing Contexts in Joint Image-Text Space for Advanced Chart Reasoning
di: Dong, Qihua, et al.
Pubblicazione: (2026)
di: Dong, Qihua, et al.
Pubblicazione: (2026)
TextInVision: Text and Prompt Complexity Driven Visual Text Generation Benchmark
di: Fallah, Forouzan, et al.
Pubblicazione: (2025)
di: Fallah, Forouzan, et al.
Pubblicazione: (2025)
Words Worth a Thousand Pictures: Measuring and Understanding Perceptual Variability in Text-to-Image Generation
di: Tang, Raphael, et al.
Pubblicazione: (2024)
di: Tang, Raphael, et al.
Pubblicazione: (2024)
Multi-Head Attention Driven Dynamic Visual-Semantic Embedding for Enhanced Image-Text Matching
di: Chen, Wenjing
Pubblicazione: (2024)
di: Chen, Wenjing
Pubblicazione: (2024)
Fine-Grained Image-Text Alignment in Medical Imaging Enables Explainable Cyclic Image-Report Generation
di: Chen, Wenting, et al.
Pubblicazione: (2023)
di: Chen, Wenting, et al.
Pubblicazione: (2023)
Pico-Banana-400K: A Large-Scale Dataset for Text-Guided Image Editing
di: Qian, Yusu, et al.
Pubblicazione: (2025)
di: Qian, Yusu, et al.
Pubblicazione: (2025)
ReFACT: Updating Text-to-Image Models by Editing the Text Encoder
di: Arad, Dana, et al.
Pubblicazione: (2023)
di: Arad, Dana, et al.
Pubblicazione: (2023)
Making Avatars Interact: Towards Text-Driven Human-Object Interaction for Controllable Talking Avatars
di: Zhang, Youliang, et al.
Pubblicazione: (2026)
di: Zhang, Youliang, et al.
Pubblicazione: (2026)
Image2Text2Image: A Novel Framework for Label-Free Evaluation of Image-to-Text Generation with Text-to-Image Diffusion Models
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
SST-EM: Advanced Metrics for Evaluating Semantic, Spatial and Temporal Aspects in Video Editing
di: Biyyala, Varun, et al.
Pubblicazione: (2025)
di: Biyyala, Varun, et al.
Pubblicazione: (2025)
EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing
di: Wu, Keming, et al.
Pubblicazione: (2025)
di: Wu, Keming, et al.
Pubblicazione: (2025)
Hands-off Image Editing: Language-guided Editing without any Task-specific Labeling, Masking or even Training
di: Santos, Rodrigo, et al.
Pubblicazione: (2025)
di: Santos, Rodrigo, et al.
Pubblicazione: (2025)
VisRet: Visualization Improves Knowledge-Intensive Text-to-Image Retrieval
di: Wu, Di, et al.
Pubblicazione: (2025)
di: Wu, Di, et al.
Pubblicazione: (2025)
ImageChain: Advancing Sequential Image-to-Text Reasoning in Multimodal Large Language Models
di: Villegas, Danae Sánchez, et al.
Pubblicazione: (2025)
di: Villegas, Danae Sánchez, et al.
Pubblicazione: (2025)
Documenti analoghi
-
IE-Bench: Advancing the Measurement of Text-Driven Image Editing for Human Perception Alignment
di: Sun, Shangkun, et al.
Pubblicazione: (2025) -
Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency
di: Sun, Shangkun, et al.
Pubblicazione: (2025) -
Exploring AIGC Video Quality: A Focus on Visual Harmony, Video-Text Consistency and Domain Distribution Gap
di: Qu, Bowen, et al.
Pubblicazione: (2024) -
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
di: Sun, Shangkun, et al.
Pubblicazione: (2024) -
Perception-R1: Pioneering Perception Policy with Reinforcement Learning
di: Yu, En, et al.
Pubblicazione: (2025)