IE-Bench: Advancing the Measurement of Text-Driven Image Editing for Human Perception Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Shangkun, Qu, Bowen, Liang, Xiaoyu, Fan, Songlin, Gao, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IE-Critic-R1: Advancing the Explanatory Measurement of Text-Driven Image Editing for Human Perception Alignment
par: Qu, Bowen, et autres
Publié: (2025)
par: Qu, Bowen, et autres
Publié: (2025)
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
par: Sun, Shangkun, et autres
Publié: (2024)
par: Sun, Shangkun, et autres
Publié: (2024)
Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency
par: Sun, Shangkun, et autres
Publié: (2025)
par: Sun, Shangkun, et autres
Publié: (2025)
Exploring AIGC Video Quality: A Focus on Visual Harmony, Video-Text Consistency and Domain Distribution Gap
par: Qu, Bowen, et autres
Publié: (2024)
par: Qu, Bowen, et autres
Publié: (2024)
Consistent Video Editing as Flow-Driven Image-to-Video Generation
par: Wang, Ge, et autres
Publié: (2025)
par: Wang, Ge, et autres
Publié: (2025)
Instant Preference Alignment for Text-to-Image Diffusion Models
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
From Passive Perception to Active Memory: A Weakly Supervised Image Manipulation Localization Framework Driven by Coarse-Grained Annotations
par: Guo, Zhiqing, et autres
Publié: (2025)
par: Guo, Zhiqing, et autres
Publié: (2025)
TextEditBench: Evaluating Reasoning-aware Text Editing Beyond Rendering
par: Gui, Rui, et autres
Publié: (2025)
par: Gui, Rui, et autres
Publié: (2025)
OpenGPT-4o-Image: A Comprehensive Dataset for Advanced Image Generation and Editing
par: Chen, Zhihong, et autres
Publié: (2025)
par: Chen, Zhihong, et autres
Publié: (2025)
Text-Driven Image Editing via Learnable Regions
par: Lin, Yuanze, et autres
Publié: (2023)
par: Lin, Yuanze, et autres
Publié: (2023)
Omni IIE Bench: Benchmarking the Practical Capabilities of Image Editing Models
par: Yang, Yujia, et autres
Publié: (2026)
par: Yang, Yujia, et autres
Publié: (2026)
MedEBench: Diagnosing Reliability in Text-Guided Medical Image Editing
par: Liu, Minghao, et autres
Publié: (2025)
par: Liu, Minghao, et autres
Publié: (2025)
VDE Bench: Evaluating The Capability of Image Editing Models to Modify Visual Documents
par: Yi, Hongzhu, et autres
Publié: (2026)
par: Yi, Hongzhu, et autres
Publié: (2026)
Textual and Visual Prompt Fusion for Image Editing via Step-Wise Alignment
par: Feng, Zhanbo, et autres
Publié: (2023)
par: Feng, Zhanbo, et autres
Publié: (2023)
Personalized Safety Alignment for Text-to-Image Diffusion Models
par: Lei, Yu, et autres
Publié: (2025)
par: Lei, Yu, et autres
Publié: (2025)
SINE: SINgle Image Editing with Text-to-Image Diffusion Models
par: Zhang, Zhixing, et autres
Publié: (2022)
par: Zhang, Zhixing, et autres
Publié: (2022)
MCIE: Multimodal LLM-Driven Complex Instruction Image Editing with Spatial Guidance
par: Bai, Xuehai, et autres
Publié: (2026)
par: Bai, Xuehai, et autres
Publié: (2026)
DragText: Rethinking Text Embedding in Point-based Image Editing
par: Choi, Gayoon, et autres
Publié: (2024)
par: Choi, Gayoon, et autres
Publié: (2024)
VEU-Bench: Towards Comprehensive Understanding of Video Editing
par: Li, Bozheng, et autres
Publié: (2025)
par: Li, Bozheng, et autres
Publié: (2025)
MoCHA: Advanced Vision-Language Reasoning with MoE Connector and Hierarchical Group Attention
par: Pang, Yuqi, et autres
Publié: (2025)
par: Pang, Yuqi, et autres
Publié: (2025)
AirCopBench: A Benchmark for Multi-drone Collaborative Embodied Perception and Reasoning
par: Zha, Jirong, et autres
Publié: (2025)
par: Zha, Jirong, et autres
Publié: (2025)
Informative Text-Image Alignment for Visual Affordance Learning with Foundation Models
par: Zhang, Qian, et autres
Publié: (2025)
par: Zhang, Qian, et autres
Publié: (2025)
FCoT-VL:Advancing Text-oriented Large Vision-Language Models with Efficient Visual Token Compression
par: Li, Jianjian, et autres
Publié: (2025)
par: Li, Jianjian, et autres
Publié: (2025)
How Control Information Influences Multilingual Text Image Generation and Editing?
par: Zhang, Boqiang, et autres
Publié: (2024)
par: Zhang, Boqiang, et autres
Publié: (2024)
RAISE: Requirement-Adaptive Evolutionary Refinement for Training-Free Text-to-Image Alignment
par: Jiang, Liyao, et autres
Publié: (2026)
par: Jiang, Liyao, et autres
Publié: (2026)
GEditBench v2: A Human-Aligned Benchmark for General Image Editing
par: Jiang, Zhangqi, et autres
Publié: (2026)
par: Jiang, Zhangqi, et autres
Publié: (2026)
LatentEditor: Text Driven Local Editing of 3D Scenes
par: Khalid, Umar, et autres
Publié: (2023)
par: Khalid, Umar, et autres
Publié: (2023)
TextHawk: Exploring Efficient Fine-Grained Perception of Multimodal Large Language Models
par: Yu, Ya-Qi, et autres
Publié: (2024)
par: Yu, Ya-Qi, et autres
Publié: (2024)
InEdit-Bench: Benchmarking Intermediate Logical Pathways for Intelligent Image Editing Models
par: Sheng, Zhiqiang, et autres
Publié: (2026)
par: Sheng, Zhiqiang, et autres
Publié: (2026)
DSH-Bench: A Difficulty- and Scenario-Aware Benchmark with Hierarchical Subject Taxonomy for Subject-Driven Text-to-Image Generation
par: Hu, Zhenyu, et autres
Publié: (2026)
par: Hu, Zhenyu, et autres
Publié: (2026)
Text Guided Image Editing with Automatic Concept Locating and Forgetting
par: Li, Jia, et autres
Publié: (2024)
par: Li, Jia, et autres
Publié: (2024)
HP-Edit: A Human-Preference Post-Training Framework for Image Editing
par: Li, Fan, et autres
Publié: (2026)
par: Li, Fan, et autres
Publié: (2026)
GIE-Bench: Towards Grounded Evaluation for Text-Guided Image Editing
par: Qian, Yusu, et autres
Publié: (2025)
par: Qian, Yusu, et autres
Publié: (2025)
World-To-Image: Grounding Text-to-Image Generation with Agent-Driven World Knowledge
par: Son, Moo Hyun, et autres
Publié: (2025)
par: Son, Moo Hyun, et autres
Publié: (2025)
UniG2U-Bench: Do Unified Models Advance Multimodal Understanding?
par: Wen, Zimo, et autres
Publié: (2026)
par: Wen, Zimo, et autres
Publié: (2026)
A Survey on Text-Driven 360-Degree Panorama Generation
par: Wang, Hai, et autres
Publié: (2025)
par: Wang, Hai, et autres
Publié: (2025)
CLIPDrag: Combining Text-based and Drag-based Instructions for Image Editing
par: Jiang, Ziqi, et autres
Publié: (2024)
par: Jiang, Ziqi, et autres
Publié: (2024)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
par: Wang, Yufei, et autres
Publié: (2025)
par: Wang, Yufei, et autres
Publié: (2025)
AdapEdit: Spatio-Temporal Guided Adaptive Editing Algorithm for Text-Based Continuity-Sensitive Image Editing
par: Ma, Zhiyuan, et autres
Publié: (2023)
par: Ma, Zhiyuan, et autres
Publié: (2023)
Align and Surpass Human Camouflaged Perception: Visual Refocus Reinforcement Fine-Tuning
par: Shen, Ruolin, et autres
Publié: (2025)
par: Shen, Ruolin, et autres
Publié: (2025)
Documents similaires
-
IE-Critic-R1: Advancing the Explanatory Measurement of Text-Driven Image Editing for Human Perception Alignment
par: Qu, Bowen, et autres
Publié: (2025) -
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
par: Sun, Shangkun, et autres
Publié: (2024) -
Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency
par: Sun, Shangkun, et autres
Publié: (2025) -
Exploring AIGC Video Quality: A Focus on Visual Harmony, Video-Text Consistency and Domain Distribution Gap
par: Qu, Bowen, et autres
Publié: (2024) -
Consistent Video Editing as Flow-Driven Image-to-Video Generation
par: Wang, Ge, et autres
Publié: (2025)