IE-Bench: Advancing the Measurement of Text-Driven Image Editing for Human Perception Alignment
Fuente:
arXiv
Salvato in:
| Autori principali: | Sun, Shangkun, Qu, Bowen, Liang, Xiaoyu, Fan, Songlin, Gao, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
IE-Critic-R1: Advancing the Explanatory Measurement of Text-Driven Image Editing for Human Perception Alignment
di: Qu, Bowen, et al.
Pubblicazione: (2025)
di: Qu, Bowen, et al.
Pubblicazione: (2025)
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
di: Sun, Shangkun, et al.
Pubblicazione: (2024)
di: Sun, Shangkun, et al.
Pubblicazione: (2024)
Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
Exploring AIGC Video Quality: A Focus on Visual Harmony, Video-Text Consistency and Domain Distribution Gap
di: Qu, Bowen, et al.
Pubblicazione: (2024)
di: Qu, Bowen, et al.
Pubblicazione: (2024)
Consistent Video Editing as Flow-Driven Image-to-Video Generation
di: Wang, Ge, et al.
Pubblicazione: (2025)
di: Wang, Ge, et al.
Pubblicazione: (2025)
Instant Preference Alignment for Text-to-Image Diffusion Models
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
From Passive Perception to Active Memory: A Weakly Supervised Image Manipulation Localization Framework Driven by Coarse-Grained Annotations
di: Guo, Zhiqing, et al.
Pubblicazione: (2025)
di: Guo, Zhiqing, et al.
Pubblicazione: (2025)
TextEditBench: Evaluating Reasoning-aware Text Editing Beyond Rendering
di: Gui, Rui, et al.
Pubblicazione: (2025)
di: Gui, Rui, et al.
Pubblicazione: (2025)
OpenGPT-4o-Image: A Comprehensive Dataset for Advanced Image Generation and Editing
di: Chen, Zhihong, et al.
Pubblicazione: (2025)
di: Chen, Zhihong, et al.
Pubblicazione: (2025)
Text-Driven Image Editing via Learnable Regions
di: Lin, Yuanze, et al.
Pubblicazione: (2023)
di: Lin, Yuanze, et al.
Pubblicazione: (2023)
Omni IIE Bench: Benchmarking the Practical Capabilities of Image Editing Models
di: Yang, Yujia, et al.
Pubblicazione: (2026)
di: Yang, Yujia, et al.
Pubblicazione: (2026)
MedEBench: Diagnosing Reliability in Text-Guided Medical Image Editing
di: Liu, Minghao, et al.
Pubblicazione: (2025)
di: Liu, Minghao, et al.
Pubblicazione: (2025)
VDE Bench: Evaluating The Capability of Image Editing Models to Modify Visual Documents
di: Yi, Hongzhu, et al.
Pubblicazione: (2026)
di: Yi, Hongzhu, et al.
Pubblicazione: (2026)
Textual and Visual Prompt Fusion for Image Editing via Step-Wise Alignment
di: Feng, Zhanbo, et al.
Pubblicazione: (2023)
di: Feng, Zhanbo, et al.
Pubblicazione: (2023)
Personalized Safety Alignment for Text-to-Image Diffusion Models
di: Lei, Yu, et al.
Pubblicazione: (2025)
di: Lei, Yu, et al.
Pubblicazione: (2025)
SINE: SINgle Image Editing with Text-to-Image Diffusion Models
di: Zhang, Zhixing, et al.
Pubblicazione: (2022)
di: Zhang, Zhixing, et al.
Pubblicazione: (2022)
MCIE: Multimodal LLM-Driven Complex Instruction Image Editing with Spatial Guidance
di: Bai, Xuehai, et al.
Pubblicazione: (2026)
di: Bai, Xuehai, et al.
Pubblicazione: (2026)
DragText: Rethinking Text Embedding in Point-based Image Editing
di: Choi, Gayoon, et al.
Pubblicazione: (2024)
di: Choi, Gayoon, et al.
Pubblicazione: (2024)
VEU-Bench: Towards Comprehensive Understanding of Video Editing
di: Li, Bozheng, et al.
Pubblicazione: (2025)
di: Li, Bozheng, et al.
Pubblicazione: (2025)
MoCHA: Advanced Vision-Language Reasoning with MoE Connector and Hierarchical Group Attention
di: Pang, Yuqi, et al.
Pubblicazione: (2025)
di: Pang, Yuqi, et al.
Pubblicazione: (2025)
AirCopBench: A Benchmark for Multi-drone Collaborative Embodied Perception and Reasoning
di: Zha, Jirong, et al.
Pubblicazione: (2025)
di: Zha, Jirong, et al.
Pubblicazione: (2025)
Informative Text-Image Alignment for Visual Affordance Learning with Foundation Models
di: Zhang, Qian, et al.
Pubblicazione: (2025)
di: Zhang, Qian, et al.
Pubblicazione: (2025)
FCoT-VL:Advancing Text-oriented Large Vision-Language Models with Efficient Visual Token Compression
di: Li, Jianjian, et al.
Pubblicazione: (2025)
di: Li, Jianjian, et al.
Pubblicazione: (2025)
How Control Information Influences Multilingual Text Image Generation and Editing?
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
RAISE: Requirement-Adaptive Evolutionary Refinement for Training-Free Text-to-Image Alignment
di: Jiang, Liyao, et al.
Pubblicazione: (2026)
di: Jiang, Liyao, et al.
Pubblicazione: (2026)
GEditBench v2: A Human-Aligned Benchmark for General Image Editing
di: Jiang, Zhangqi, et al.
Pubblicazione: (2026)
di: Jiang, Zhangqi, et al.
Pubblicazione: (2026)
LatentEditor: Text Driven Local Editing of 3D Scenes
di: Khalid, Umar, et al.
Pubblicazione: (2023)
di: Khalid, Umar, et al.
Pubblicazione: (2023)
TextHawk: Exploring Efficient Fine-Grained Perception of Multimodal Large Language Models
di: Yu, Ya-Qi, et al.
Pubblicazione: (2024)
di: Yu, Ya-Qi, et al.
Pubblicazione: (2024)
InEdit-Bench: Benchmarking Intermediate Logical Pathways for Intelligent Image Editing Models
di: Sheng, Zhiqiang, et al.
Pubblicazione: (2026)
di: Sheng, Zhiqiang, et al.
Pubblicazione: (2026)
DSH-Bench: A Difficulty- and Scenario-Aware Benchmark with Hierarchical Subject Taxonomy for Subject-Driven Text-to-Image Generation
di: Hu, Zhenyu, et al.
Pubblicazione: (2026)
di: Hu, Zhenyu, et al.
Pubblicazione: (2026)
Text Guided Image Editing with Automatic Concept Locating and Forgetting
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
HP-Edit: A Human-Preference Post-Training Framework for Image Editing
di: Li, Fan, et al.
Pubblicazione: (2026)
di: Li, Fan, et al.
Pubblicazione: (2026)
GIE-Bench: Towards Grounded Evaluation for Text-Guided Image Editing
di: Qian, Yusu, et al.
Pubblicazione: (2025)
di: Qian, Yusu, et al.
Pubblicazione: (2025)
World-To-Image: Grounding Text-to-Image Generation with Agent-Driven World Knowledge
di: Son, Moo Hyun, et al.
Pubblicazione: (2025)
di: Son, Moo Hyun, et al.
Pubblicazione: (2025)
UniG2U-Bench: Do Unified Models Advance Multimodal Understanding?
di: Wen, Zimo, et al.
Pubblicazione: (2026)
di: Wen, Zimo, et al.
Pubblicazione: (2026)
A Survey on Text-Driven 360-Degree Panorama Generation
di: Wang, Hai, et al.
Pubblicazione: (2025)
di: Wang, Hai, et al.
Pubblicazione: (2025)
CLIPDrag: Combining Text-based and Drag-based Instructions for Image Editing
di: Jiang, Ziqi, et al.
Pubblicazione: (2024)
di: Jiang, Ziqi, et al.
Pubblicazione: (2024)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
di: Wang, Yufei, et al.
Pubblicazione: (2025)
di: Wang, Yufei, et al.
Pubblicazione: (2025)
AdapEdit: Spatio-Temporal Guided Adaptive Editing Algorithm for Text-Based Continuity-Sensitive Image Editing
di: Ma, Zhiyuan, et al.
Pubblicazione: (2023)
di: Ma, Zhiyuan, et al.
Pubblicazione: (2023)
Align and Surpass Human Camouflaged Perception: Visual Refocus Reinforcement Fine-Tuning
di: Shen, Ruolin, et al.
Pubblicazione: (2025)
di: Shen, Ruolin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
IE-Critic-R1: Advancing the Explanatory Measurement of Text-Driven Image Editing for Human Perception Alignment
di: Qu, Bowen, et al.
Pubblicazione: (2025) -
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
di: Sun, Shangkun, et al.
Pubblicazione: (2024) -
Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency
di: Sun, Shangkun, et al.
Pubblicazione: (2025) -
Exploring AIGC Video Quality: A Focus on Visual Harmony, Video-Text Consistency and Domain Distribution Gap
di: Qu, Bowen, et al.
Pubblicazione: (2024) -
Consistent Video Editing as Flow-Driven Image-to-Video Generation
di: Wang, Ge, et al.
Pubblicazione: (2025)