MIRAGE: Benchmarking and Aligning Multi-Instance Image Editing
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Ziqian, Alaniz, Stephan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MIRAGE: A Multi-modal Benchmark for Spatial Perception, Reasoning, and Intelligence
di: Liu, Chonghan, et al.
Pubblicazione: (2025)
di: Liu, Chonghan, et al.
Pubblicazione: (2025)
PRIMEdit: Probability Redistribution for Instance-aware Multi-object Video Editing with Benchmark Dataset
di: Teodoro, Samuel, et al.
Pubblicazione: (2024)
di: Teodoro, Samuel, et al.
Pubblicazione: (2024)
GRADE: Benchmarking Discipline-Informed Reasoning in Image Editing
di: Liu, Mingxin, et al.
Pubblicazione: (2026)
di: Liu, Mingxin, et al.
Pubblicazione: (2026)
MIRAGE: Retrieval and Generation of Multimodal Images and Texts for Medical Education
di: Benito, Miguel Diaz, et al.
Pubblicazione: (2026)
di: Benito, Miguel Diaz, et al.
Pubblicazione: (2026)
Training-Free Multi-Concept Image Editing
di: Foteinopoulou, Niki, et al.
Pubblicazione: (2026)
di: Foteinopoulou, Niki, et al.
Pubblicazione: (2026)
Large-scale EM Benchmark for Multi-Organelle Instance Segmentation in the Wild
di: Lu, Yanrui, et al.
Pubblicazione: (2026)
di: Lu, Yanrui, et al.
Pubblicazione: (2026)
GEditBench v2: A Human-Aligned Benchmark for General Image Editing
di: Jiang, Zhangqi, et al.
Pubblicazione: (2026)
di: Jiang, Zhangqi, et al.
Pubblicazione: (2026)
CAMEO: A Conditional and Quality-Aware Multi-Agent Image Editing Orchestrator
di: Pu, Yuhan, et al.
Pubblicazione: (2026)
di: Pu, Yuhan, et al.
Pubblicazione: (2026)
MIRAGE: Runtime Scheduling for Multi-Vector Image Retrieval with Hierarchical Decomposition
di: Li, Maoliang, et al.
Pubblicazione: (2025)
di: Li, Maoliang, et al.
Pubblicazione: (2025)
A Large Scale Analysis of Gender Biases in Text-to-Image Generative Models
di: Girrbach, Leander, et al.
Pubblicazione: (2025)
di: Girrbach, Leander, et al.
Pubblicazione: (2025)
MIRAGE: Towards AI-Generated Image Detection in the Wild
di: Xia, Cheng, et al.
Pubblicazione: (2025)
di: Xia, Cheng, et al.
Pubblicazione: (2025)
SeedEdit: Align Image Re-Generation to Image Editing
di: Shi, Yichun, et al.
Pubblicazione: (2024)
di: Shi, Yichun, et al.
Pubblicazione: (2024)
Shifting the Breaking Point of Flow Matching for Multi-Instance Editing
di: Zaccagnino, Carmine, et al.
Pubblicazione: (2026)
di: Zaccagnino, Carmine, et al.
Pubblicazione: (2026)
Human-Aligned MLLM Judges for Fine-Grained Image Editing Evaluation: A Benchmark, Framework, and Analysis
di: Liu, Runzhou, et al.
Pubblicazione: (2026)
di: Liu, Runzhou, et al.
Pubblicazione: (2026)
SUB: Benchmarking CBM Generalization via Synthetic Attribute Substitutions
di: Bader, Jessica, et al.
Pubblicazione: (2025)
di: Bader, Jessica, et al.
Pubblicazione: (2025)
TabletopGen: Instance-Level Interactive 3D Tabletop Scene Generation from Text or Single Image
di: Wang, Ziqian, et al.
Pubblicazione: (2025)
di: Wang, Ziqian, et al.
Pubblicazione: (2025)
VTEdit-Bench: A Comprehensive Benchmark for Multi-Reference Image Editing Models in Virtual Try-On
di: Liang, Xiaoye, et al.
Pubblicazione: (2026)
di: Liang, Xiaoye, et al.
Pubblicazione: (2026)
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
di: Sun, Shangkun, et al.
Pubblicazione: (2024)
di: Sun, Shangkun, et al.
Pubblicazione: (2024)
Re-Align: Structured Reasoning-guided Alignment for In-Context Image Generation and Editing
di: He, Runze, et al.
Pubblicazione: (2026)
di: He, Runze, et al.
Pubblicazione: (2026)
EditRefiner: A Human-Aligned Agentic Framework for Image Editing Refinement
di: Xu, Zitong, et al.
Pubblicazione: (2026)
di: Xu, Zitong, et al.
Pubblicazione: (2026)
LoFT: LoRA-fused Training Dataset Generation with Few-shot Guidance
di: Kim, Jae Myung, et al.
Pubblicazione: (2025)
di: Kim, Jae Myung, et al.
Pubblicazione: (2025)
Instance-Aligned Captions for Explainable Video Anomaly Detection
di: Song, Inpyo, et al.
Pubblicazione: (2026)
di: Song, Inpyo, et al.
Pubblicazione: (2026)
2D Instance Editing in 3D Space
di: Xie, Yuhuan, et al.
Pubblicazione: (2025)
di: Xie, Yuhuan, et al.
Pubblicazione: (2025)
Cluster-Level Sparse Multi-Instance Learning for Whole-Slide Images
di: Zhang, Yuedi, et al.
Pubblicazione: (2025)
di: Zhang, Yuedi, et al.
Pubblicazione: (2025)
ICE-Bench: A Unified and Comprehensive Benchmark for Image Creating and Editing
di: Pan, Yulin, et al.
Pubblicazione: (2025)
di: Pan, Yulin, et al.
Pubblicazione: (2025)
MIRAGE: Multimodal foundation model and benchmark for comprehensive retinal OCT image analysis
di: Morano, José, et al.
Pubblicazione: (2025)
di: Morano, José, et al.
Pubblicazione: (2025)
Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing
di: Li, Yan, et al.
Pubblicazione: (2026)
di: Li, Yan, et al.
Pubblicazione: (2026)
MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models
di: Zhu, Hongyang, et al.
Pubblicazione: (2025)
di: Zhu, Hongyang, et al.
Pubblicazione: (2025)
FLAIR: VLM with Fine-grained Language-informed Image Representations
di: Xiao, Rui, et al.
Pubblicazione: (2024)
di: Xiao, Rui, et al.
Pubblicazione: (2024)
Multi-turn Consistent Image Editing
di: Zhou, Zijun, et al.
Pubblicazione: (2025)
di: Zhou, Zijun, et al.
Pubblicazione: (2025)
SISP: A Benchmark Dataset for Fine-grained Ship Instance Segmentation in Panchromatic Satellite Images
di: Feng, Pengming, et al.
Pubblicazione: (2024)
di: Feng, Pengming, et al.
Pubblicazione: (2024)
Explaining CLIP Zero-shot Predictions Through Concepts
di: Ozdemir, Onat, et al.
Pubblicazione: (2026)
di: Ozdemir, Onat, et al.
Pubblicazione: (2026)
Training-free Uncertainty Guidance for Complex Visual Tasks with MLLMs
di: Kim, Sanghwan, et al.
Pubblicazione: (2025)
di: Kim, Sanghwan, et al.
Pubblicazione: (2025)
M$^{3}$T2IBench: A Large-Scale Multi-Category, Multi-Instance, Multi-Relation Text-to-Image Benchmark
di: Zhang, Huixuan, et al.
Pubblicazione: (2025)
di: Zhang, Huixuan, et al.
Pubblicazione: (2025)
SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing
di: Xiao, Yicheng, et al.
Pubblicazione: (2026)
di: Xiao, Yicheng, et al.
Pubblicazione: (2026)
WiseEdit: Benchmarking Cognition- and Creativity-Informed Image Editing
di: Pan, Kaihang, et al.
Pubblicazione: (2025)
di: Pan, Kaihang, et al.
Pubblicazione: (2025)
CompBench: Benchmarking Complex Instruction-guided Image Editing
di: Jia, Bohan, et al.
Pubblicazione: (2025)
di: Jia, Bohan, et al.
Pubblicazione: (2025)
ImgEdit: A Unified Image Editing Dataset and Benchmark
di: Ye, Yang, et al.
Pubblicazione: (2025)
di: Ye, Yang, et al.
Pubblicazione: (2025)
MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM
di: Dong, Bowen, et al.
Pubblicazione: (2025)
di: Dong, Bowen, et al.
Pubblicazione: (2025)
Compact and De-biased Negative Instance Embedding for Multi-Instance Learning on Whole-Slide Image Classification
di: Lee, Joohyung, et al.
Pubblicazione: (2024)
di: Lee, Joohyung, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MIRAGE: A Multi-modal Benchmark for Spatial Perception, Reasoning, and Intelligence
di: Liu, Chonghan, et al.
Pubblicazione: (2025) -
PRIMEdit: Probability Redistribution for Instance-aware Multi-object Video Editing with Benchmark Dataset
di: Teodoro, Samuel, et al.
Pubblicazione: (2024) -
GRADE: Benchmarking Discipline-Informed Reasoning in Image Editing
di: Liu, Mingxin, et al.
Pubblicazione: (2026) -
MIRAGE: Retrieval and Generation of Multimodal Images and Texts for Medical Education
di: Benito, Miguel Diaz, et al.
Pubblicazione: (2026) -
Training-Free Multi-Concept Image Editing
di: Foteinopoulou, Niki, et al.
Pubblicazione: (2026)