Salvato in:
| Autori principali: | Chan, Wing, Allen, Richard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.00105 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LiDAR-EDIT: LiDAR Data Generation by Editing the Object Layouts in Real-World Scenes
di: Ho, Shing-Hei, et al.
Pubblicazione: (2024)
di: Ho, Shing-Hei, et al.
Pubblicazione: (2024)
EDIT: Enhancing Vision Transformers by Mitigating Attention Sink through an Encoder-Decoder Architecture
di: Feng, Wenfeng, et al.
Pubblicazione: (2025)
di: Feng, Wenfeng, et al.
Pubblicazione: (2025)
Omni IIE Bench: Benchmarking the Practical Capabilities of Image Editing Models
di: Yang, Yujia, et al.
Pubblicazione: (2026)
di: Yang, Yujia, et al.
Pubblicazione: (2026)
MedEBench: Diagnosing Reliability in Text-Guided Medical Image Editing
di: Liu, Minghao, et al.
Pubblicazione: (2025)
di: Liu, Minghao, et al.
Pubblicazione: (2025)
On the Fairness, Diversity and Reliability of Text-to-Image Generative Models
di: Vice, Jordan, et al.
Pubblicazione: (2024)
di: Vice, Jordan, et al.
Pubblicazione: (2024)
InEdit-Bench: Benchmarking Intermediate Logical Pathways for Intelligent Image Editing Models
di: Sheng, Zhiqiang, et al.
Pubblicazione: (2026)
di: Sheng, Zhiqiang, et al.
Pubblicazione: (2026)
When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models
di: Hou, Jiacheng, et al.
Pubblicazione: (2026)
di: Hou, Jiacheng, et al.
Pubblicazione: (2026)
I2EBench: A Comprehensive Benchmark for Instruction-based Image Editing
di: Ma, Yiwei, et al.
Pubblicazione: (2024)
di: Ma, Yiwei, et al.
Pubblicazione: (2024)
MULTITEXTEDIT: Benchmarking Cross-Lingual Degradation in Text-in-Image Editing
di: Cheng, Liwei, et al.
Pubblicazione: (2026)
di: Cheng, Liwei, et al.
Pubblicazione: (2026)
MotionEdit: Benchmarking and Learning Motion-Centric Image Editing
di: Wan, Yixin, et al.
Pubblicazione: (2025)
di: Wan, Yixin, et al.
Pubblicazione: (2025)
Toward the Frontiers of Reliable Diffusion Sampling via Adversarial Sinkhorn Attention Guidance
di: Kim, Kwanyoung
Pubblicazione: (2025)
di: Kim, Kwanyoung
Pubblicazione: (2025)
WorldEdit: Towards Open-World Image Editing with a Knowledge-Informed Benchmark
di: Lin, Wang, et al.
Pubblicazione: (2026)
di: Lin, Wang, et al.
Pubblicazione: (2026)
Probing Visual Planning in Image Editing Models
di: Zhou, Zhimu, et al.
Pubblicazione: (2026)
di: Zhou, Zhimu, et al.
Pubblicazione: (2026)
SINE: SINgle Image Editing with Text-to-Image Diffusion Models
di: Zhang, Zhixing, et al.
Pubblicazione: (2022)
di: Zhang, Zhixing, et al.
Pubblicazione: (2022)
Concept Lancet: Image Editing with Compositional Representation Transplant
di: Luo, Jinqi, et al.
Pubblicazione: (2025)
di: Luo, Jinqi, et al.
Pubblicazione: (2025)
IE-Bench: Advancing the Measurement of Text-Driven Image Editing for Human Perception Alignment
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
HYPE: Hyperbolic Entailment Filtering for Underspecified Images and Texts
di: Kim, Wonjae, et al.
Pubblicazione: (2024)
di: Kim, Wonjae, et al.
Pubblicazione: (2024)
$\texttt{Complex-Edit}$: CoT-Like Instruction Generation for Complexity-Controllable Image Editing Benchmark
di: Yang, Siwei, et al.
Pubblicazione: (2025)
di: Yang, Siwei, et al.
Pubblicazione: (2025)
DLEBench: Evaluating Small-scale Object Editing Ability for Instruction-based Image Editing Model
di: Hong, Shibo, et al.
Pubblicazione: (2026)
di: Hong, Shibo, et al.
Pubblicazione: (2026)
Lazy Diffusion Transformer for Interactive Image Editing
di: Nitzan, Yotam, et al.
Pubblicazione: (2024)
di: Nitzan, Yotam, et al.
Pubblicazione: (2024)
An Interpretable Local Editing Model for Counterfactual Medical Image Generation
di: Min, Hyungi, et al.
Pubblicazione: (2026)
di: Min, Hyungi, et al.
Pubblicazione: (2026)
Unsupervised Region-Based Image Editing of Denoising Diffusion Models
di: Li, Zixiang, et al.
Pubblicazione: (2024)
di: Li, Zixiang, et al.
Pubblicazione: (2024)
SVGenius: Benchmarking LLMs in SVG Understanding, Editing and Generation
di: Chen, Siqi, et al.
Pubblicazione: (2025)
di: Chen, Siqi, et al.
Pubblicazione: (2025)
PPTArena: A Benchmark for Agentic PowerPoint Editing
di: Ofengenden, Michael, et al.
Pubblicazione: (2025)
di: Ofengenden, Michael, et al.
Pubblicazione: (2025)
EgoEdit: Dataset, Real-Time Streaming Model, and Benchmark for Egocentric Video Editing
di: Li, Runjia, et al.
Pubblicazione: (2025)
di: Li, Runjia, et al.
Pubblicazione: (2025)
UniEditBench: A Unified and Cost-Effective Benchmark for Image and Video Editing via Distilled MLLMs
di: Jiang, Lifan, et al.
Pubblicazione: (2026)
di: Jiang, Lifan, et al.
Pubblicazione: (2026)
EvalMuse-40K: A Reliable and Fine-Grained Benchmark with Comprehensive Human Annotations for Text-to-Image Generation Model Evaluation
di: Han, Shuhao, et al.
Pubblicazione: (2024)
di: Han, Shuhao, et al.
Pubblicazione: (2024)
Self-Attention Diffusion Models for Zero-Shot Biomedical Image Segmentation: Unlocking New Frontiers in Medical Imaging
di: Hamrani, Abderrachid, et al.
Pubblicazione: (2025)
di: Hamrani, Abderrachid, et al.
Pubblicazione: (2025)
IE-Critic-R1: Advancing the Explanatory Measurement of Text-Driven Image Editing for Human Perception Alignment
di: Qu, Bowen, et al.
Pubblicazione: (2025)
di: Qu, Bowen, et al.
Pubblicazione: (2025)
Do Vision-Language Models Measure Up? Benchmarking Visual Measurement Reading with MeasureBench
di: Lin, Fenfen, et al.
Pubblicazione: (2025)
di: Lin, Fenfen, et al.
Pubblicazione: (2025)
Inline Critic Steers Image Editing
di: Kang, Weitai, et al.
Pubblicazione: (2026)
di: Kang, Weitai, et al.
Pubblicazione: (2026)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
di: Wang, Yufei, et al.
Pubblicazione: (2025)
di: Wang, Yufei, et al.
Pubblicazione: (2025)
DPDEdit: Detail-Preserved Diffusion Models for Multimodal Fashion Image Editing
di: Wang, Xiaolong, et al.
Pubblicazione: (2024)
di: Wang, Xiaolong, et al.
Pubblicazione: (2024)
Measuring the Measurers: Quality Evaluation of Hallucination Benchmarks for Large Vision-Language Models
di: Yan, Bei, et al.
Pubblicazione: (2024)
di: Yan, Bei, et al.
Pubblicazione: (2024)
VLKEB: A Large Vision-Language Model Knowledge Editing Benchmark
di: Huang, Han, et al.
Pubblicazione: (2024)
di: Huang, Han, et al.
Pubblicazione: (2024)
Revisiting Reliability in the Reasoning-based Pose Estimation Benchmark
di: Kim, Junsu, et al.
Pubblicazione: (2025)
di: Kim, Junsu, et al.
Pubblicazione: (2025)
ChartM$^3$: Benchmarking Chart Editing with Multimodal Instructions
di: Yang, Donglu, et al.
Pubblicazione: (2025)
di: Yang, Donglu, et al.
Pubblicazione: (2025)
Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
di: Dunlop, Connor, et al.
Pubblicazione: (2025)
di: Dunlop, Connor, et al.
Pubblicazione: (2025)
T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts
di: Huang, Ziwei, et al.
Pubblicazione: (2024)
di: Huang, Ziwei, et al.
Pubblicazione: (2024)
DeepGen 1.0: A Lightweight Unified Multimodal Model for Advancing Image Generation and Editing
di: Wang, Dianyi, et al.
Pubblicazione: (2026)
di: Wang, Dianyi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
LiDAR-EDIT: LiDAR Data Generation by Editing the Object Layouts in Real-World Scenes
di: Ho, Shing-Hei, et al.
Pubblicazione: (2024) -
EDIT: Enhancing Vision Transformers by Mitigating Attention Sink through an Encoder-Decoder Architecture
di: Feng, Wenfeng, et al.
Pubblicazione: (2025) -
Omni IIE Bench: Benchmarking the Practical Capabilities of Image Editing Models
di: Yang, Yujia, et al.
Pubblicazione: (2026) -
MedEBench: Diagnosing Reliability in Text-Guided Medical Image Editing
di: Liu, Minghao, et al.
Pubblicazione: (2025) -
On the Fairness, Diversity and Reliability of Text-to-Image Generative Models
di: Vice, Jordan, et al.
Pubblicazione: (2024)