Semantic Mismatch and Perceptual Degradation: A New Perspective on Image Editing Immunity
Fuente:
arXiv
Guardado en:
| Autores principales: | Dong, Shuai, Zhang, Jie, Zhao, Guoying, Shan, Shiguang, Chen, Xilin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Transferable Defense Against Malicious Image Edits
por: Zhang, Jie, et al.
Publicado: (2025)
por: Zhang, Jie, et al.
Publicado: (2025)
Dual Attention Guided Defense Against Malicious Edits
por: Zhang, Jie, et al.
Publicado: (2025)
por: Zhang, Jie, et al.
Publicado: (2025)
Trigger without Trace: Towards Stealthy Backdoor Attack on Text-to-Image Diffusion Models
por: Zhang, Jie, et al.
Publicado: (2025)
por: Zhang, Jie, et al.
Publicado: (2025)
UniPose: A Unified Multimodal Framework for Human Pose Comprehension, Generation and Editing
por: Li, Yiheng, et al.
Publicado: (2024)
por: Li, Yiheng, et al.
Publicado: (2024)
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
por: Yan, Bei, et al.
Publicado: (2024)
por: Yan, Bei, et al.
Publicado: (2024)
Measuring the Measurers: Quality Evaluation of Hallucination Benchmarks for Large Vision-Language Models
por: Yan, Bei, et al.
Publicado: (2024)
por: Yan, Bei, et al.
Publicado: (2024)
INFACT: A Diagnostic Benchmark for Induced Faithfulness and Factuality Hallucinations in Video-LLMs
por: Yang, Junqi, et al.
Publicado: (2026)
por: Yang, Junqi, et al.
Publicado: (2026)
Happy Young Women, Grumpy Old Men? Emotion-Driven Demographic Biases in Synthetic Face Generation
por: Wei, Mengting, et al.
Publicado: (2026)
por: Wei, Mengting, et al.
Publicado: (2026)
VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model
por: Wang, Sibo, et al.
Publicado: (2024)
por: Wang, Sibo, et al.
Publicado: (2024)
DeltaSpace: A Semantic-aligned Feature Space for Flexible Text-guided Image Editing
por: Lyu, Yueming, et al.
Publicado: (2023)
por: Lyu, Yueming, et al.
Publicado: (2023)
Semantic or Covariate? A Study on the Intractable Case of Out-of-Distribution Detection
por: Long, Xingming, et al.
Publicado: (2024)
por: Long, Xingming, et al.
Publicado: (2024)
Jodi: Unification of Visual Generation and Understanding via Joint Modeling
por: Xu, Yifeng, et al.
Publicado: (2025)
por: Xu, Yifeng, et al.
Publicado: (2025)
Learning Separable Hidden Unit Contributions for Speaker-Adaptive Lip-Reading
por: Luo, Songtao, et al.
Publicado: (2023)
por: Luo, Songtao, et al.
Publicado: (2023)
Dynamic Attention Analysis for Backdoor Detection in Text-to-Image Diffusion Models
por: Wang, Zhongqi, et al.
Publicado: (2025)
por: Wang, Zhongqi, et al.
Publicado: (2025)
T2IShield: Defending Against Backdoors on Text-to-Image Diffusion Models
por: Wang, Zhongqi, et al.
Publicado: (2024)
por: Wang, Zhongqi, et al.
Publicado: (2024)
Towards Robust Semantic Segmentation against Patch-based Attack via Attention Refinement
por: Yuan, Zheng, et al.
Publicado: (2024)
por: Yuan, Zheng, et al.
Publicado: (2024)
Pose-Robust Calibration Strategy for Point-of-Gaze Estimation on Mobile Phones
por: Zhao, Yujie, et al.
Publicado: (2025)
por: Zhao, Yujie, et al.
Publicado: (2025)
Urban Socio-Semantic Segmentation with Vision-Language Reasoning
por: Wang, Yu, et al.
Publicado: (2026)
por: Wang, Yu, et al.
Publicado: (2026)
MULTITEXTEDIT: Benchmarking Cross-Lingual Degradation in Text-in-Image Editing
por: Cheng, Liwei, et al.
Publicado: (2026)
por: Cheng, Liwei, et al.
Publicado: (2026)
Multimodal Approaches to Fair Image Classification: An Ethical Perspective
por: Hickmon, Javon
Publicado: (2024)
por: Hickmon, Javon
Publicado: (2024)
VOPE: Revisiting Hallucination of Vision-Language Models in Voluntary Imagination Task
por: Long, Xingming, et al.
Publicado: (2025)
por: Long, Xingming, et al.
Publicado: (2025)
Assimilation Matters: Model-level Backdoor Detection in Vision-Language Pretrained Models
por: Wang, Zhongqi, et al.
Publicado: (2025)
por: Wang, Zhongqi, et al.
Publicado: (2025)
FullLoRA: Efficiently Boosting the Robustness of Pretrained Vision Transformers
por: Yuan, Zheng, et al.
Publicado: (2024)
por: Yuan, Zheng, et al.
Publicado: (2024)
Rethinking the Evaluation of Out-of-Distribution Detection: A Sorites Paradox
por: Long, Xingming, et al.
Publicado: (2024)
por: Long, Xingming, et al.
Publicado: (2024)
CtrLoRA: An Extensible and Efficient Framework for Controllable Image Generation
por: Xu, Yifeng, et al.
Publicado: (2024)
por: Xu, Yifeng, et al.
Publicado: (2024)
Position: Towards Implicit Prompt For Text-To-Image Models
por: Yang, Yue, et al.
Publicado: (2024)
por: Yang, Yue, et al.
Publicado: (2024)
Position: Universal Aesthetic Alignment Narrows Artistic Expression
por: Guo, Wenqi Marshall, et al.
Publicado: (2025)
por: Guo, Wenqi Marshall, et al.
Publicado: (2025)
Synthesizing Images on Perceptual Boundaries of ANNs for Uncovering Human Perceptual Variability on Facial Expressions
por: Deng, Haotian, et al.
Publicado: (2025)
por: Deng, Haotian, et al.
Publicado: (2025)
PRIME: Protect Your Videos From Malicious Editing
por: Li, Guanlin, et al.
Publicado: (2024)
por: Li, Guanlin, et al.
Publicado: (2024)
Unsupervised Deep Learning Image Verification Method
por: Solomon, Enoch, et al.
Publicado: (2023)
por: Solomon, Enoch, et al.
Publicado: (2023)
Survey of Bias In Text-to-Image Generation: Definition, Evaluation, and Mitigation
por: Wan, Yixin, et al.
Publicado: (2024)
por: Wan, Yixin, et al.
Publicado: (2024)
INFELM: In-depth Fairness Evaluation of Large Text-To-Image Models
por: Jin, Di, et al.
Publicado: (2024)
por: Jin, Di, et al.
Publicado: (2024)
Visual Chronicles: Using Multimodal LLMs to Analyze Massive Collections of Images
por: Deng, Boyang, et al.
Publicado: (2025)
por: Deng, Boyang, et al.
Publicado: (2025)
Where Culture Fades: Revealing the Cultural Gap in Text-to-Image Generation
por: Shi, Chuancheng, et al.
Publicado: (2025)
por: Shi, Chuancheng, et al.
Publicado: (2025)
Steering Vision-Language Pre-trained Models for Incremental Face Presentation Attack Detection
por: Li, Haoze, et al.
Publicado: (2025)
por: Li, Haoze, et al.
Publicado: (2025)
JoPano: Unified Panorama Generation via Joint Modeling
por: Feng, Wancheng, et al.
Publicado: (2025)
por: Feng, Wancheng, et al.
Publicado: (2025)
Aesthetics as Structural Harm: Algorithmic Lookism Across Text-to-Image Generation and Classification
por: Doh, Miriam, et al.
Publicado: (2026)
por: Doh, Miriam, et al.
Publicado: (2026)
DP$^2$O-SR: Direct Perceptual Preference Optimization for Real-World Image Super-Resolution
por: Wu, Rongyuan, et al.
Publicado: (2025)
por: Wu, Rongyuan, et al.
Publicado: (2025)
MetaphorStar: Image Metaphor Understanding and Reasoning with End-to-End Visual Reinforcement Learning
por: Zhang, Chenhao, et al.
Publicado: (2026)
por: Zhang, Chenhao, et al.
Publicado: (2026)
FairREAD: Re-fusing Demographic Attributes after Disentanglement for Fair Medical Image Classification
por: Gao, Yicheng, et al.
Publicado: (2024)
por: Gao, Yicheng, et al.
Publicado: (2024)
Ejemplares similares
-
Towards Transferable Defense Against Malicious Image Edits
por: Zhang, Jie, et al.
Publicado: (2025) -
Dual Attention Guided Defense Against Malicious Edits
por: Zhang, Jie, et al.
Publicado: (2025) -
Trigger without Trace: Towards Stealthy Backdoor Attack on Text-to-Image Diffusion Models
por: Zhang, Jie, et al.
Publicado: (2025) -
UniPose: A Unified Multimodal Framework for Human Pose Comprehension, Generation and Editing
por: Li, Yiheng, et al.
Publicado: (2024) -
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
por: Yan, Bei, et al.
Publicado: (2024)