Seeing It Before It Happens: In-Generation NSFW Detection for Diffusion-Based Text-to-Image Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Fan, Huang, Yihao, Zhu, Jiayi, Shi, Ling, Pu, Geguang, Dong, Jin Song, Wang, Kailong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Verify Claimed Text-to-Image Models via Boundary-Aware Prompt Optimization
di: Zhao, Zidong, et al.
Pubblicazione: (2026)
di: Zhao, Zidong, et al.
Pubblicazione: (2026)
Efficient and Effective Universal Adversarial Attack against Vision-Language Pre-training Models
di: Yang, Fan, et al.
Pubblicazione: (2024)
di: Yang, Fan, et al.
Pubblicazione: (2024)
Privacy Protection Against Personalized Text-to-Image Synthesis via Cross-image Consistency Constraints
di: Wang, Guanyu, et al.
Pubblicazione: (2025)
di: Wang, Guanyu, et al.
Pubblicazione: (2025)
CosalPure: Learning Concept from Group Images for Robust Co-Saliency Detection
di: Zhu, Jiayi, et al.
Pubblicazione: (2024)
di: Zhu, Jiayi, et al.
Pubblicazione: (2024)
Disciplined Diffusion: Text-to-Image Diffusion Model against NSFW Generation
di: Zhang, Chi, et al.
Pubblicazione: (2026)
di: Zhang, Chi, et al.
Pubblicazione: (2026)
Text Modality Oriented Image Feature Extraction for Detecting Diffusion-based DeepFake
di: Yang, Di, et al.
Pubblicazione: (2024)
di: Yang, Di, et al.
Pubblicazione: (2024)
Concept Guided Co-salient Object Detection
di: Zhu, Jiayi, et al.
Pubblicazione: (2024)
di: Zhu, Jiayi, et al.
Pubblicazione: (2024)
Perception-guided Jailbreak against Text-to-Image Models
di: Huang, Yihao, et al.
Pubblicazione: (2024)
di: Huang, Yihao, et al.
Pubblicazione: (2024)
Dodging DeepFake Detection via Implicit Spatial-Domain Notch Filtering
di: Huang, Yihao, et al.
Pubblicazione: (2020)
di: Huang, Yihao, et al.
Pubblicazione: (2020)
Comprehensive Assessment and Analysis for NSFW Content Erasure in Text-to-Image Diffusion Models
di: Chen, Die, et al.
Pubblicazione: (2025)
di: Chen, Die, et al.
Pubblicazione: (2025)
Comprehensive Evaluation and Analysis for NSFW Concept Erasure in Text-to-Image Diffusion Models
di: Chen, Die, et al.
Pubblicazione: (2025)
di: Chen, Die, et al.
Pubblicazione: (2025)
NSFW-Classifier Guided Prompt Sanitization for Safe Text-to-Image Generation
di: Xie, Yu, et al.
Pubblicazione: (2025)
di: Xie, Yu, et al.
Pubblicazione: (2025)
ALA: Naturalness-aware Adversarial Lightness Attack
di: Huang, Yihao, et al.
Pubblicazione: (2022)
di: Huang, Yihao, et al.
Pubblicazione: (2022)
Beyond Pixels: Semantic-aware Typographic Attack for Geo-Privacy Protection
di: Zhu, Jiayi, et al.
Pubblicazione: (2025)
di: Zhu, Jiayi, et al.
Pubblicazione: (2025)
Controllable Generation with Text-to-Image Diffusion Models: A Survey
di: Cao, Pu, et al.
Pubblicazione: (2024)
di: Cao, Pu, et al.
Pubblicazione: (2024)
Buster: Implanting Semantic Backdoor into Text Encoder to Mitigate NSFW Content Generation
di: Zhao, Xin, et al.
Pubblicazione: (2024)
di: Zhao, Xin, et al.
Pubblicazione: (2024)
Seeing Structural Failure Before it Happens: An Image-Based Physics-Informed Neural Network (PINN) for Spaghetti Bridge Load Prediction
di: Khan, Omer Jauhar, et al.
Pubblicazione: (2025)
di: Khan, Omer Jauhar, et al.
Pubblicazione: (2025)
Seeing Before Reasoning: A Unified Framework for Generalizable and Explainable Fake Image Detection
di: Lin, Kaiqing, et al.
Pubblicazione: (2025)
di: Lin, Kaiqing, et al.
Pubblicazione: (2025)
Dynamic Frequency Modulation for Controllable Text-driven Image Generation
di: Shi, Tiandong, et al.
Pubblicazione: (2026)
di: Shi, Tiandong, et al.
Pubblicazione: (2026)
VModA: An Effective Framework for Adaptive NSFW Image Moderation
di: Bao, Han, et al.
Pubblicazione: (2025)
di: Bao, Han, et al.
Pubblicazione: (2025)
Texture Re-scalable Universal Adversarial Perturbation
di: Huang, Yihao, et al.
Pubblicazione: (2024)
di: Huang, Yihao, et al.
Pubblicazione: (2024)
Scale-Invariant Adversarial Attack against Arbitrary-scale Super-resolution
di: Huang, Yihao, et al.
Pubblicazione: (2025)
di: Huang, Yihao, et al.
Pubblicazione: (2025)
Improving Robustness of LiDAR-Camera Fusion Model against Weather Corruption from Fusion Strategy Perspective
di: Huang, Yihao, et al.
Pubblicazione: (2024)
di: Huang, Yihao, et al.
Pubblicazione: (2024)
Efficient Universal Goal Hijacking with Semantics-guided Prompt Organization
di: Huang, Yihao, et al.
Pubblicazione: (2024)
di: Huang, Yihao, et al.
Pubblicazione: (2024)
What Happens Before Decoding? Prefill Determines GUI Grounding in VLMs
di: Lin, Jiaping, et al.
Pubblicazione: (2026)
di: Lin, Jiaping, et al.
Pubblicazione: (2026)
MoColl: Agent-Based Specific and General Model Collaboration for Image Captioning
di: Yang, Pu, et al.
Pubblicazione: (2025)
di: Yang, Pu, et al.
Pubblicazione: (2025)
Exploring Phrase-Level Grounding with Text-to-Image Diffusion Model
di: Yang, Danni, et al.
Pubblicazione: (2024)
di: Yang, Danni, et al.
Pubblicazione: (2024)
ChangeDiff: A Multi-Temporal Change Detection Data Generator with Flexible Text Prompts via Diffusion Model
di: Zang, Qi, et al.
Pubblicazione: (2024)
di: Zang, Qi, et al.
Pubblicazione: (2024)
PolarAnything: Diffusion-based Polarimetric Image Synthesis
di: Zhang, Kailong, et al.
Pubblicazione: (2025)
di: Zhang, Kailong, et al.
Pubblicazione: (2025)
Detecting Origin Attribution for Text-to-Image Diffusion Models
di: Xu, Katherine, et al.
Pubblicazione: (2024)
di: Xu, Katherine, et al.
Pubblicazione: (2024)
Image is All You Need to Empower Large-scale Diffusion Models for In-Domain Generation
di: Cao, Pu, et al.
Pubblicazione: (2023)
di: Cao, Pu, et al.
Pubblicazione: (2023)
Towards Safe Synthetic Image Generation On the Web: A Multimodal Robust NSFW Defense and Million Scale Dataset
di: Muneer, Muhammad Shahid, et al.
Pubblicazione: (2025)
di: Muneer, Muhammad Shahid, et al.
Pubblicazione: (2025)
EmoGen: Emotional Image Content Generation with Text-to-Image Diffusion Models
di: Yang, Jingyuan, et al.
Pubblicazione: (2024)
di: Yang, Jingyuan, et al.
Pubblicazione: (2024)
Progressive Compositionality in Text-to-Image Generative Models
di: Han, Evans Xu, et al.
Pubblicazione: (2024)
di: Han, Evans Xu, et al.
Pubblicazione: (2024)
Few-Step Distillation for Text-to-Image Generation: A Practical Guide
di: Pu, Yifan, et al.
Pubblicazione: (2025)
di: Pu, Yifan, et al.
Pubblicazione: (2025)
InsightTok: Improving Text and Face Fidelity in Discrete Tokenization for Autoregressive Image Generation
di: Yue, Yang, et al.
Pubblicazione: (2026)
di: Yue, Yang, et al.
Pubblicazione: (2026)
Image2Text2Image: A Novel Framework for Label-Free Evaluation of Image-to-Text Generation with Text-to-Image Diffusion Models
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
E4C: Enhance Editability for Text-Based Image Editing by Harnessing Efficient CLIP Guidance
di: Huang, Tianrui, et al.
Pubblicazione: (2024)
di: Huang, Tianrui, et al.
Pubblicazione: (2024)
Think-Then-Generate: Reasoning-Aware Text-to-Image Diffusion with LLM Encoders
di: Kou, Siqi, et al.
Pubblicazione: (2026)
di: Kou, Siqi, et al.
Pubblicazione: (2026)
Learning to See Before Seeing: Demystifying LLM Visual Priors from Language Pre-training
di: Han, Junlin, et al.
Pubblicazione: (2025)
di: Han, Junlin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Verify Claimed Text-to-Image Models via Boundary-Aware Prompt Optimization
di: Zhao, Zidong, et al.
Pubblicazione: (2026) -
Efficient and Effective Universal Adversarial Attack against Vision-Language Pre-training Models
di: Yang, Fan, et al.
Pubblicazione: (2024) -
Privacy Protection Against Personalized Text-to-Image Synthesis via Cross-image Consistency Constraints
di: Wang, Guanyu, et al.
Pubblicazione: (2025) -
CosalPure: Learning Concept from Group Images for Robust Co-Saliency Detection
di: Zhu, Jiayi, et al.
Pubblicazione: (2024) -
Disciplined Diffusion: Text-to-Image Diffusion Model against NSFW Generation
di: Zhang, Chi, et al.
Pubblicazione: (2026)