Enregistré dans:
| Auteurs principaux: | Zhang, Chenyu, Hu, Mingwang, Li, Wenhui, Wang, Lanjun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2407.15861 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
T2I-RiskyPrompt: A Benchmark for Safety Evaluation, Attack, and Defense on Text-to-Image Model
par: Zhang, Chenyu, et autres
Publié: (2025)
par: Zhang, Chenyu, et autres
Publié: (2025)
Reason2Attack: Jailbreaking Text-to-Image Models via LLM Reasoning
par: Zhang, Chenyu, et autres
Publié: (2025)
par: Zhang, Chenyu, et autres
Publié: (2025)
Metaphor-based Jailbreak Attacks on Text-to-Image Models
par: Zhang, Chenyu, et autres
Publié: (2025)
par: Zhang, Chenyu, et autres
Publié: (2025)
Beyond Vulnerabilities: A Survey of Adversarial Attacks as Both Threats and Defenses in Computer Vision Systems
par: Guo, Zhongliang, et autres
Publié: (2025)
par: Guo, Zhongliang, et autres
Publié: (2025)
DIFFender: Diffusion-Based Adversarial Defense against Patch Attacks
par: Kang, Caixin, et autres
Publié: (2023)
par: Kang, Caixin, et autres
Publié: (2023)
Real-world Adversarial Defense against Patch Attacks based on Diffusion Model
par: Wei, Xingxing, et autres
Publié: (2024)
par: Wei, Xingxing, et autres
Publié: (2024)
Safety in Embodied AI: A Survey of Risks, Attacks, and Defenses
par: Li, Xiao, et autres
Publié: (2026)
par: Li, Xiao, et autres
Publié: (2026)
Towards Dataset Copyright Evasion Attack against Personalized Text-to-Image Diffusion Models
par: Gao, Kuofeng, et autres
Publié: (2025)
par: Gao, Kuofeng, et autres
Publié: (2025)
Autoencoder-based Denoising Defense against Adversarial Attacks on Object Detection
par: Song, Min Geun, et autres
Publié: (2025)
par: Song, Min Geun, et autres
Publié: (2025)
Silent Branding Attack: Trigger-free Data Poisoning Attack on Text-to-Image Diffusion Models
par: Jang, Sangwon, et autres
Publié: (2025)
par: Jang, Sangwon, et autres
Publié: (2025)
CtrlAttack: A Unified Attack on World-Model Control in Diffusion Models
par: Xu, Shuhan, et autres
Publié: (2026)
par: Xu, Shuhan, et autres
Publié: (2026)
PLA: Prompt Learning Attack against Text-to-Image Generative Models
par: Lyu, Xinqi, et autres
Publié: (2025)
par: Lyu, Xinqi, et autres
Publié: (2025)
PromptLA: Towards Integrity Verification of Black-box Text-to-Image Diffusion Models
par: Zhang, Zhuomeng, et autres
Publié: (2024)
par: Zhang, Zhuomeng, et autres
Publié: (2024)
DiffZOO: A Purely Query-Based Black-Box Attack for Red-teaming Text-to-Image Generative Model via Zeroth Order Optimization
par: Dang, Pucheng, et autres
Publié: (2024)
par: Dang, Pucheng, et autres
Publié: (2024)
AttackVLA: Benchmarking Adversarial and Backdoor Attacks on Vision-Language-Action Models
par: Li, Jiayu, et autres
Publié: (2025)
par: Li, Jiayu, et autres
Publié: (2025)
Undermining Image and Text Classification Algorithms Using Adversarial Attacks
par: Lunga, Langalibalele, et autres
Publié: (2024)
par: Lunga, Langalibalele, et autres
Publié: (2024)
CAAP: Capture-Aware Adversarial Patch Attacks on Palmprint Recognition Models
par: Liu, Renyang, et autres
Publié: (2026)
par: Liu, Renyang, et autres
Publié: (2026)
Superpixel Attack: Enhancing Black-box Adversarial Attack with Image-driven Division Areas
par: Oe, Issa, et autres
Publié: (2025)
par: Oe, Issa, et autres
Publié: (2025)
SteerDiff: Steering towards Safe Text-to-Image Diffusion Models
par: Zhang, Hongxiang, et autres
Publié: (2024)
par: Zhang, Hongxiang, et autres
Publié: (2024)
A Survey on Physical Adversarial Attacks against Face Recognition Systems
par: Wang, Mingsi, et autres
Publié: (2024)
par: Wang, Mingsi, et autres
Publié: (2024)
PuriDefense: Randomized Local Implicit Adversarial Purification for Defending Black-box Query-based Attacks
par: Guo, Ping, et autres
Publié: (2024)
par: Guo, Ping, et autres
Publié: (2024)
DREAM: Scalable Red Teaming for Text-to-Image Generative Systems via Distribution Modeling
par: Li, Boheng, et autres
Publié: (2025)
par: Li, Boheng, et autres
Publié: (2025)
Backdoor Defense in Diffusion Models via Spatial Attention Unlearning
par: Jha, Abha, et autres
Publié: (2025)
par: Jha, Abha, et autres
Publié: (2025)
Disentangling Adversarial Prompts: A Semantic-Graph Defense for Robust LLM Security
par: Fang, Xiang, et autres
Publié: (2026)
par: Fang, Xiang, et autres
Publié: (2026)
ROBIN: Robust and Invisible Watermarks for Diffusion Models with Adversarial Optimization
par: Huang, Huayang, et autres
Publié: (2024)
par: Huang, Huayang, et autres
Publié: (2024)
Backdoor Attacks against Image-to-Image Networks
par: Jiang, Wenbo, et autres
Publié: (2024)
par: Jiang, Wenbo, et autres
Publié: (2024)
VideoEraser: Concept Erasure in Text-to-Video Diffusion Models
par: Xu, Naen, et autres
Publié: (2025)
par: Xu, Naen, et autres
Publié: (2025)
Sparse Autoencoder as a Zero-Shot Classifier for Concept Erasing in Text-to-Image Diffusion Models
par: Tian, Zhihua, et autres
Publié: (2025)
par: Tian, Zhihua, et autres
Publié: (2025)
On the Adversarial Robustness of Large Vision-Language Models under Visual Token Compression
par: Zhang, Xinwei, et autres
Publié: (2026)
par: Zhang, Xinwei, et autres
Publié: (2026)
DeMark: A Query-Free Black-Box Attack on Deepfake Watermarking Defenses
par: Song, Wei, et autres
Publié: (2026)
par: Song, Wei, et autres
Publié: (2026)
PAD-FT: A Lightweight Defense for Backdoor Attacks via Data Purification and Fine-Tuning
par: Xu, Yukai, et autres
Publié: (2024)
par: Xu, Yukai, et autres
Publié: (2024)
Watertox: The Art of Simplicity in Universal Attacks A Cross-Model Framework for Robust Adversarial Generation
par: Gao, Zhenghao, et autres
Publié: (2024)
par: Gao, Zhenghao, et autres
Publié: (2024)
VA3: Virtually Assured Amplification Attack on Probabilistic Copyright Protection for Text-to-Image Generative Models
par: Li, Xiang, et autres
Publié: (2023)
par: Li, Xiang, et autres
Publié: (2023)
AR-GAN: Generative Adversarial Network-Based Defense Method Against Adversarial Attacks on the Traffic Sign Classification System of Autonomous Vehicles
par: Salek, M Sabbir, et autres
Publié: (2023)
par: Salek, M Sabbir, et autres
Publié: (2023)
Edge-Only Universal Adversarial Attacks in Distributed Learning
par: Rossolini, Giulio, et autres
Publié: (2024)
par: Rossolini, Giulio, et autres
Publié: (2024)
SKeDA: A Generative Watermarking Framework for Text-to-video Diffusion Models
par: Yang, Yang, et autres
Publié: (2026)
par: Yang, Yang, et autres
Publié: (2026)
Diffusion Soup: Model Merging for Text-to-Image Diffusion Models
par: Biggs, Benjamin, et autres
Publié: (2024)
par: Biggs, Benjamin, et autres
Publié: (2024)
MOS-Attack: A Scalable Multi-objective Adversarial Attack Framework
par: Guo, Ping, et autres
Publié: (2025)
par: Guo, Ping, et autres
Publié: (2025)
Proactive Adversarial Defense: Harnessing Prompt Tuning in Vision-Language Models to Detect Unseen Backdoored Images
par: Stein, Kyle, et autres
Publié: (2024)
par: Stein, Kyle, et autres
Publié: (2024)
Black-Box Forgery Attacks on Semantic Watermarks for Diffusion Models
par: Müller, Andreas, et autres
Publié: (2024)
par: Müller, Andreas, et autres
Publié: (2024)
Documents similaires
-
T2I-RiskyPrompt: A Benchmark for Safety Evaluation, Attack, and Defense on Text-to-Image Model
par: Zhang, Chenyu, et autres
Publié: (2025) -
Reason2Attack: Jailbreaking Text-to-Image Models via LLM Reasoning
par: Zhang, Chenyu, et autres
Publié: (2025) -
Metaphor-based Jailbreak Attacks on Text-to-Image Models
par: Zhang, Chenyu, et autres
Publié: (2025) -
Beyond Vulnerabilities: A Survey of Adversarial Attacks as Both Threats and Defenses in Computer Vision Systems
par: Guo, Zhongliang, et autres
Publié: (2025) -
DIFFender: Diffusion-Based Adversarial Defense against Patch Attacks
par: Kang, Caixin, et autres
Publié: (2023)