MMCert: Provable Defense against Adversarial Attacks to Multi-modal Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yanting, Fu, Hongye, Zou, Wei, Jia, Jinyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Robust Image Classification: Defensive Strategies against FGSM and PGD Adversarial Attacks
par: Waghela, Hetvi, et autres
Publié: (2024)
par: Waghela, Hetvi, et autres
Publié: (2024)
Autoencoder-based Denoising Defense against Adversarial Attacks on Object Detection
par: Song, Min Geun, et autres
Publié: (2025)
par: Song, Min Geun, et autres
Publié: (2025)
DIFFender: Diffusion-Based Adversarial Defense against Patch Attacks
par: Kang, Caixin, et autres
Publié: (2023)
par: Kang, Caixin, et autres
Publié: (2023)
Real-world Adversarial Defense against Patch Attacks based on Diffusion Model
par: Wei, Xingxing, et autres
Publié: (2024)
par: Wei, Xingxing, et autres
Publié: (2024)
Bounding-box Watermarking: Defense against Model Extraction Attacks on Object Detectors
par: Koda, Satoru, et autres
Publié: (2024)
par: Koda, Satoru, et autres
Publié: (2024)
Universal Anti-forensics Attack against Image Forgery Detection via Multi-modal Guidance
par: Li, Haipeng, et autres
Publié: (2026)
par: Li, Haipeng, et autres
Publié: (2026)
Nearest is Not Dearest: Towards Practical Defense against Quantization-conditioned Backdoor Attacks
par: Li, Boheng, et autres
Publié: (2024)
par: Li, Boheng, et autres
Publié: (2024)
Adversarial Attacks and Defenses on Text-to-Image Diffusion Models: A Survey
par: Zhang, Chenyu, et autres
Publié: (2024)
par: Zhang, Chenyu, et autres
Publié: (2024)
Defensive Unlearning with Adversarial Training for Robust Concept Erasure in Diffusion Models
par: Zhang, Yimeng, et autres
Publié: (2024)
par: Zhang, Yimeng, et autres
Publié: (2024)
Continual Adversarial Defense
par: Wang, Qian, et autres
Publié: (2023)
par: Wang, Qian, et autres
Publié: (2023)
Anomaly Unveiled: Securing Image Classification against Adversarial Patch Attacks
par: Chattopadhyay, Nandish, et autres
Publié: (2024)
par: Chattopadhyay, Nandish, et autres
Publié: (2024)
Stealthy Multi-Task Adversarial Attacks
par: Guo, Jiacheng, et autres
Publié: (2024)
par: Guo, Jiacheng, et autres
Publié: (2024)
Struggle with Adversarial Defense? Try Diffusion
par: Li, Yujie, et autres
Publié: (2024)
par: Li, Yujie, et autres
Publié: (2024)
Mitigating Backdoor Attack by Injecting Proactive Defensive Backdoor
par: Wei, Shaokui, et autres
Publié: (2024)
par: Wei, Shaokui, et autres
Publié: (2024)
Data-free Defense of Black Box Models Against Adversarial Attacks
par: Nayak, Gaurav Kumar, et autres
Publié: (2022)
par: Nayak, Gaurav Kumar, et autres
Publié: (2022)
A Survey of Trojan Attacks and Defenses to Deep Neural Networks
par: Jin, Lingxin, et autres
Publié: (2024)
par: Jin, Lingxin, et autres
Publié: (2024)
MIBench: A Comprehensive Framework for Benchmarking Model Inversion Attack and Defense
par: Qiu, Yixiang, et autres
Publié: (2024)
par: Qiu, Yixiang, et autres
Publié: (2024)
Physical 3D Adversarial Attacks against Monocular Depth Estimation in Autonomous Driving
par: Zheng, Junhao, et autres
Publié: (2024)
par: Zheng, Junhao, et autres
Publié: (2024)
Defensive Adversarial CAPTCHA: A Semantics-Driven Framework for Natural Adversarial Example Generation
par: Du, Xia, et autres
Publié: (2025)
par: Du, Xia, et autres
Publié: (2025)
Adversarial Sparse Teacher: Defense Against Distillation-Based Model Stealing Attacks Using Adversarial Examples
par: Yilmaz, Eda, et autres
Publié: (2024)
par: Yilmaz, Eda, et autres
Publié: (2024)
Attacking Transformers with Feature Diversity Adversarial Perturbation
par: Gao, Chenxing, et autres
Publié: (2024)
par: Gao, Chenxing, et autres
Publié: (2024)
Exploring Adversarial Attacks against Latent Diffusion Model from the Perspective of Adversarial Transferability
par: Chen, Junxi, et autres
Publié: (2024)
par: Chen, Junxi, et autres
Publié: (2024)
Practical Region-level Attack against Segment Anything Models
par: Shen, Yifan, et autres
Publié: (2024)
par: Shen, Yifan, et autres
Publié: (2024)
Stego Battlefield: Evaluating Image Steganography Attacks and Steganalysis Defenses
par: Sun, Zhen, et autres
Publié: (2026)
par: Sun, Zhen, et autres
Publié: (2026)
Meta Invariance Defense Towards Generalizable Robustness to Unknown Adversarial Attacks
par: Zhang, Lei, et autres
Publié: (2024)
par: Zhang, Lei, et autres
Publié: (2024)
Environmental Injection Attacks against GUI Agents in Realistic Dynamic Environments
par: Zhang, Yitong, et autres
Publié: (2025)
par: Zhang, Yitong, et autres
Publié: (2025)
Vulnerabilities in AI-generated Image Detection: The Challenge of Adversarial Attacks
par: Diao, Yunfeng, et autres
Publié: (2024)
par: Diao, Yunfeng, et autres
Publié: (2024)
A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations
par: Ye, Mang, et autres
Publié: (2025)
par: Ye, Mang, et autres
Publié: (2025)
When Memory Becomes a Vulnerability: Towards Multi-turn Jailbreak Attacks against Text-to-Image Generation Systems
par: Zhao, Shiqian, et autres
Publié: (2025)
par: Zhao, Shiqian, et autres
Publié: (2025)
A Multi-task Adversarial Attack Against Face Authentication
par: Wang, Hanrui, et autres
Publié: (2024)
par: Wang, Hanrui, et autres
Publié: (2024)
Enhancing Adversarial Attacks: The Similar Target Method
par: Zhang, Shuo, et autres
Publié: (2023)
par: Zhang, Shuo, et autres
Publié: (2023)
Adversarially Guided Stateful Defense Against Backdoor Attacks in Federated Deep Learning
par: Ali, Hassan, et autres
Publié: (2024)
par: Ali, Hassan, et autres
Publié: (2024)
PatchCURE: Improving Certifiable Robustness, Model Utility, and Computation Efficiency of Adversarial Patch Defenses
par: Xiang, Chong, et autres
Publié: (2023)
par: Xiang, Chong, et autres
Publié: (2023)
Let the Noise Speak: Harnessing Noise for a Unified Defense Against Adversarial and Backdoor Attacks
par: Shahriar, Md Hasan, et autres
Publié: (2024)
par: Shahriar, Md Hasan, et autres
Publié: (2024)
The VLLM Safety Paradox: Dual Ease in Jailbreak Attack and Defense
par: Guo, Yangyang, et autres
Publié: (2024)
par: Guo, Yangyang, et autres
Publié: (2024)
Interpretability-Guided Test-Time Adversarial Defense
par: Kulkarni, Akshay, et autres
Publié: (2024)
par: Kulkarni, Akshay, et autres
Publié: (2024)
Image Corruption-Inspired Membership Inference Attacks against Large Vision-Language Models
par: Wu, Zongyu, et autres
Publié: (2025)
par: Wu, Zongyu, et autres
Publié: (2025)
ViT-EnsembleAttack: Augmenting Ensemble Models for Stronger Adversarial Transferability in Vision Transformers
par: Cao, Hanwen, et autres
Publié: (2025)
par: Cao, Hanwen, et autres
Publié: (2025)
Patronus: Safeguarding Text-to-Image Models against White-Box Adversaries
par: Li, Xinfeng, et autres
Publié: (2025)
par: Li, Xinfeng, et autres
Publié: (2025)
REFORGE: Multi-modal Attacks Reveal Vulnerable Concept Unlearning in Image Generation Models
par: Zou, Yong, et autres
Publié: (2026)
par: Zou, Yong, et autres
Publié: (2026)
Documents similaires
-
Robust Image Classification: Defensive Strategies against FGSM and PGD Adversarial Attacks
par: Waghela, Hetvi, et autres
Publié: (2024) -
Autoencoder-based Denoising Defense against Adversarial Attacks on Object Detection
par: Song, Min Geun, et autres
Publié: (2025) -
DIFFender: Diffusion-Based Adversarial Defense against Patch Attacks
par: Kang, Caixin, et autres
Publié: (2023) -
Real-world Adversarial Defense against Patch Attacks based on Diffusion Model
par: Wei, Xingxing, et autres
Publié: (2024) -
Bounding-box Watermarking: Defense against Model Extraction Attacks on Object Detectors
par: Koda, Satoru, et autres
Publié: (2024)