UNIT: Backdoor Mitigation via Automated Neural Distribution Tightening
Fuente:
arXiv
Salvato in:
| Autori principali: | Cheng, Siyuan, Shen, Guangyu, Zhang, Kaiyuan, Tao, Guanhong, An, Shengwei, Guo, Hanxi, Ma, Shiqing, Zhang, Xiangyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LOTUS: Evasive and Resilient Backdoor Attacks through Sub-Partitioning
di: Cheng, Siyuan, et al.
Pubblicazione: (2024)
di: Cheng, Siyuan, et al.
Pubblicazione: (2024)
Elijah: Eliminating Backdoors Injected in Diffusion Models via Distribution Shift
di: An, Shengwei, et al.
Pubblicazione: (2023)
di: An, Shengwei, et al.
Pubblicazione: (2023)
Rapid Optimization for Jailbreaking LLMs via Subconscious Exploitation and Echopraxia
di: Shen, Guangyu, et al.
Pubblicazione: (2024)
di: Shen, Guangyu, et al.
Pubblicazione: (2024)
From Poisoned to Aware: Fostering Backdoor Self-Awareness in LLMs
di: Shen, Guangyu, et al.
Pubblicazione: (2025)
di: Shen, Guangyu, et al.
Pubblicazione: (2025)
ASPIRER: Bypassing System Prompts With Permutation-based Backdoors in LLMs
di: Yan, Lu, et al.
Pubblicazione: (2024)
di: Yan, Lu, et al.
Pubblicazione: (2024)
Opening A Pandora's Box: Things You Should Know in the Era of Custom GPTs
di: Tao, Guanhong, et al.
Pubblicazione: (2023)
di: Tao, Guanhong, et al.
Pubblicazione: (2023)
CENSOR: Defense Against Gradient Inversion via Orthogonal Subspace Bayesian Sampling
di: Zhang, Kaiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Kaiyuan, et al.
Pubblicazione: (2025)
Temporal Logic-Based Multi-Vehicle Backdoor Attacks against Offline RL Agents in End-to-end Autonomous Driving
di: Chen, Xuan, et al.
Pubblicazione: (2025)
di: Chen, Xuan, et al.
Pubblicazione: (2025)
Gradient Shaping: Enhancing Backdoor Attack Against Reverse Engineering
di: Zhu, Rui, et al.
Pubblicazione: (2023)
di: Zhu, Rui, et al.
Pubblicazione: (2023)
SOFT: Selective Data Obfuscation for Protecting LLM Fine-tuning against Membership Inference Attacks
di: Zhang, Kaiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Kaiyuan, et al.
Pubblicazione: (2025)
Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation
di: Zhong, Zhiyuan, et al.
Pubblicazione: (2025)
di: Zhong, Zhiyuan, et al.
Pubblicazione: (2025)
Fusion is Not Enough: Single Modal Attacks on Fusion Models for 3D Object Detection
di: Cheng, Zhiyuan, et al.
Pubblicazione: (2023)
di: Cheng, Zhiyuan, et al.
Pubblicazione: (2023)
Unsupervised Backdoor Detection and Mitigation for Spiking Neural Networks
di: Li, Jiachen, et al.
Pubblicazione: (2025)
di: Li, Jiachen, et al.
Pubblicazione: (2025)
Tightening Robustness Verification of MaxPool-based Neural Networks via Minimizing the Over-Approximation Zone
di: Xiao, Yuan, et al.
Pubblicazione: (2022)
di: Xiao, Yuan, et al.
Pubblicazione: (2022)
Mitigating Backdoor Attack by Injecting Proactive Defensive Backdoor
di: Wei, Shaokui, et al.
Pubblicazione: (2024)
di: Wei, Shaokui, et al.
Pubblicazione: (2024)
Backdoor Mitigation in Object Detection via Adversarial Fine-Tuning
di: Dunnett, Kealan, et al.
Pubblicazione: (2026)
di: Dunnett, Kealan, et al.
Pubblicazione: (2026)
CatchBackdoor: Backdoor Detection via Critical Trojan Neural Path Fuzzing
di: Jin, Haibo, et al.
Pubblicazione: (2021)
di: Jin, Haibo, et al.
Pubblicazione: (2021)
MGC: A Compiler Framework Exploiting Compositional Blindness in Aligned LLMs for Malware Generation
di: Yan, Lu, et al.
Pubblicazione: (2025)
di: Yan, Lu, et al.
Pubblicazione: (2025)
ICLShield: Exploring and Mitigating In-Context Learning Backdoor Attacks
di: Ren, Zhiyao, et al.
Pubblicazione: (2025)
di: Ren, Zhiyao, et al.
Pubblicazione: (2025)
Robust Anti-Backdoor Instruction Tuning in LVLMs
di: Xun, Yuan, et al.
Pubblicazione: (2025)
di: Xun, Yuan, et al.
Pubblicazione: (2025)
XNN: Paradigm Shift in Mitigating Identity Leakage within Cloud-Enabled Deep Learning
di: Liu, Kaixin, et al.
Pubblicazione: (2024)
di: Liu, Kaixin, et al.
Pubblicazione: (2024)
Model X-ray:Detecting Backdoored Models via Decision Boundary
di: Su, Yanghao, et al.
Pubblicazione: (2024)
di: Su, Yanghao, et al.
Pubblicazione: (2024)
Mitigating Backdoor Attacks using Activation-Guided Model Editing
di: Hsieh, Felix, et al.
Pubblicazione: (2024)
di: Hsieh, Felix, et al.
Pubblicazione: (2024)
A Practical Trigger-Free Backdoor Attack on Neural Networks
di: Wang, Jiahao, et al.
Pubblicazione: (2024)
di: Wang, Jiahao, et al.
Pubblicazione: (2024)
Model Supply Chain Poisoning: Backdooring Pre-trained Models via Embedding Indistinguishability
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
AutoBackdoor: Automating Backdoor Attacks via LLM Agents
di: Li, Yige, et al.
Pubblicazione: (2025)
di: Li, Yige, et al.
Pubblicazione: (2025)
Privacy Amplification via Shuffling: Unified, Simplified, and Tightened
di: Wang, Shaowei, et al.
Pubblicazione: (2023)
di: Wang, Shaowei, et al.
Pubblicazione: (2023)
DMGNN: Detecting and Mitigating Backdoor Attacks in Graph Neural Networks
di: Sui, Hao, et al.
Pubblicazione: (2024)
di: Sui, Hao, et al.
Pubblicazione: (2024)
Unveiling and Mitigating Backdoor Vulnerabilities based on Unlearning Weight Changes and Backdoor Activeness
di: Lin, Weilin, et al.
Pubblicazione: (2024)
di: Lin, Weilin, et al.
Pubblicazione: (2024)
Uncovering, Explaining, and Mitigating the Superficial Safety of Backdoor Defense
di: Min, Rui, et al.
Pubblicazione: (2024)
di: Min, Rui, et al.
Pubblicazione: (2024)
Invisible Backdoor Attacks on Diffusion Models
di: Li, Sen, et al.
Pubblicazione: (2024)
di: Li, Sen, et al.
Pubblicazione: (2024)
Towards Physical World Backdoor Attacks against Skeleton Action Recognition
di: Zheng, Qichen, et al.
Pubblicazione: (2024)
di: Zheng, Qichen, et al.
Pubblicazione: (2024)
Backdoor Attack with Mode Mixture Latent Modification
di: Zhang, Hongwei, et al.
Pubblicazione: (2024)
di: Zhang, Hongwei, et al.
Pubblicazione: (2024)
ASTRA: Autonomous Spatial-Temporal Red-teaming for AI Software Assistants
di: Xu, Xiangzhe, et al.
Pubblicazione: (2025)
di: Xu, Xiangzhe, et al.
Pubblicazione: (2025)
Beating Backdoor Attack at Its Own Game
di: Liu, Min, et al.
Pubblicazione: (2023)
di: Liu, Min, et al.
Pubblicazione: (2023)
Backdoor Attacks against Hybrid Classical-Quantum Neural Networks
di: Guo, Ji, et al.
Pubblicazione: (2024)
di: Guo, Ji, et al.
Pubblicazione: (2024)
BadBone: Backdoor Attacks Against Backbone Models in Visual Prompt Learning
di: Yang, Ziqing, et al.
Pubblicazione: (2026)
di: Yang, Ziqing, et al.
Pubblicazione: (2026)
BURN: Backdoor Unlearning via Adversarial Boundary Analysis
di: Su, Yanghao, et al.
Pubblicazione: (2025)
di: Su, Yanghao, et al.
Pubblicazione: (2025)
Backdoor Mitigation by Distance-Driven Detoxification
di: Wei, Shaokui, et al.
Pubblicazione: (2024)
di: Wei, Shaokui, et al.
Pubblicazione: (2024)
Revocable Backdoor for Deep Model Trading
di: Xu, Yiran, et al.
Pubblicazione: (2024)
di: Xu, Yiran, et al.
Pubblicazione: (2024)
Documenti analoghi
-
LOTUS: Evasive and Resilient Backdoor Attacks through Sub-Partitioning
di: Cheng, Siyuan, et al.
Pubblicazione: (2024) -
Elijah: Eliminating Backdoors Injected in Diffusion Models via Distribution Shift
di: An, Shengwei, et al.
Pubblicazione: (2023) -
Rapid Optimization for Jailbreaking LLMs via Subconscious Exploitation and Echopraxia
di: Shen, Guangyu, et al.
Pubblicazione: (2024) -
From Poisoned to Aware: Fostering Backdoor Self-Awareness in LLMs
di: Shen, Guangyu, et al.
Pubblicazione: (2025) -
ASPIRER: Bypassing System Prompts With Permutation-based Backdoors in LLMs
di: Yan, Lu, et al.
Pubblicazione: (2024)