Towards Backdoor Stealthiness in Model Parameter Space
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Xiaoyun, Liu, Zhuoran, Koffas, Stefanos, Picek, Stjepan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BAN: Detecting Backdoors Activated by Adversarial Neuron Noise
par: Xu, Xiaoyun, et autres
Publié: (2024)
par: Xu, Xiaoyun, et autres
Publié: (2024)
SoK: The Last Line of Defense: On Backdoor Defense Evaluation
par: Abad, Gorka, et autres
Publié: (2025)
par: Abad, Gorka, et autres
Publié: (2025)
CatBack: Universal Backdoor Attacks on Tabular Data via Categorical Encoding
par: Tajalli, Behrad, et autres
Publié: (2025)
par: Tajalli, Behrad, et autres
Publié: (2025)
EmoBack: Backdoor Attacks Against Speaker Identification Using Emotional Prosody
par: Schoof, Coen, et autres
Publié: (2024)
par: Schoof, Coen, et autres
Publié: (2024)
Removing the Trigger, Not the Backdoor: Alternative Triggers and Latent Backdoors
par: Abad, Gorka, et autres
Publié: (2026)
par: Abad, Gorka, et autres
Publié: (2026)
Let's Focus: Focused Backdoor Attack against Federated Transfer Learning
par: Arazzi, Marco, et autres
Publié: (2024)
par: Arazzi, Marco, et autres
Publié: (2024)
Flashy Backdoor: Real-world Environment Backdoor Attack on SNNs with DVS Cameras
par: Riaño, Roberto, et autres
Publié: (2024)
par: Riaño, Roberto, et autres
Publié: (2024)
$$\mathbf{L^2\cdot M = C^2}$$ Large Language Models are Covert Channels
par: Gaure, Simen, et autres
Publié: (2024)
par: Gaure, Simen, et autres
Publié: (2024)
More is Better (Mostly): On the Backdoor Attacks in Federated Graph Neural Networks
par: Xu, Jing, et autres
Publié: (2022)
par: Xu, Jing, et autres
Publié: (2022)
The SkipSponge Attack: Sponge Weight Poisoning of Deep Neural Networks
par: Lintelo, Jona te, et autres
Publié: (2024)
par: Lintelo, Jona te, et autres
Publié: (2024)
Context is the Key: Backdoor Attacks for In-Context Learning with Vision Transformers
par: Abad, Gorka, et autres
Publié: (2024)
par: Abad, Gorka, et autres
Publié: (2024)
Backdoor Attacks on Decentralised Post-Training
par: Ersoy, Oğuzhan, et autres
Publié: (2026)
par: Ersoy, Oğuzhan, et autres
Publié: (2026)
Backdoor Attacks on Transformers for Tabular Data: An Empirical Study
par: Pleiter, Bart, et autres
Publié: (2023)
par: Pleiter, Bart, et autres
Publié: (2023)
A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models
par: Xu, Zihao, et autres
Publié: (2024)
par: Xu, Zihao, et autres
Publié: (2024)
Towards Effective, Stealthy, and Persistent Backdoor Attacks Targeting Graph Foundation Models
par: Luo, Jiayi, et autres
Publié: (2025)
par: Luo, Jiayi, et autres
Publié: (2025)
Stealthy Backdoor Attack to Real-world Models in Android Apps
par: Wei, Jiali, et autres
Publié: (2025)
par: Wei, Jiali, et autres
Publié: (2025)
Membership Privacy Evaluation in Deep Spiking Neural Networks
par: Li, Jiaxin, et autres
Publié: (2024)
par: Li, Jiaxin, et autres
Publié: (2024)
Sneaky Spikes: Uncovering Stealthy Backdoor Attacks in Spiking Neural Networks with Neuromorphic Data
par: Abad, Gorka, et autres
Publié: (2023)
par: Abad, Gorka, et autres
Publié: (2023)
Label Inference Attacks against Node-level Vertical Federated GNNs
par: Arazzi, Marco, et autres
Publié: (2023)
par: Arazzi, Marco, et autres
Publié: (2023)
SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-Action Models
par: Xu, Bingxin, et autres
Publié: (2026)
par: Xu, Bingxin, et autres
Publié: (2026)
A Spatiotemporal Stealthy Backdoor Attack against Cooperative Multi-Agent Deep Reinforcement Learning
par: Yu, Yinbo, et autres
Publié: (2024)
par: Yu, Yinbo, et autres
Publié: (2024)
Stealthy Dual-Trigger Backdoors: Attacking Prompt Tuning in LM-Empowered Graph Foundation Models
par: Xue, Xiaoyu, et autres
Publié: (2025)
par: Xue, Xiaoyu, et autres
Publié: (2025)
SNEAKDOOR: Stealthy Backdoor Attacks against Distribution Matching-based Dataset Condensation
par: Yang, He, et autres
Publié: (2026)
par: Yang, He, et autres
Publié: (2026)
FlowMur: A Stealthy and Practical Audio Backdoor Attack with Limited Knowledge
par: Lan, Jiahe, et autres
Publié: (2023)
par: Lan, Jiahe, et autres
Publié: (2023)
Continuous Embedding Attacks via Clipped Inputs in Jailbreaking Large Language Models
par: Xu, Zihao, et autres
Publié: (2024)
par: Xu, Zihao, et autres
Publié: (2024)
BadPatches: Routing-aware Backdoor Attacks on Vision Mixture of Experts
par: Chan, Cedric, et autres
Publié: (2025)
par: Chan, Cedric, et autres
Publié: (2025)
Stealthy and Persistent Unalignment on Large Language Models via Backdoor Injections
par: Cao, Yuanpu, et autres
Publié: (2023)
par: Cao, Yuanpu, et autres
Publié: (2023)
Stealthy Backdoor Attacks against LLMs Based on Natural Style Triggers
par: Wei, Jiali, et autres
Publié: (2026)
par: Wei, Jiali, et autres
Publié: (2026)
ForgetMark: Stealthy Fingerprint Embedding via Targeted Unlearning in Language Models
par: Xu, Zhenhua, et autres
Publié: (2026)
par: Xu, Zhenhua, et autres
Publié: (2026)
NeuroLip: An Event-driven Spatiotemporal Learning Framework for Cross-Scene Lip-Motion-based Visual Speaker Recognition
par: Yao, Junguang, et autres
Publié: (2026)
par: Yao, Junguang, et autres
Publié: (2026)
Backdoor Sentinel: Detecting and Detoxifying Backdoors in Diffusion Models via Temporal Noise Consistency
par: Wang, Bingzheng, et autres
Publié: (2026)
par: Wang, Bingzheng, et autres
Publié: (2026)
Backdoor Attribution: Elucidating and Controlling Backdoor in Language Models
par: Yu, Miao, et autres
Publié: (2025)
par: Yu, Miao, et autres
Publié: (2025)
BLAST: A Stealthy Backdoor Leverage Attack against Cooperative Multi-Agent Deep Reinforcement Learning based Systems
par: Fang, Jing, et autres
Publié: (2025)
par: Fang, Jing, et autres
Publié: (2025)
Trojan's Whisper: Stealthy Manipulation of OpenClaw through Injected Bootstrapped Guidance
par: Liu, Fazhong, et autres
Publié: (2026)
par: Liu, Fazhong, et autres
Publié: (2026)
AGATE: Stealthy Black-box Watermarking for Multimodal Model Copyright Protection
par: Gao, Jianbo, et autres
Publié: (2025)
par: Gao, Jianbo, et autres
Publié: (2025)
Lightweight and Fast Backdoor Model Detection
par: Yu, Yinbo, et autres
Publié: (2026)
par: Yu, Yinbo, et autres
Publié: (2026)
Concept-Guided Backdoor Attack on Vision Language Models
par: Shen, Haoyu, et autres
Publié: (2025)
par: Shen, Haoyu, et autres
Publié: (2025)
Hijacking Agent Memory: Stealthy Trojan Attacks Through Conversational Interaction
par: Wang, Hongtao, et autres
Publié: (2026)
par: Wang, Hongtao, et autres
Publié: (2026)
Backdoor Directions in Vision Transformers
par: Karayalcin, Sengim, et autres
Publié: (2026)
par: Karayalcin, Sengim, et autres
Publié: (2026)
StealthInk: A Multi-bit and Stealthy Watermark for Large Language Models
par: Jiang, Ya, et autres
Publié: (2025)
par: Jiang, Ya, et autres
Publié: (2025)
Documents similaires
-
BAN: Detecting Backdoors Activated by Adversarial Neuron Noise
par: Xu, Xiaoyun, et autres
Publié: (2024) -
SoK: The Last Line of Defense: On Backdoor Defense Evaluation
par: Abad, Gorka, et autres
Publié: (2025) -
CatBack: Universal Backdoor Attacks on Tabular Data via Categorical Encoding
par: Tajalli, Behrad, et autres
Publié: (2025) -
EmoBack: Backdoor Attacks Against Speaker Identification Using Emotional Prosody
par: Schoof, Coen, et autres
Publié: (2024) -
Removing the Trigger, Not the Backdoor: Alternative Triggers and Latent Backdoors
par: Abad, Gorka, et autres
Publié: (2026)