Backdoor Contrastive Learning via Bi-level Trigger Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Weiyu, Zhang, Xinyu, Lu, Hao, Chen, Yingcong, Wang, Ting, Chen, Jinghui, Lin, Lu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Watch the Watcher! Backdoor Attacks on Security-Enhancing Diffusion Models
par: Li, Changjiang, et autres
Publié: (2024)
par: Li, Changjiang, et autres
Publié: (2024)
STEP: Detecting Audio Backdoor Attacks via Stability-based Trigger Exposure Profiling
par: Wang, Kun, et autres
Publié: (2026)
par: Wang, Kun, et autres
Publié: (2026)
A Set of Generalized Components to Achieve Effective Poison-only Clean-label Backdoor Attacks with Collaborative Sample Selection and Triggers
par: Wu, Zhixiao, et autres
Publié: (2025)
par: Wu, Zhixiao, et autres
Publié: (2025)
Isolate Trigger: Detecting and Eliminating Adaptive Backdoor Attacks
par: Sun, Chengrui, et autres
Publié: (2025)
par: Sun, Chengrui, et autres
Publié: (2025)
Turn-Based Structural Triggers: Prompt-Free Backdoors in Multi-Turn LLMs
par: Lu, Yiyang, et autres
Publié: (2026)
par: Lu, Yiyang, et autres
Publié: (2026)
Differentially Private Contrastive Learning via Bounding Group-level Contribution
par: Li, Kecen, et autres
Publié: (2026)
par: Li, Kecen, et autres
Publié: (2026)
A Practical Trigger-Free Backdoor Attack on Neural Networks
par: Wang, Jiahao, et autres
Publié: (2024)
par: Wang, Jiahao, et autres
Publié: (2024)
Your Agent Can Defend Itself against Backdoor Attacks
par: Changjiang, Li, et autres
Publié: (2025)
par: Changjiang, Li, et autres
Publié: (2025)
Stealthy and Persistent Unalignment on Large Language Models via Backdoor Injections
par: Cao, Yuanpu, et autres
Publié: (2023)
par: Cao, Yuanpu, et autres
Publié: (2023)
BadMoE: Backdooring Mixture-of-Experts LLMs via Optimizing Routing Triggers and Infecting Dormant Experts
par: Wang, Qingyue, et autres
Publié: (2025)
par: Wang, Qingyue, et autres
Publié: (2025)
Meme Trojan: Backdoor Attacks Against Hateful Meme Detection via Cross-Modal Triggers
par: Wang, Ruofei, et autres
Publié: (2024)
par: Wang, Ruofei, et autres
Publié: (2024)
Who Speaks for the Trigger? Dynamic Expert Routing in Backdoored Mixture-of-Experts Transformers
par: Zhao, Xin, et autres
Publié: (2025)
par: Zhao, Xin, et autres
Publié: (2025)
InverTune: Removing Backdoors from Multimodal Contrastive Learning Models via Trigger Inversion and Activation Tuning
par: Sun, Mengyuan, et autres
Publié: (2025)
par: Sun, Mengyuan, et autres
Publié: (2025)
TASO: Jailbreak LLMs via Alternative Template and Suffix Optimization
par: Wang, Yanting, et autres
Publié: (2025)
par: Wang, Yanting, et autres
Publié: (2025)
Stealthy Backdoor Attacks against LLMs Based on Natural Style Triggers
par: Wei, Jiali, et autres
Publié: (2026)
par: Wei, Jiali, et autres
Publié: (2026)
Revisiting Training-Inference Trigger Intensity in Backdoor Attacks
par: Lin, Chenhao, et autres
Publié: (2025)
par: Lin, Chenhao, et autres
Publié: (2025)
Hardware-Triggered Backdoors
par: Möller, Jonas, et autres
Publié: (2026)
par: Möller, Jonas, et autres
Publié: (2026)
Trusted Weights, Treacherous Optimizations? Optimization-Triggered Backdoor Attacks on LLMs
par: Wang, Yifei, et autres
Publié: (2026)
par: Wang, Yifei, et autres
Publié: (2026)
TooBadRL: Trigger Optimization to Boost Effectiveness of Backdoor Attacks on Deep Reinforcement Learning
par: Zhang, Mingxuan, et autres
Publié: (2025)
par: Zhang, Mingxuan, et autres
Publié: (2025)
Trigger Where It Hurts: Unveiling Hidden Backdoors through Sensitivity with Sensitron
par: Zhao, Gejian, et autres
Publié: (2025)
par: Zhao, Gejian, et autres
Publié: (2025)
ASPIRER: Bypassing System Prompts With Permutation-based Backdoors in LLMs
par: Yan, Lu, et autres
Publié: (2024)
par: Yan, Lu, et autres
Publié: (2024)
Removing the Trigger, Not the Backdoor: Alternative Triggers and Latent Backdoors
par: Abad, Gorka, et autres
Publié: (2026)
par: Abad, Gorka, et autres
Publié: (2026)
BaThe: Defense against the Jailbreak Attack in Multimodal Large Language Models by Treating Harmful Instruction as Backdoor Trigger
par: Chen, Yulin, et autres
Publié: (2024)
par: Chen, Yulin, et autres
Publié: (2024)
Concealing Backdoor Model Updates in Federated Learning by Trigger-Optimized Data Poisoning
par: Zhang, Yujie, et autres
Publié: (2024)
par: Zhang, Yujie, et autres
Publié: (2024)
M-to-N Backdoor Paradigm: A Multi-Trigger and Multi-Target Attack to Deep Learning Models
par: Hou, Linshan, et autres
Publié: (2022)
par: Hou, Linshan, et autres
Publié: (2022)
Backdoor Attacks against No-Reference Image Quality Assessment Models via a Scalable Trigger
par: Yu, Yi, et autres
Publié: (2024)
par: Yu, Yi, et autres
Publié: (2024)
The Trigger in the Haystack: Extracting and Reconstructing LLM Backdoor Triggers
par: Bullwinkel, Blake, et autres
Publié: (2026)
par: Bullwinkel, Blake, et autres
Publié: (2026)
BackdoorDM: A Comprehensive Benchmark for Backdoor Learning on Diffusion Model
par: Lin, Weilin, et autres
Publié: (2025)
par: Lin, Weilin, et autres
Publié: (2025)
When Forgetting Triggers Backdoors: A Clean Unlearning Attack
par: Arazzi, Marco, et autres
Publié: (2025)
par: Arazzi, Marco, et autres
Publié: (2025)
Backdoor Attack with Invisible Triggers Based on Model Architecture Modification
par: Ma, Yuan, et autres
Publié: (2024)
par: Ma, Yuan, et autres
Publié: (2024)
Runtime Backdoor Detection for Federated Learning via Representational Dissimilarity Analysis
par: Zhang, Xiyue, et autres
Publié: (2025)
par: Zhang, Xiyue, et autres
Publié: (2025)
Stateful Agent Backdoor
par: Dai, Zhengchunmin, et autres
Publié: (2026)
par: Dai, Zhengchunmin, et autres
Publié: (2026)
The Invitation Trap: Proactive Availability Backdoor in LLMs via Conversational Induction
par: Wang, He, et autres
Publié: (2026)
par: Wang, He, et autres
Publié: (2026)
Phishing Detection in Ethereum via Temporal Graph Contrastive Learning
par: Wu, Cong, et autres
Publié: (2026)
par: Wu, Cong, et autres
Publié: (2026)
DSBA: Dynamic Stealthy Backdoor Attack with Collaborative Optimization in Self-Supervised Learning
par: Wang, Jiayao, et autres
Publié: (2026)
par: Wang, Jiayao, et autres
Publié: (2026)
DMGNN: Detecting and Mitigating Backdoor Attacks in Graph Neural Networks
par: Sui, Hao, et autres
Publié: (2024)
par: Sui, Hao, et autres
Publié: (2024)
Shortcuts Everywhere and Nowhere: Exploring Multi-Trigger Backdoor Attacks
par: Li, Yige, et autres
Publié: (2024)
par: Li, Yige, et autres
Publié: (2024)
Is the Trigger Essential? A Feature-Based Triggerless Backdoor Attack in Vertical Federated Learning
par: Liu, Yige, et autres
Publié: (2026)
par: Liu, Yige, et autres
Publié: (2026)
CL-Attack: Textual Backdoor Attacks via Cross-Lingual Triggers
par: Zheng, Jingyi, et autres
Publié: (2024)
par: Zheng, Jingyi, et autres
Publié: (2024)
Efficient Input-level Backdoor Defense on Text-to-Image Synthesis via Neuron Activation Variation
par: Zhai, Shengfang, et autres
Publié: (2025)
par: Zhai, Shengfang, et autres
Publié: (2025)
Documents similaires
-
Watch the Watcher! Backdoor Attacks on Security-Enhancing Diffusion Models
par: Li, Changjiang, et autres
Publié: (2024) -
STEP: Detecting Audio Backdoor Attacks via Stability-based Trigger Exposure Profiling
par: Wang, Kun, et autres
Publié: (2026) -
A Set of Generalized Components to Achieve Effective Poison-only Clean-label Backdoor Attacks with Collaborative Sample Selection and Triggers
par: Wu, Zhixiao, et autres
Publié: (2025) -
Isolate Trigger: Detecting and Eliminating Adaptive Backdoor Attacks
par: Sun, Chengrui, et autres
Publié: (2025) -
Turn-Based Structural Triggers: Prompt-Free Backdoors in Multi-Turn LLMs
par: Lu, Yiyang, et autres
Publié: (2026)