TooBadRL: Trigger Optimization to Boost Effectiveness of Backdoor Attacks on Deep Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Mingxuan, Ma, Oubo, Wei, Kang, Li, Songze, Ji, Shouling |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UNIDOOR: A Universal Framework for Action-Level Backdoor Attacks in Deep Reinforcement Learning
di: Ma, Oubo, et al.
Pubblicazione: (2025)
di: Ma, Oubo, et al.
Pubblicazione: (2025)
Angel or Demon: Investigating the Plasticity Interventions' Impact on Backdoor Threats in Deep Reinforcement Learning
di: Ma, Oubo, et al.
Pubblicazione: (2026)
di: Ma, Oubo, et al.
Pubblicazione: (2026)
Reformulation is All You Need: Addressing Malicious Text Features in DNNs
di: Jiang, Yi, et al.
Pubblicazione: (2025)
di: Jiang, Yi, et al.
Pubblicazione: (2025)
BadMerging: Backdoor Attacks Against Model Merging
di: Zhang, Jinghuai, et al.
Pubblicazione: (2024)
di: Zhang, Jinghuai, et al.
Pubblicazione: (2024)
BadFair: Backdoored Fairness Attacks with Group-conditioned Triggers
di: Xue, Jiaqi, et al.
Pubblicazione: (2024)
di: Xue, Jiaqi, et al.
Pubblicazione: (2024)
SUB-PLAY: Adversarial Policies against Partially Observed Multi-Agent Reinforcement Learning Systems
di: Ma, Oubo, et al.
Pubblicazione: (2024)
di: Ma, Oubo, et al.
Pubblicazione: (2024)
BadRSSD: Backdoor Attacks on Regularized Self-Supervised Diffusion Models
di: Wang, Jiayao, et al.
Pubblicazione: (2026)
di: Wang, Jiayao, et al.
Pubblicazione: (2026)
Trusted Weights, Treacherous Optimizations? Optimization-Triggered Backdoor Attacks on LLMs
di: Wang, Yifei, et al.
Pubblicazione: (2026)
di: Wang, Yifei, et al.
Pubblicazione: (2026)
Shortcuts Everywhere and Nowhere: Exploring Multi-Trigger Backdoor Attacks
di: Li, Yige, et al.
Pubblicazione: (2024)
di: Li, Yige, et al.
Pubblicazione: (2024)
Fine-tuning is Not Fine: Mitigating Backdoor Attacks in GNNs with Limited Clean Data
di: Zhang, Jiale, et al.
Pubblicazione: (2025)
di: Zhang, Jiale, et al.
Pubblicazione: (2025)
Attributing and Exploiting Safety Vectors through Global Optimization in Large Language Models
di: Chu, Fengheng, et al.
Pubblicazione: (2026)
di: Chu, Fengheng, et al.
Pubblicazione: (2026)
BadTime: An Effective Backdoor Attack on Multivariate Long-Term Time Series Forecasting
di: Xiang, Kunlan, et al.
Pubblicazione: (2025)
di: Xiang, Kunlan, et al.
Pubblicazione: (2025)
BackdoorIndicator: Leveraging OOD Data for Proactive Backdoor Detection in Federated Learning
di: Li, Songze, et al.
Pubblicazione: (2024)
di: Li, Songze, et al.
Pubblicazione: (2024)
Hidden Ads: Behavior Triggered Semantic Backdoors for Advertisement Injection in Vision Language Models
di: Yao, Duanyi, et al.
Pubblicazione: (2026)
di: Yao, Duanyi, et al.
Pubblicazione: (2026)
Awakening the Hydra: Stabilizing Multi-Concept Backdoor Injection in Text-to-Image Diffusion Models
di: Wang, Kai, et al.
Pubblicazione: (2026)
di: Wang, Kai, et al.
Pubblicazione: (2026)
Adversarial Inception Backdoor Attacks against Reinforcement Learning
di: Rathbun, Ethan, et al.
Pubblicazione: (2024)
di: Rathbun, Ethan, et al.
Pubblicazione: (2024)
Watch the Watcher! Backdoor Attacks on Security-Enhancing Diffusion Models
di: Li, Changjiang, et al.
Pubblicazione: (2024)
di: Li, Changjiang, et al.
Pubblicazione: (2024)
Cross-Paradigm Graph Backdoor Attacks with Promptable Subgraph Triggers
di: Liu, Dongyi, et al.
Pubblicazione: (2025)
di: Liu, Dongyi, et al.
Pubblicazione: (2025)
DeDe: Detecting Backdoor Samples for SSL Encoders via Decoders
di: Hou, Sizai, et al.
Pubblicazione: (2024)
di: Hou, Sizai, et al.
Pubblicazione: (2024)
Is the Trigger Essential? A Feature-Based Triggerless Backdoor Attack in Vertical Federated Learning
di: Liu, Yige, et al.
Pubblicazione: (2026)
di: Liu, Yige, et al.
Pubblicazione: (2026)
Dullahan: Stealthy Backdoor Attack against Without-Label-Sharing Split Learning
di: Pu, Yuwen, et al.
Pubblicazione: (2024)
di: Pu, Yuwen, et al.
Pubblicazione: (2024)
A Channel-Triggered Backdoor Attack on Wireless Semantic Image Reconstruction
di: Wan, Jialin, et al.
Pubblicazione: (2025)
di: Wan, Jialin, et al.
Pubblicazione: (2025)
Beware Untrusted Simulators -- Reward-Free Backdoor Attacks in Reinforcement Learning
di: Rathbun, Ethan, et al.
Pubblicazione: (2026)
di: Rathbun, Ethan, et al.
Pubblicazione: (2026)
HashVFL: Defending Against Data Reconstruction Attacks in Vertical Federated Learning
di: Qiu, Pengyu, et al.
Pubblicazione: (2022)
di: Qiu, Pengyu, et al.
Pubblicazione: (2022)
BadImplant: Injection-based Multi-Targeted Graph Backdoor Attack
di: Khan, Md Nabi Newaz, et al.
Pubblicazione: (2026)
di: Khan, Md Nabi Newaz, et al.
Pubblicazione: (2026)
Hardware-Triggered Backdoors
di: Möller, Jonas, et al.
Pubblicazione: (2026)
di: Möller, Jonas, et al.
Pubblicazione: (2026)
TrojanDam: Detection-Free Backdoor Defense in Federated Learning through Proactive Model Robustification utilizing OOD Data
di: Dai, Yanbo, et al.
Pubblicazione: (2025)
di: Dai, Yanbo, et al.
Pubblicazione: (2025)
BadFU: Backdoor Federated Learning through Adversarial Machine Unlearning
di: Lu, Bingguang, et al.
Pubblicazione: (2025)
di: Lu, Bingguang, et al.
Pubblicazione: (2025)
EmInspector: Combating Backdoor Attacks in Federated Self-Supervised Learning Through Embedding Inspection
di: Qian, Yuwen, et al.
Pubblicazione: (2024)
di: Qian, Yuwen, et al.
Pubblicazione: (2024)
BadAgent: Inserting and Activating Backdoor Attacks in LLM Agents
di: Wang, Yifei, et al.
Pubblicazione: (2024)
di: Wang, Yifei, et al.
Pubblicazione: (2024)
BadCM: Invisible Backdoor Attack Against Cross-Modal Learning
di: Zhang, Zheng, et al.
Pubblicazione: (2024)
di: Zhang, Zheng, et al.
Pubblicazione: (2024)
Bad-PFL: Exploring Backdoor Attacks against Personalized Federated Learning
di: Fan, Mingyuan, et al.
Pubblicazione: (2025)
di: Fan, Mingyuan, et al.
Pubblicazione: (2025)
On the Out-of-Distribution Backdoor Attack for Federated Learning
di: Xu, Jiahao, et al.
Pubblicazione: (2025)
di: Xu, Jiahao, et al.
Pubblicazione: (2025)
Stealthy Yet Effective: Distribution-Preserving Backdoor Attacks on Graph Classification
di: Wang, Xiaobao, et al.
Pubblicazione: (2025)
di: Wang, Xiaobao, et al.
Pubblicazione: (2025)
SleeperNets: Universal Backdoor Poisoning Attacks Against Reinforcement Learning Agents
di: Rathbun, Ethan, et al.
Pubblicazione: (2024)
di: Rathbun, Ethan, et al.
Pubblicazione: (2024)
Attack by Yourself: Effective and Unnoticeable Multi-Category Graph Backdoor Attacks with Subgraph Triggers Pool
di: Li, Jiangtong, et al.
Pubblicazione: (2024)
di: Li, Jiangtong, et al.
Pubblicazione: (2024)
"No Matter What You Do": Purifying GNN Models via Backdoor Unlearning
di: Zhang, Jiale, et al.
Pubblicazione: (2024)
di: Zhang, Jiale, et al.
Pubblicazione: (2024)
Backdoor Attack with Sparse and Invisible Trigger
di: Gao, Yinghua, et al.
Pubblicazione: (2023)
di: Gao, Yinghua, et al.
Pubblicazione: (2023)
STEP: Detecting Audio Backdoor Attacks via Stability-based Trigger Exposure Profiling
di: Wang, Kun, et al.
Pubblicazione: (2026)
di: Wang, Kun, et al.
Pubblicazione: (2026)
Defending against Backdoor Attack on Deep Neural Networks
di: Cheng, Hao, et al.
Pubblicazione: (2020)
di: Cheng, Hao, et al.
Pubblicazione: (2020)
Documenti analoghi
-
UNIDOOR: A Universal Framework for Action-Level Backdoor Attacks in Deep Reinforcement Learning
di: Ma, Oubo, et al.
Pubblicazione: (2025) -
Angel or Demon: Investigating the Plasticity Interventions' Impact on Backdoor Threats in Deep Reinforcement Learning
di: Ma, Oubo, et al.
Pubblicazione: (2026) -
Reformulation is All You Need: Addressing Malicious Text Features in DNNs
di: Jiang, Yi, et al.
Pubblicazione: (2025) -
BadMerging: Backdoor Attacks Against Model Merging
di: Zhang, Jinghuai, et al.
Pubblicazione: (2024) -
BadFair: Backdoored Fairness Attacks with Group-conditioned Triggers
di: Xue, Jiaqi, et al.
Pubblicazione: (2024)