Exposing Vulnerabilities in RL: A Novel Stealthy Backdoor Attack through Reward Poisoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Bokang, Lu, Chaojun, Li, Jianhui, Wu, Junfeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Online Poisoning Attack Against Reinforcement Learning under Black-box Environments
por: Li, Jianhui, et al.
Publicado: (2024)
por: Li, Jianhui, et al.
Publicado: (2024)
Towards Stealthy and Effective Backdoor Attacks on Lane Detection: A Naturalistic Data Poisoning Approach
por: Liao, Yifan, et al.
Publicado: (2025)
por: Liao, Yifan, et al.
Publicado: (2025)
Spa-VLM: Stealthy Poisoning Attacks on RAG-based VLM
por: Yu, Lei, et al.
Publicado: (2025)
por: Yu, Lei, et al.
Publicado: (2025)
Stealthy Targeted Backdoor Attacks against Image Captioning
por: Fan, Wenshu, et al.
Publicado: (2024)
por: Fan, Wenshu, et al.
Publicado: (2024)
State Backdoor: Towards Stealthy Real-world Poisoning Attack on Vision-Language-Action Model in State Space
por: Guo, Ji, et al.
Publicado: (2026)
por: Guo, Ji, et al.
Publicado: (2026)
Stealthy Backdoor Attack via Confidence-driven Sampling
por: He, Pengfei, et al.
Publicado: (2023)
por: He, Pengfei, et al.
Publicado: (2023)
DSBA: Dynamic Stealthy Backdoor Attack with Collaborative Optimization in Self-Supervised Learning
por: Wang, Jiayao, et al.
Publicado: (2026)
por: Wang, Jiayao, et al.
Publicado: (2026)
Activation Gradient based Poisoned Sample Detection Against Backdoor Attacks
por: Yuan, Danni, et al.
Publicado: (2023)
por: Yuan, Danni, et al.
Publicado: (2023)
MirageBackdoor: A Stealthy Attack that Induces Think-Well-Answer-Wrong Reasoning
por: Zeng, Yizhe, et al.
Publicado: (2026)
por: Zeng, Yizhe, et al.
Publicado: (2026)
Poisoning the Pixels: Revisiting Backdoor Attacks on Semantic Segmentation
por: Zhang, Guangsheng, et al.
Publicado: (2026)
por: Zhang, Guangsheng, et al.
Publicado: (2026)
Graph-Aware Stealthy Poison-Text Backdoors for Text-Attributed Graphs
por: Luo, Qi, et al.
Publicado: (2026)
por: Luo, Qi, et al.
Publicado: (2026)
SSD: A State-based Stealthy Backdoor Attack For Navigation System in UAV Route Planning
por: Wang, Zhaoxuan, et al.
Publicado: (2025)
por: Wang, Zhaoxuan, et al.
Publicado: (2025)
Dullahan: Stealthy Backdoor Attack against Without-Label-Sharing Split Learning
por: Pu, Yuwen, et al.
Publicado: (2024)
por: Pu, Yuwen, et al.
Publicado: (2024)
Your RAG is Unfair: Exposing Fairness Vulnerabilities in Retrieval-Augmented Generation via Backdoor Attacks
por: Bagwe, Gaurav, et al.
Publicado: (2025)
por: Bagwe, Gaurav, et al.
Publicado: (2025)
Stealthy Backdoor Attack to Real-world Models in Android Apps
por: Wei, Jiali, et al.
Publicado: (2025)
por: Wei, Jiali, et al.
Publicado: (2025)
SteganoBackdoor: Stealthy and Data-Efficient Backdoor Attacks on Language Models
por: Xue, Eric, et al.
Publicado: (2025)
por: Xue, Eric, et al.
Publicado: (2025)
Detecting Stealthy Data Poisoning Attacks in AI Code Generators
por: Improta, Cristina
Publicado: (2025)
por: Improta, Cristina
Publicado: (2025)
Towards Effective, Stealthy, and Persistent Backdoor Attacks Targeting Graph Foundation Models
por: Luo, Jiayi, et al.
Publicado: (2025)
por: Luo, Jiayi, et al.
Publicado: (2025)
Stealthy Yet Effective: Distribution-Preserving Backdoor Attacks on Graph Classification
por: Wang, Xiaobao, et al.
Publicado: (2025)
por: Wang, Xiaobao, et al.
Publicado: (2025)
Stealthy and Adjustable Text-Guided Backdoor Attacks on Multimodal Pretrained Models
por: Zhang, Yiyang, et al.
Publicado: (2026)
por: Zhang, Yiyang, et al.
Publicado: (2026)
VisPoison: An Effective Backdoor Attack Framework for Tabular Data Visualization Models
por: Li, Shuaimin, et al.
Publicado: (2024)
por: Li, Shuaimin, et al.
Publicado: (2024)
DOPA: Stealthy and Generalizable Backdoor Attacks from a Single Client under Challenging Federated Constraints
por: Qin, Xuezheng, et al.
Publicado: (2025)
por: Qin, Xuezheng, et al.
Publicado: (2025)
Large Language Models are Good Attackers: Efficient and Stealthy Textual Backdoor Attacks
por: Li, Ziqiang, et al.
Publicado: (2024)
por: Li, Ziqiang, et al.
Publicado: (2024)
Stealthy Poisoning Attacks Bypass Defenses in Regression Settings
por: Carnerero-Cano, Javier, et al.
Publicado: (2026)
por: Carnerero-Cano, Javier, et al.
Publicado: (2026)
Privacy-Preserving Federated Learning Scheme with Mitigating Model Poisoning Attacks: Vulnerabilities and Countermeasures
por: Wu, Jiahui, et al.
Publicado: (2025)
por: Wu, Jiahui, et al.
Publicado: (2025)
Lurking in the shadows: Unveiling Stealthy Backdoor Attacks against Personalized Federated Learning
por: Lyu, Xiaoting, et al.
Publicado: (2024)
por: Lyu, Xiaoting, et al.
Publicado: (2024)
Multi-Trigger Poisoning Amplifies Backdoor Vulnerabilities in LLMs
por: Sivapiromrat, Sanhanat, et al.
Publicado: (2025)
por: Sivapiromrat, Sanhanat, et al.
Publicado: (2025)
FlowMur: A Stealthy and Practical Audio Backdoor Attack with Limited Knowledge
por: Lan, Jiahe, et al.
Publicado: (2023)
por: Lan, Jiahe, et al.
Publicado: (2023)
SDBA: A Stealthy and Long-Lasting Durable Backdoor Attack in Federated Learning
por: Choe, Minyeong, et al.
Publicado: (2024)
por: Choe, Minyeong, et al.
Publicado: (2024)
Federated Learning Under Attack: Exposing Vulnerabilities through Data Poisoning Attacks in Computer Networks
por: Nowroozi, Ehsan, et al.
Publicado: (2024)
por: Nowroozi, Ehsan, et al.
Publicado: (2024)
Shadowcast: Stealthy Data Poisoning Attacks Against Vision-Language Models
por: Xu, Yuancheng, et al.
Publicado: (2024)
por: Xu, Yuancheng, et al.
Publicado: (2024)
The 'Sure' Trap: Multi-Scale Poisoning Analysis of Stealthy Compliance-Only Backdoors in Fine-Tuned Large Language Models
por: Tan, Yuting, et al.
Publicado: (2025)
por: Tan, Yuting, et al.
Publicado: (2025)
Mitigating Backdoor Triggered and Targeted Data Poisoning Attacks in Voice Authentication Systems
por: Mohammadi, Alireza, et al.
Publicado: (2025)
por: Mohammadi, Alireza, et al.
Publicado: (2025)
Stealthy Dual-Trigger Backdoors: Attacking Prompt Tuning in LM-Empowered Graph Foundation Models
por: Xue, Xiaoyu, et al.
Publicado: (2025)
por: Xue, Xiaoyu, et al.
Publicado: (2025)
SNEAKDOOR: Stealthy Backdoor Attacks against Distribution Matching-based Dataset Condensation
por: Yang, He, et al.
Publicado: (2026)
por: Yang, He, et al.
Publicado: (2026)
ShadowCoT: Cognitive Hijacking for Stealthy Reasoning Backdoors in LLMs
por: Zhao, Gejian, et al.
Publicado: (2025)
por: Zhao, Gejian, et al.
Publicado: (2025)
Stealthy Backdoor Attacks against LLMs Based on Natural Style Triggers
por: Wei, Jiali, et al.
Publicado: (2026)
por: Wei, Jiali, et al.
Publicado: (2026)
Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation
por: Zhong, Zhiyuan, et al.
Publicado: (2025)
por: Zhong, Zhiyuan, et al.
Publicado: (2025)
CBPF: Filtering Poisoned Data Based on Composite Backdoor Attack
por: Xia, Hanfeng, et al.
Publicado: (2024)
por: Xia, Hanfeng, et al.
Publicado: (2024)
A Proxy Attack-Free Strategy for Practically Improving the Poisoning Efficiency in Backdoor Attacks
por: Li, Ziqiang, et al.
Publicado: (2023)
por: Li, Ziqiang, et al.
Publicado: (2023)
Ejemplares similares
-
Online Poisoning Attack Against Reinforcement Learning under Black-box Environments
por: Li, Jianhui, et al.
Publicado: (2024) -
Towards Stealthy and Effective Backdoor Attacks on Lane Detection: A Naturalistic Data Poisoning Approach
por: Liao, Yifan, et al.
Publicado: (2025) -
Spa-VLM: Stealthy Poisoning Attacks on RAG-based VLM
por: Yu, Lei, et al.
Publicado: (2025) -
Stealthy Targeted Backdoor Attacks against Image Captioning
por: Fan, Wenshu, et al.
Publicado: (2024) -
State Backdoor: Towards Stealthy Real-world Poisoning Attack on Vision-Language-Action Model in State Space
por: Guo, Ji, et al.
Publicado: (2026)