PNAct: Crafting Backdoor Attacks in Safe Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Weiran, Liu, Guanjun, Zhou, Ziyuan, Wang, Ling |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SAJA: A State-Action Joint Attack Framework on Multi-Agent Deep Reinforcement Learning
di: Guo, Weiqi, et al.
Pubblicazione: (2025)
di: Guo, Weiqi, et al.
Pubblicazione: (2025)
Enhancing the Robustness of QMIX against State-adversarial Attacks
di: Guo, Weiran, et al.
Pubblicazione: (2023)
di: Guo, Weiran, et al.
Pubblicazione: (2023)
Cooperative Backdoor Attack in Decentralized Reinforcement Learning with Theoretical Guarantee
di: Gao, Mengtong, et al.
Pubblicazione: (2024)
di: Gao, Mengtong, et al.
Pubblicazione: (2024)
How to Craft Backdoors with Unlabeled Data Alone?
di: Wang, Yifei, et al.
Pubblicazione: (2024)
di: Wang, Yifei, et al.
Pubblicazione: (2024)
Compromising Embodied Agents with Contextual Backdoor Attacks
di: Liu, Aishan, et al.
Pubblicazione: (2024)
di: Liu, Aishan, et al.
Pubblicazione: (2024)
UNIDOOR: A Universal Framework for Action-Level Backdoor Attacks in Deep Reinforcement Learning
di: Ma, Oubo, et al.
Pubblicazione: (2025)
di: Ma, Oubo, et al.
Pubblicazione: (2025)
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
di: Guo, Zijian, et al.
Pubblicazione: (2024)
di: Guo, Zijian, et al.
Pubblicazione: (2024)
Structure-Aware Distributed Backdoor Attacks in Federated Learning
di: Jian, Wang, et al.
Pubblicazione: (2026)
di: Jian, Wang, et al.
Pubblicazione: (2026)
Skill-based Safe Reinforcement Learning with Risk Planning
di: Zhang, Hanping, et al.
Pubblicazione: (2025)
di: Zhang, Hanping, et al.
Pubblicazione: (2025)
Multi-Agent Reinforcement Learning: Methods, Applications, Visionary Prospects, and Challenges
di: Zhou, Ziyuan, et al.
Pubblicazione: (2023)
di: Zhou, Ziyuan, et al.
Pubblicazione: (2023)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
di: Ji, Jiaming, et al.
Pubblicazione: (2025)
di: Ji, Jiaming, et al.
Pubblicazione: (2025)
Partially Observable Mean Field Multi-Agent Reinforcement Learning Based on Graph-Attention
di: Yang, Min, et al.
Pubblicazione: (2023)
di: Yang, Min, et al.
Pubblicazione: (2023)
Adversarial Robustness Unhardening via Backdoor Attacks in Federated Learning
di: Kim, Taejin, et al.
Pubblicazione: (2023)
di: Kim, Taejin, et al.
Pubblicazione: (2023)
ICLShield: Exploring and Mitigating In-Context Learning Backdoor Attacks
di: Ren, Zhiyao, et al.
Pubblicazione: (2025)
di: Ren, Zhiyao, et al.
Pubblicazione: (2025)
Defending Deep Regression Models against Backdoor Attacks
di: Du, Lingyu, et al.
Pubblicazione: (2024)
di: Du, Lingyu, et al.
Pubblicazione: (2024)
Implicit Safe Set Algorithm for Provably Safe Reinforcement Learning
di: Zhao, Weiye, et al.
Pubblicazione: (2024)
di: Zhao, Weiye, et al.
Pubblicazione: (2024)
The Eminence in Shadow: Exploiting Feature Boundary Ambiguity for Robust Backdoor Attacks
di: Feng, Zhou, et al.
Pubblicazione: (2025)
di: Feng, Zhou, et al.
Pubblicazione: (2025)
Crafting Imperceptible On-Manifold Adversarial Attacks for Tabular Data
di: He, Zhipeng, et al.
Pubblicazione: (2025)
di: He, Zhipeng, et al.
Pubblicazione: (2025)
Unlearn to Relearn Backdoors: Deferred Backdoor Functionality Attacks on Deep Learning Models
di: Shin, Jeongjin, et al.
Pubblicazione: (2024)
di: Shin, Jeongjin, et al.
Pubblicazione: (2024)
BAFFLE: Hiding Backdoors in Offline Reinforcement Learning Datasets
di: Gong, Chen, et al.
Pubblicazione: (2022)
di: Gong, Chen, et al.
Pubblicazione: (2022)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
di: Su, Huikang, et al.
Pubblicazione: (2025)
di: Su, Huikang, et al.
Pubblicazione: (2025)
Probabilistic Shielding for Safe Reinforcement Learning
di: Court, Edwin Hamel-De le, et al.
Pubblicazione: (2025)
di: Court, Edwin Hamel-De le, et al.
Pubblicazione: (2025)
Reinforcement Learning by Guided Safe Exploration
di: Yang, Qisong, et al.
Pubblicazione: (2023)
di: Yang, Qisong, et al.
Pubblicazione: (2023)
Provably Efficient Action-Manipulation Attack Against Continuous Reinforcement Learning
di: Luo, Zhi, et al.
Pubblicazione: (2024)
di: Luo, Zhi, et al.
Pubblicazione: (2024)
GUARD: A Safe Reinforcement Learning Benchmark
di: Zhao, Weiye, et al.
Pubblicazione: (2023)
di: Zhao, Weiye, et al.
Pubblicazione: (2023)
Certifying Language Model Robustness with Fuzzed Randomized Smoothing: An Efficient Defense Against Backdoor Attacks
di: He, Bowei, et al.
Pubblicazione: (2025)
di: He, Bowei, et al.
Pubblicazione: (2025)
BLAST: A Stealthy Backdoor Leverage Attack against Cooperative Multi-Agent Deep Reinforcement Learning based Systems
di: Fang, Jing, et al.
Pubblicazione: (2025)
di: Fang, Jing, et al.
Pubblicazione: (2025)
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
di: Anisimov, Maksim, et al.
Pubblicazione: (2026)
di: Anisimov, Maksim, et al.
Pubblicazione: (2026)
Behavior Backdoor for Deep Learning Models
di: Wang, Jiakai, et al.
Pubblicazione: (2024)
di: Wang, Jiakai, et al.
Pubblicazione: (2024)
Causal Policy Learning in Reinforcement Learning: Backdoor-Adjusted Soft Actor-Critic
di: Vo, Thanh Vinh, et al.
Pubblicazione: (2025)
di: Vo, Thanh Vinh, et al.
Pubblicazione: (2025)
Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
di: Ji, Jiaming, et al.
Pubblicazione: (2023)
di: Ji, Jiaming, et al.
Pubblicazione: (2023)
A Vision-Language Pre-training Model-Guided Approach for Mitigating Backdoor Attacks in Federated Learning
di: Gai, Keke, et al.
Pubblicazione: (2025)
di: Gai, Keke, et al.
Pubblicazione: (2025)
Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk
di: Ying, Chengyang, et al.
Pubblicazione: (2022)
di: Ying, Chengyang, et al.
Pubblicazione: (2022)
Heterogeneous Graph Backdoor Attack
di: Chen, Jiawei, et al.
Pubblicazione: (2025)
di: Chen, Jiawei, et al.
Pubblicazione: (2025)
Online Optimization for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2025)
di: Chemingui, Yassine, et al.
Pubblicazione: (2025)
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
di: Yao, Yihang, et al.
Pubblicazione: (2023)
di: Yao, Yihang, et al.
Pubblicazione: (2023)
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
di: Tayal, Mumuksh, et al.
Pubblicazione: (2026)
di: Tayal, Mumuksh, et al.
Pubblicazione: (2026)
A Review of Safe Reinforcement Learning: Methods, Theory and Applications
di: Gu, Shangding, et al.
Pubblicazione: (2022)
di: Gu, Shangding, et al.
Pubblicazione: (2022)
Rethinking Adversarial Attacks in Reinforcement Learning from Policy Distribution Perspective
di: Duan, Tianyang, et al.
Pubblicazione: (2025)
di: Duan, Tianyang, et al.
Pubblicazione: (2025)
Enhance Exploration in Safe Reinforcement Learning with Contrastive Representation Learning
di: Doan, Duc Kien, et al.
Pubblicazione: (2025)
di: Doan, Duc Kien, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SAJA: A State-Action Joint Attack Framework on Multi-Agent Deep Reinforcement Learning
di: Guo, Weiqi, et al.
Pubblicazione: (2025) -
Enhancing the Robustness of QMIX against State-adversarial Attacks
di: Guo, Weiran, et al.
Pubblicazione: (2023) -
Cooperative Backdoor Attack in Decentralized Reinforcement Learning with Theoretical Guarantee
di: Gao, Mengtong, et al.
Pubblicazione: (2024) -
How to Craft Backdoors with Unlabeled Data Alone?
di: Wang, Yifei, et al.
Pubblicazione: (2024) -
Compromising Embodied Agents with Contextual Backdoor Attacks
di: Liu, Aishan, et al.
Pubblicazione: (2024)