Stealthy Backdoor Attack via Confidence-driven Sampling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Pengfei, Xing, Yue, Xu, Han, Ren, Jie, Cui, Yingqian, Zeng, Shenglai, Tang, Jiliang, Yamada, Makoto, Sabokrou, Mohammad |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sharpness-Aware Data Poisoning Attack
par: He, Pengfei, et autres
Publié: (2023)
par: He, Pengfei, et autres
Publié: (2023)
Data Poisoning for In-context Learning
par: He, Pengfei, et autres
Publié: (2024)
par: He, Pengfei, et autres
Publié: (2024)
Six-CD: Benchmarking Concept Removals for Benign Text-to-image Diffusion Models
par: Ren, Jie, et autres
Publié: (2024)
par: Ren, Jie, et autres
Publié: (2024)
Mitigating the Privacy Issues in Retrieval-Augmented Generation (RAG) via Pure Synthetic Data
par: Zeng, Shenglai, et autres
Publié: (2024)
par: Zeng, Shenglai, et autres
Publié: (2024)
Unveiling Privacy Risks in LLM Agent Memory
par: Wang, Bo, et autres
Publié: (2025)
par: Wang, Bo, et autres
Publié: (2025)
Unveiling and Mitigating Memorization in Text-to-image Diffusion Models through Cross Attention
par: Ren, Jie, et autres
Publié: (2024)
par: Ren, Jie, et autres
Publié: (2024)
DiffusionShield: A Watermark for Copyright Protection against Generative Diffusion Models
par: Cui, Yingqian, et autres
Publié: (2023)
par: Cui, Yingqian, et autres
Publié: (2023)
Large Language Models are Good Attackers: Efficient and Stealthy Textual Backdoor Attacks
par: Li, Ziqiang, et autres
Publié: (2024)
par: Li, Ziqiang, et autres
Publié: (2024)
A Robust Semantics-based Watermark for Large Language Model against Paraphrasing
par: Ren, Jie, et autres
Publié: (2023)
par: Ren, Jie, et autres
Publié: (2023)
Exploiting Layer-Specific Vulnerabilities to Backdoor Attack in Federated Learning
par: Foroughi, Mohammad Hadi, et autres
Publié: (2026)
par: Foroughi, Mohammad Hadi, et autres
Publié: (2026)
Stealthy Targeted Backdoor Attacks against Image Captioning
par: Fan, Wenshu, et autres
Publié: (2024)
par: Fan, Wenshu, et autres
Publié: (2024)
FT-Shield: A Watermark Against Unauthorized Fine-tuning in Text-to-Image Diffusion Models
par: Cui, Yingqian, et autres
Publié: (2023)
par: Cui, Yingqian, et autres
Publié: (2023)
DSBA: Dynamic Stealthy Backdoor Attack with Collaborative Optimization in Self-Supervised Learning
par: Wang, Jiayao, et autres
Publié: (2026)
par: Wang, Jiayao, et autres
Publié: (2026)
SSD: A State-based Stealthy Backdoor Attack For Navigation System in UAV Route Planning
par: Wang, Zhaoxuan, et autres
Publié: (2025)
par: Wang, Zhaoxuan, et autres
Publié: (2025)
MirageBackdoor: A Stealthy Attack that Induces Think-Well-Answer-Wrong Reasoning
par: Zeng, Yizhe, et autres
Publié: (2026)
par: Zeng, Yizhe, et autres
Publié: (2026)
The Good and The Bad: Exploring Privacy Issues in Retrieval-Augmented Generation (RAG)
par: Zeng, Shenglai, et autres
Publié: (2024)
par: Zeng, Shenglai, et autres
Publié: (2024)
Multi-Faceted Studies on Data Poisoning can Advance LLM Development
par: He, Pengfei, et autres
Publié: (2025)
par: He, Pengfei, et autres
Publié: (2025)
DOPA: Stealthy and Generalizable Backdoor Attacks from a Single Client under Challenging Federated Constraints
par: Qin, Xuezheng, et autres
Publié: (2025)
par: Qin, Xuezheng, et autres
Publié: (2025)
Copyright Protection in Generative AI: A Technical Perspective
par: Ren, Jie, et autres
Publié: (2024)
par: Ren, Jie, et autres
Publié: (2024)
FlowMur: A Stealthy and Practical Audio Backdoor Attack with Limited Knowledge
par: Lan, Jiahe, et autres
Publié: (2023)
par: Lan, Jiahe, et autres
Publié: (2023)
Stealthy Yet Effective: Distribution-Preserving Backdoor Attacks on Graph Classification
par: Wang, Xiaobao, et autres
Publié: (2025)
par: Wang, Xiaobao, et autres
Publié: (2025)
Towards Stealthy and Effective Backdoor Attacks on Lane Detection: A Naturalistic Data Poisoning Approach
par: Liao, Yifan, et autres
Publié: (2025)
par: Liao, Yifan, et autres
Publié: (2025)
EnTruth: Enhancing the Traceability of Unauthorized Dataset Usage in Text-to-image Diffusion Models with Minimal and Robust Alterations
par: Ren, Jie, et autres
Publié: (2024)
par: Ren, Jie, et autres
Publié: (2024)
Dullahan: Stealthy Backdoor Attack against Without-Label-Sharing Split Learning
par: Pu, Yuwen, et autres
Publié: (2024)
par: Pu, Yuwen, et autres
Publié: (2024)
SNEAKDOOR: Stealthy Backdoor Attacks against Distribution Matching-based Dataset Condensation
par: Yang, He, et autres
Publié: (2026)
par: Yang, He, et autres
Publié: (2026)
Stealthy Backdoor Attack to Real-world Models in Android Apps
par: Wei, Jiali, et autres
Publié: (2025)
par: Wei, Jiali, et autres
Publié: (2025)
Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation
par: Zhong, Zhiyuan, et autres
Publié: (2025)
par: Zhong, Zhiyuan, et autres
Publié: (2025)
Lurking in the shadows: Unveiling Stealthy Backdoor Attacks against Personalized Federated Learning
par: Lyu, Xiaoting, et autres
Publié: (2024)
par: Lyu, Xiaoting, et autres
Publié: (2024)
Exposing Vulnerabilities in RL: A Novel Stealthy Backdoor Attack through Reward Poisoning
par: Zhang, Bokang, et autres
Publié: (2025)
par: Zhang, Bokang, et autres
Publié: (2025)
SteganoBackdoor: Stealthy and Data-Efficient Backdoor Attacks on Language Models
par: Xue, Eric, et autres
Publié: (2025)
par: Xue, Eric, et autres
Publié: (2025)
SoK: Machine Unlearning for Large Language Models
par: Ren, Jie, et autres
Publié: (2025)
par: Ren, Jie, et autres
Publié: (2025)
Stealthy and Adjustable Text-Guided Backdoor Attacks on Multimodal Pretrained Models
par: Zhang, Yiyang, et autres
Publié: (2026)
par: Zhang, Yiyang, et autres
Publié: (2026)
A Portable and Stealthy Inaudible Voice Attack Based on Acoustic Metamaterials
par: Ning, Zhiyuan, et autres
Publié: (2025)
par: Ning, Zhiyuan, et autres
Publié: (2025)
Towards Effective, Stealthy, and Persistent Backdoor Attacks Targeting Graph Foundation Models
par: Luo, Jiayi, et autres
Publié: (2025)
par: Luo, Jiayi, et autres
Publié: (2025)
SDBA: A Stealthy and Long-Lasting Durable Backdoor Attack in Federated Learning
par: Choe, Minyeong, et autres
Publié: (2024)
par: Choe, Minyeong, et autres
Publié: (2024)
Cuckoo Attack: Stealthy and Persistent Attacks Against AI-IDE
par: Liu, Xinpeng, et autres
Publié: (2025)
par: Liu, Xinpeng, et autres
Publié: (2025)
Red-Teaming LLM Multi-Agent Systems via Communication Attacks
par: He, Pengfei, et autres
Publié: (2025)
par: He, Pengfei, et autres
Publié: (2025)
UAV Resilience Against Stealthy Attacks
par: Amorim, Arthur, et autres
Publié: (2025)
par: Amorim, Arthur, et autres
Publié: (2025)
Stealthy Backdoor Attacks against LLMs Based on Natural Style Triggers
par: Wei, Jiali, et autres
Publié: (2026)
par: Wei, Jiali, et autres
Publié: (2026)
State Backdoor: Towards Stealthy Real-world Poisoning Attack on Vision-Language-Action Model in State Space
par: Guo, Ji, et autres
Publié: (2026)
par: Guo, Ji, et autres
Publié: (2026)
Documents similaires
-
Sharpness-Aware Data Poisoning Attack
par: He, Pengfei, et autres
Publié: (2023) -
Data Poisoning for In-context Learning
par: He, Pengfei, et autres
Publié: (2024) -
Six-CD: Benchmarking Concept Removals for Benign Text-to-image Diffusion Models
par: Ren, Jie, et autres
Publié: (2024) -
Mitigating the Privacy Issues in Retrieval-Augmented Generation (RAG) via Pure Synthetic Data
par: Zeng, Shenglai, et autres
Publié: (2024) -
Unveiling Privacy Risks in LLM Agent Memory
par: Wang, Bo, et autres
Publié: (2025)