ARMOR: Shielding Unlearnable Examples against Data Augmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gong, Xueluan, Wang, Yuji, Chen, Yanjiao, Dong, Haocheng, Li, Yiming, Sun, Mengyuan, Li, Shuaike, Wang, Qian, Chen, Chen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hidden Data Privacy Breaches in Federated Learning
par: Gong, Xueluan, et autres
Publié: (2024)
par: Gong, Xueluan, et autres
Publié: (2024)
PAPILLON: Efficient and Stealthy Fuzz Testing-Powered Jailbreaks for LLMs
par: Gong, Xueluan, et autres
Publié: (2024)
par: Gong, Xueluan, et autres
Publié: (2024)
Evaluating and Mitigating LLM-as-a-judge Bias in Communication Systems
par: Gao, Jiaxin, et autres
Publié: (2025)
par: Gao, Jiaxin, et autres
Publié: (2025)
Megatron: Evasive Clean-Label Backdoor Attacks against Vision Transformer
par: Gong, Xueluan, et autres
Publié: (2024)
par: Gong, Xueluan, et autres
Publié: (2024)
Channel-Level Semantic Perturbations: Unlearnable Examples for Diverse Training Paradigms
par: Wang, Bo, et autres
Publié: (2026)
par: Wang, Bo, et autres
Publié: (2026)
Generating Is Believing: Membership Inference Attacks against Retrieval-Augmented Generation
par: Li, Yuying, et autres
Publié: (2024)
par: Li, Yuying, et autres
Publié: (2024)
An Effective and Resilient Backdoor Attack Framework against Deep Neural Networks and Vision Transformers
par: Gong, Xueluan, et autres
Publié: (2024)
par: Gong, Xueluan, et autres
Publié: (2024)
Provably Unlearnable Data Examples
par: Wang, Derui, et autres
Publié: (2024)
par: Wang, Derui, et autres
Publié: (2024)
Beyond Max Tokens: Stealthy Resource Amplification via Tool Calling Chains in LLM Agents
par: Zhou, Kaiyu, et autres
Publié: (2026)
par: Zhou, Kaiyu, et autres
Publié: (2026)
T2UE: Generating Unlearnable Examples from Text Descriptions
par: Ma, Xingjun, et autres
Publié: (2025)
par: Ma, Xingjun, et autres
Publié: (2025)
AgentTypo: Adaptive Typographic Prompt Injection Attacks against Black-box Multimodal Agents
par: Li, Yanjie, et autres
Publié: (2025)
par: Li, Yanjie, et autres
Publié: (2025)
AdaShield: Safeguarding Multimodal Large Language Models from Structure-based Attack via Adaptive Shield Prompting
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
SoK: Unlearnability and Unlearning for Model Dememorization
par: Zhang, Mengying, et autres
Publié: (2026)
par: Zhang, Mengying, et autres
Publié: (2026)
Purify Unlearnable Examples via Rate-Constrained Variational Autoencoders
par: Yu, Yi, et autres
Publié: (2024)
par: Yu, Yi, et autres
Publié: (2024)
Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning
par: Liu, Xinwei, et autres
Publié: (2024)
par: Liu, Xinwei, et autres
Publié: (2024)
EdgeShield: A Universal and Efficient Edge Computing Framework for Robust AI
par: Zhong, Duo, et autres
Publié: (2024)
par: Zhong, Duo, et autres
Publié: (2024)
BitHydra: Towards Bit-flip Inference Cost Attack against Large Language Models
par: Yan, Xiaobei, et autres
Publié: (2025)
par: Yan, Xiaobei, et autres
Publié: (2025)
Buffer is All You Need: Defending Federated Learning against Backdoor Attacks under Non-iids via Buffering
par: Lyu, Xingyu, et autres
Publié: (2025)
par: Lyu, Xingyu, et autres
Publié: (2025)
RAG-WM: An Efficient Black-Box Watermarking Approach for Retrieval-Augmented Generation of Large Language Models
par: Lv, Peizhuo, et autres
Publié: (2025)
par: Lv, Peizhuo, et autres
Publié: (2025)
DPImageBench: A Unified Benchmark for Differentially Private Image Synthesis
par: Gong, Chen, et autres
Publié: (2025)
par: Gong, Chen, et autres
Publié: (2025)
Stable Unlearnable Example: Enhancing the Robustness of Unlearnable Examples via Stable Error-Minimizing Noise
par: Liu, Yixin, et autres
Publié: (2023)
par: Liu, Yixin, et autres
Publié: (2023)
Game-Theoretic Unlearnable Example Generator
par: Liu, Shuang, et autres
Publié: (2024)
par: Liu, Shuang, et autres
Publié: (2024)
"Glue pizza and eat rocks" -- Exploiting Vulnerabilities in Retrieval-Augmented Generative Models
par: Tan, Zhen, et autres
Publié: (2024)
par: Tan, Zhen, et autres
Publié: (2024)
From Easy to Hard: Building a Shortcut for Differentially Private Image Synthesis
par: Li, Kecen, et autres
Publié: (2025)
par: Li, Kecen, et autres
Publié: (2025)
FraudShield: Knowledge Graph Empowered Defense for LLMs against Fraud Attacks
par: Xu, Naen, et autres
Publié: (2026)
par: Xu, Naen, et autres
Publié: (2026)
ADAM: A Systematic Data Extraction Attack on Agent Memory via Adaptive Querying
par: Lyu, Xingyu, et autres
Publié: (2026)
par: Lyu, Xingyu, et autres
Publié: (2026)
SOFT: Selective Data Obfuscation for Protecting LLM Fine-tuning against Membership Inference Attacks
par: Zhang, Kaiyuan, et autres
Publié: (2025)
par: Zhang, Kaiyuan, et autres
Publié: (2025)
Toward Polymorphic Backdoor against Semantic Communication via Intensity-Based Poisoning
par: Yang, Xiao, et autres
Publié: (2026)
par: Yang, Xiao, et autres
Publié: (2026)
QUEEN: Query Unlearning against Model Extraction
par: Chen, Huajie, et autres
Publié: (2024)
par: Chen, Huajie, et autres
Publié: (2024)
Deciphering the Interplay between Attack and Protection Complexity in Privacy-Preserving Federated Learning
par: Zhang, Xiaojin, et autres
Publié: (2025)
par: Zhang, Xiaojin, et autres
Publié: (2025)
TEAM: Temporal Adversarial Examples Attack Model against Network Intrusion Detection System Applied to RNN
par: Liu, Ziyi, et autres
Publié: (2024)
par: Liu, Ziyi, et autres
Publié: (2024)
Semantic-level Backdoor Attack against Text-to-Image Diffusion Models
par: Chen, Tianxin, et autres
Publié: (2026)
par: Chen, Tianxin, et autres
Publié: (2026)
Securing Retrieval-Augmented Generation: A Taxonomy of Attacks, Defenses, and Future Directions
par: Xu, Yuming, et autres
Publié: (2026)
par: Xu, Yuming, et autres
Publié: (2026)
NCCR: to Evaluate the Robustness of Neural Networks and Adversarial Examples
par: Pu, Shi, et autres
Publié: (2025)
par: Pu, Shi, et autres
Publié: (2025)
DiscourseFlip: An Oblique Discourse-Level Opinion Manipulation Attack against Black-box Retrieval-Augmented Generation
par: Gong, Yuyang, et autres
Publié: (2026)
par: Gong, Yuyang, et autres
Publié: (2026)
From Texts to Shields: Convergence of Large Language Models and Cybersecurity
par: Li, Tao, et autres
Publié: (2025)
par: Li, Tao, et autres
Publié: (2025)
Your Agent Can Defend Itself against Backdoor Attacks
par: Changjiang, Li, et autres
Publié: (2025)
par: Changjiang, Li, et autres
Publié: (2025)
Improving Sustainability of Adversarial Examples in Class-Incremental Learning
par: Liu, Taifeng, et autres
Publié: (2025)
par: Liu, Taifeng, et autres
Publié: (2025)
ShadowCode: Towards (Automatic) External Prompt Injection Attack against Code LLMs
par: Yang, Yuchen, et autres
Publié: (2024)
par: Yang, Yuchen, et autres
Publié: (2024)
Coward: Collision-based OOD Watermarking for Practical Proactive Federated Backdoor Detection
par: Li, Wenjie, et autres
Publié: (2025)
par: Li, Wenjie, et autres
Publié: (2025)
Documents similaires
-
Hidden Data Privacy Breaches in Federated Learning
par: Gong, Xueluan, et autres
Publié: (2024) -
PAPILLON: Efficient and Stealthy Fuzz Testing-Powered Jailbreaks for LLMs
par: Gong, Xueluan, et autres
Publié: (2024) -
Evaluating and Mitigating LLM-as-a-judge Bias in Communication Systems
par: Gao, Jiaxin, et autres
Publié: (2025) -
Megatron: Evasive Clean-Label Backdoor Attacks against Vision Transformer
par: Gong, Xueluan, et autres
Publié: (2024) -
Channel-Level Semantic Perturbations: Unlearnable Examples for Diverse Training Paradigms
par: Wang, Bo, et autres
Publié: (2026)