Self-interpreting Adversarial Images
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Tingwei, Zhang, Collin, Morris, John X., Bagdasarian, Eugene, Shmatikov, Vitaly |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Adversarial Illusions in Multi-Modal Embeddings
par: Zhang, Tingwei, et autres
Publié: (2023)
par: Zhang, Tingwei, et autres
Publié: (2023)
Adversarial Decoding: Generating Readable Documents for Adversarial Objectives
par: Zhang, Collin, et autres
Publié: (2024)
par: Zhang, Collin, et autres
Publié: (2024)
How to Steal Reasoning Without Reasoning Traces
par: Zhang, Tingwei, et autres
Publié: (2026)
par: Zhang, Tingwei, et autres
Publié: (2026)
Universal Zero-shot Embedding Inversion
par: Zhang, Collin, et autres
Publié: (2025)
par: Zhang, Collin, et autres
Publié: (2025)
Backdooring Bias ($B^2$) into Stable Diffusion Models
par: Naseh, Ali, et autres
Publié: (2024)
par: Naseh, Ali, et autres
Publié: (2024)
Adversarial Hubness in Multi-Modal Retrieval
par: Zhang, Tingwei, et autres
Publié: (2024)
par: Zhang, Tingwei, et autres
Publié: (2024)
Throttling Web Agents Using Reasoning Gates
par: Kumar, Abhinav, et autres
Publié: (2025)
par: Kumar, Abhinav, et autres
Publié: (2025)
Deep-Research Agents Can Be Poisoned via User-Generated Content
par: Zhang, Tingwei, et autres
Publié: (2026)
par: Zhang, Tingwei, et autres
Publié: (2026)
Trusted Machine Learning Models Unlock Private Inference for Problems Currently Infeasible with Cryptography
par: Shumailov, Ilia, et autres
Publié: (2025)
par: Shumailov, Ilia, et autres
Publié: (2025)
Multi-Agent Systems Execute Arbitrary Malicious Code
par: Triedman, Harold, et autres
Publié: (2025)
par: Triedman, Harold, et autres
Publié: (2025)
Disappearing Ink: Obfuscation Breaks N-gram Code Watermarks in Theory and Practice
par: Zhang, Gehao, et autres
Publié: (2025)
par: Zhang, Gehao, et autres
Publié: (2025)
Rerouting LLM Routers
par: Shafran, Avital, et autres
Publié: (2025)
par: Shafran, Avital, et autres
Publié: (2025)
Machine Against the RAG: Jamming Retrieval-Augmented Generation with Blocker Documents
par: Shafran, Avital, et autres
Publié: (2024)
par: Shafran, Avital, et autres
Publié: (2024)
Vision Transformer with Adversarial Indicator Token against Adversarial Attacks in Radio Signal Classifications
par: Zhang, Lu, et autres
Publié: (2025)
par: Zhang, Lu, et autres
Publié: (2025)
Contextual Agent Security: A Policy for Every Purpose
par: Tsai, Lillian, et autres
Publié: (2025)
par: Tsai, Lillian, et autres
Publié: (2025)
Jailbreaking GPT-4V via Self-Adversarial Attacks with System Prompts
par: Wu, Yuanwei, et autres
Publié: (2023)
par: Wu, Yuanwei, et autres
Publié: (2023)
Information Theoretic Adversarial Training of Large Language Models
par: Zhang, Yiwei, et autres
Publié: (2026)
par: Zhang, Yiwei, et autres
Publié: (2026)
Perturbation Towards Easy Samples Improves Targeted Adversarial Transferability
par: Gao, Junqi, et autres
Publié: (2024)
par: Gao, Junqi, et autres
Publié: (2024)
Disttack: Graph Adversarial Attacks Toward Distributed GNN Training
par: Zhang, Yuxiang, et autres
Publié: (2024)
par: Zhang, Yuxiang, et autres
Publié: (2024)
Unveiling the Backdoor Mechanism Hidden Behind Catastrophic Overfitting in Fast Adversarial Training
par: Zhao, Mengnan, et autres
Publié: (2026)
par: Zhao, Mengnan, et autres
Publié: (2026)
Breaking and Fixing Defenses Against Control-Flow Hijacking in Multi-Agent Systems
par: Jha, Rishi, et autres
Publié: (2025)
par: Jha, Rishi, et autres
Publié: (2025)
DP-TRAE: A Dual-Phase Merging Transferable Reversible Adversarial Example for Image Privacy Protection
par: Du, Xia, et autres
Publié: (2025)
par: Du, Xia, et autres
Publié: (2025)
MF-CLIP: Leveraging CLIP as Surrogate Models for No-box Adversarial Attacks
par: Zhang, Jiaming, et autres
Publié: (2023)
par: Zhang, Jiaming, et autres
Publié: (2023)
Self-Mined Hardness for Safety Fine-Tuning
par: Gupta, Prakhar, et autres
Publié: (2026)
par: Gupta, Prakhar, et autres
Publié: (2026)
Investigating the Impact of Quantization on Adversarial Robustness
par: Li, Qun, et autres
Publié: (2024)
par: Li, Qun, et autres
Publié: (2024)
Adversarial Machine Learning Threats to Spacecraft
par: Thummala, Rajiv, et autres
Publié: (2024)
par: Thummala, Rajiv, et autres
Publié: (2024)
Detecting new obfuscated malware variants: A lightweight and interpretable machine learning approach
par: Madamidola, Oladipo A., et autres
Publié: (2024)
par: Madamidola, Oladipo A., et autres
Publié: (2024)
Topological Signatures of Adversaries in Multimodal Alignments
par: Vu, Minh, et autres
Publié: (2025)
par: Vu, Minh, et autres
Publié: (2025)
Are Robust LLM Fingerprints Adversarially Robust?
par: Nasery, Anshul, et autres
Publié: (2025)
par: Nasery, Anshul, et autres
Publié: (2025)
Network-Level Prompt and Trait Leakage in Local Research Agents
par: Jeong, Hyejun, et autres
Publié: (2025)
par: Jeong, Hyejun, et autres
Publié: (2025)
Adversarial Distilled Retrieval-Augmented Guarding Model for Online Malicious Intent Detection
par: Guo, Yihao, et autres
Publié: (2025)
par: Guo, Yihao, et autres
Publié: (2025)
Untargeted Adversarial Attack on Knowledge Graph Embeddings
par: Zhao, Tianzhe, et autres
Publié: (2024)
par: Zhao, Tianzhe, et autres
Publié: (2024)
Relationship between Uncertainty in DNNs and Adversarial Attacks
par: Ogonna, Mabel, et autres
Publié: (2024)
par: Ogonna, Mabel, et autres
Publié: (2024)
Diffusion-based Adversarial Purification for Intrusion Detection
par: Merzouk, Mohamed Amine, et autres
Publié: (2024)
par: Merzouk, Mohamed Amine, et autres
Publié: (2024)
Extending XReason: Formal Explanations for Adversarial Detection
par: Jemaa, Amira, et autres
Publié: (2024)
par: Jemaa, Amira, et autres
Publié: (2024)
Adversaries Can Misuse Combinations of Safe Models
par: Jones, Erik, et autres
Publié: (2024)
par: Jones, Erik, et autres
Publié: (2024)
Mitigating the Structural Bias in Graph Adversarial Defenses
par: Fang, Junyuan, et autres
Publié: (2025)
par: Fang, Junyuan, et autres
Publié: (2025)
On the Robustness of Bayesian Neural Networks to Adversarial Attacks
par: Bortolussi, Luca, et autres
Publié: (2022)
par: Bortolussi, Luca, et autres
Publié: (2022)
Adversarial Attacks on Transformers-Based Malware Detectors
par: Jakhotiya, Yash, et autres
Publié: (2022)
par: Jakhotiya, Yash, et autres
Publié: (2022)
PEAS: A Strategy for Crafting Transferable Adversarial Examples
par: Avraham, Bar, et autres
Publié: (2024)
par: Avraham, Bar, et autres
Publié: (2024)
Documents similaires
-
Adversarial Illusions in Multi-Modal Embeddings
par: Zhang, Tingwei, et autres
Publié: (2023) -
Adversarial Decoding: Generating Readable Documents for Adversarial Objectives
par: Zhang, Collin, et autres
Publié: (2024) -
How to Steal Reasoning Without Reasoning Traces
par: Zhang, Tingwei, et autres
Publié: (2026) -
Universal Zero-shot Embedding Inversion
par: Zhang, Collin, et autres
Publié: (2025) -
Backdooring Bias ($B^2$) into Stable Diffusion Models
par: Naseh, Ali, et autres
Publié: (2024)