Attacks Meet Interpretability (AmI) Evaluation and Findings
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ma, Qian, Ye, Ziping, Mehnaz, Shagufta |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GNNBleed: Inference Attacks to Unveil Private Edges in Graphs with Realistic Access to GNN Models
par: Song, Zeyu, et autres
Publié: (2023)
par: Song, Zeyu, et autres
Publié: (2023)
Baiting AI: Deceptive Adversary Against AI-Protected Industrial Infrastructures
par: Pasikhani, Aryan, et autres
Publié: (2026)
par: Pasikhani, Aryan, et autres
Publié: (2026)
Enhancing Adversarial Example Detection Through Model Explanation
par: Ma, Qian, et autres
Publié: (2025)
par: Ma, Qian, et autres
Publié: (2025)
I Stolenly Swear That I Am Up to (No) Good: Design and Evaluation of Model Stealing Attacks
par: Oliynyk, Daryna, et autres
Publié: (2025)
par: Oliynyk, Daryna, et autres
Publié: (2025)
Forget to Flourish: Leveraging Machine-Unlearning on Pretrained Language Models for Privacy Leakage
par: Rashid, Md Rafi Ur, et autres
Publié: (2024)
par: Rashid, Md Rafi Ur, et autres
Publié: (2024)
Gradient-Free Privacy Leakage in Federated Language Models through Selective Weight Tampering
par: Rashid, Md Rafi Ur, et autres
Publié: (2023)
par: Rashid, Md Rafi Ur, et autres
Publié: (2023)
LogicEval: A Systematic Framework for Evaluating Automated Repair Techniques for Logical Vulnerabilities in Real-World Software
par: Rashid, Syed Md Mukit, et autres
Publié: (2026)
par: Rashid, Syed Md Mukit, et autres
Publié: (2026)
Finding Software Supply Chain Attack Paths with Logical Attack Graphs
par: Soeiro, Luıs, et autres
Publié: (2025)
par: Soeiro, Luıs, et autres
Publié: (2025)
Am I Infected? Lessons from Operating a Large-Scale IoT Security Diagnostic Service
par: Sasaki, Takayuki, et autres
Publié: (2025)
par: Sasaki, Takayuki, et autres
Publié: (2025)
Cross-Service Token: Finding Attacks in 5G Core Networks
par: Chen, Anqi, et autres
Publié: (2025)
par: Chen, Anqi, et autres
Publié: (2025)
Comprehensive Evaluation of Cloaking Backdoor Attacks on Object Detector in Real-World
par: Ma, Hua, et autres
Publié: (2025)
par: Ma, Hua, et autres
Publié: (2025)
Rethinking Fraud Safety Evaluation: Multi-Round Attacks Reveal Safety-Utility Tradeoffs in Graph-Context LLM Defenders
par: Jiang, Laura, et autres
Publié: (2026)
par: Jiang, Laura, et autres
Publié: (2026)
Breaking the Prompt Wall (I): A Real-World Case Study of Attacking ChatGPT via Lightweight Prompt Injection
par: Chang, Xiangyu, et autres
Publié: (2025)
par: Chang, Xiangyu, et autres
Publié: (2025)
Bones of Contention: Exploring Query-Efficient Attacks against Skeleton Recognition Systems
par: Cao, Yuxin, et autres
Publié: (2025)
par: Cao, Yuxin, et autres
Publié: (2025)
Interpreting Adversarial Attacks and Defences using Architectures with Enhanced Interpretability
par: Rao, Akshay G, et autres
Publié: (2025)
par: Rao, Akshay G, et autres
Publié: (2025)
Model Inversion Attacks Meet Cryptographic Fuzzy Extractors
par: Prabhakar, Mallika, et autres
Publié: (2025)
par: Prabhakar, Mallika, et autres
Publié: (2025)
Defensive Prompt Patch: A Robust and Interpretable Defense of LLMs against Jailbreak Attacks
par: Xiong, Chen, et autres
Publié: (2024)
par: Xiong, Chen, et autres
Publié: (2024)
Quantization Aware Attack: Enhancing Transferable Adversarial Attacks by Model Quantization
par: Yang, Yulong, et autres
Publié: (2023)
par: Yang, Yulong, et autres
Publié: (2023)
Quantum Meet-in-the-Middle Attacks on Key-Length Extension Constructions
par: Liang, Min, et autres
Publié: (2025)
par: Liang, Min, et autres
Publié: (2025)
"Training robust watermarking model may hurt authentication!'' Exploring and Mitigating the Identity Leakage in Robust Watermarking
par: Zhang, Xinyu, et autres
Publié: (2026)
par: Zhang, Xinyu, et autres
Publié: (2026)
Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models
par: Chen, Zeyuan, et autres
Publié: (2026)
par: Chen, Zeyuan, et autres
Publié: (2026)
Nip in the Bud: Forecasting and Interpreting Post-exploitation Attacks in Real-time through Cyber Threat Intelligence Reports
par: Zhu, Tiantian, et autres
Publié: (2024)
par: Zhu, Tiantian, et autres
Publié: (2024)
Infighting in the Dark: Multi-Label Backdoor Attack in Federated Learning
par: Li, Ye, et autres
Publié: (2024)
par: Li, Ye, et autres
Publié: (2024)
Cybersecurity AI: Evaluating Agentic Cybersecurity in Attack/Defense CTFs
par: Balassone, Francesco, et autres
Publié: (2025)
par: Balassone, Francesco, et autres
Publié: (2025)
Attack Effect Model based Malicious Behavior Detection
par: Wang, Limin, et autres
Publié: (2025)
par: Wang, Limin, et autres
Publié: (2025)
AmBox: Device-to-Blockchain Ambient Sensing for Food Traceability
par: Fernandes, João Miguel Guerreiro, et autres
Publié: (2026)
par: Fernandes, João Miguel Guerreiro, et autres
Publié: (2026)
Examining I2P Resilience: Effect of Centrality-based Attack
par: Akanbi, Kemi, et autres
Publié: (2025)
par: Akanbi, Kemi, et autres
Publié: (2025)
ExtendAttack: Attacking Servers of LRMs via Extending Reasoning
par: Zhu, Zhenhao, et autres
Publié: (2025)
par: Zhu, Zhenhao, et autres
Publié: (2025)
Jailbreaking Prompt Attack: A Controllable Adversarial Attack against Diffusion Models
par: Ma, Jiachen, et autres
Publié: (2024)
par: Ma, Jiachen, et autres
Publié: (2024)
Evaluating the Defense Potential of Machine Unlearning against Membership Inference Attacks
par: Tsiolakis, Theodoros, et autres
Publié: (2025)
par: Tsiolakis, Theodoros, et autres
Publié: (2025)
Data Exfiltration by Compression Attack: Definition and Evaluation on Medical Image Data
par: Li, Huiyu, et autres
Publié: (2025)
par: Li, Huiyu, et autres
Publié: (2025)
Library-Attack: Reverse Engineering Approach for Evaluating Hardware IP Protection
par: Dasgupta, Aritra, et autres
Publié: (2025)
par: Dasgupta, Aritra, et autres
Publié: (2025)
CIBER: A Comprehensive Benchmark for Security Evaluation of Code Interpreter Agents
par: Ba, Lei, et autres
Publié: (2026)
par: Ba, Lei, et autres
Publié: (2026)
Defending Against Neural Network Model Inversion Attacks via Data Poisoning
par: Zhou, Shuai, et autres
Publié: (2024)
par: Zhou, Shuai, et autres
Publié: (2024)
WebGPU-SPY: Finding Fingerprints in the Sandbox through GPU Cache Attacks
par: Ferguson, Ethan, et autres
Publié: (2024)
par: Ferguson, Ethan, et autres
Publié: (2024)
Shrinking the Kernel Attack Surface Through Static and Dynamic Syscall Limitation
par: Zhan, Dongyang, et autres
Publié: (2025)
par: Zhan, Dongyang, et autres
Publié: (2025)
Membership Inference Attacks and Defenses in Federated Learning: A Survey
par: Bai, Li, et autres
Publié: (2024)
par: Bai, Li, et autres
Publié: (2024)
A Sample-Level Evaluation and Generative Framework for Model Inversion Attacks
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
RLCracker: Evaluating the Worst-Case Vulnerability of LLM Watermarks with Adaptive RL Attacks
par: Huang, Hanbo, et autres
Publié: (2025)
par: Huang, Hanbo, et autres
Publié: (2025)
Finding Missing Input Validation in TEEs via LLM-Assisted Symbolic Execution
par: Ma, Chengyan, et autres
Publié: (2026)
par: Ma, Chengyan, et autres
Publié: (2026)
Documents similaires
-
GNNBleed: Inference Attacks to Unveil Private Edges in Graphs with Realistic Access to GNN Models
par: Song, Zeyu, et autres
Publié: (2023) -
Baiting AI: Deceptive Adversary Against AI-Protected Industrial Infrastructures
par: Pasikhani, Aryan, et autres
Publié: (2026) -
Enhancing Adversarial Example Detection Through Model Explanation
par: Ma, Qian, et autres
Publié: (2025) -
I Stolenly Swear That I Am Up to (No) Good: Design and Evaluation of Model Stealing Attacks
par: Oliynyk, Daryna, et autres
Publié: (2025) -
Forget to Flourish: Leveraging Machine-Unlearning on Pretrained Language Models for Privacy Leakage
par: Rashid, Md Rafi Ur, et autres
Publié: (2024)