AUTOLYCUS: Exploiting Explainable AI (XAI) for Model Extraction Attacks against Interpretable Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Oksuz, Abdullah Caglar, Halimi, Anisa, Ayday, Erman |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LoMime: Query-Efficient Membership Inference using Model Extraction in Label-Only Settings
di: Oksuz, Abdullah Caglar, et al.
Pubblicazione: (2026)
di: Oksuz, Abdullah Caglar, et al.
Pubblicazione: (2026)
Privacy-Preserving Optimal Parameter Selection for Collaborative Clustering
di: Ghasemian, Maryam, et al.
Pubblicazione: (2024)
di: Ghasemian, Maryam, et al.
Pubblicazione: (2024)
Topic-Based Watermarks for Large Language Models
di: Nemecek, Alexander, et al.
Pubblicazione: (2024)
di: Nemecek, Alexander, et al.
Pubblicazione: (2024)
ZKPROV: A Zero-Knowledge Approach to Dataset Provenance for Large Language Models
di: Namazi, Mina, et al.
Pubblicazione: (2025)
di: Namazi, Mina, et al.
Pubblicazione: (2025)
Quantifying Memorization and Privacy Risks in Genomic Language Models
di: Nemecek, Alexander, et al.
Pubblicazione: (2026)
di: Nemecek, Alexander, et al.
Pubblicazione: (2026)
Persona-Conditioned Adversarial Prompting: Multi-Identity Red-Teaming for Adversarial Discovery and Mitigation
di: Morasso, Cristian, et al.
Pubblicazione: (2026)
di: Morasso, Cristian, et al.
Pubblicazione: (2026)
A User-Centric, Privacy-Preserving, and Verifiable Ecosystem for Personal Data Management and Utilization
di: Zafar, Osama, et al.
Pubblicazione: (2025)
di: Zafar, Osama, et al.
Pubblicazione: (2025)
Empowering Digital Agriculture: A Privacy-Preserving Framework for Data Sharing and Collaborative Research
di: Zafar, Osama, et al.
Pubblicazione: (2025)
di: Zafar, Osama, et al.
Pubblicazione: (2025)
MEA-Defender: A Robust Watermark against Model Extraction Attack
di: Lv, Peizhuo, et al.
Pubblicazione: (2024)
di: Lv, Peizhuo, et al.
Pubblicazione: (2024)
Cluster-Aware Attacks on Graph Watermarks
di: Nemecek, Alexander, et al.
Pubblicazione: (2025)
di: Nemecek, Alexander, et al.
Pubblicazione: (2025)
Interpretable Anomaly-Based DDoS Detection in AI-RAN with XAI and LLMs
di: Chatzimiltis, Sotiris, et al.
Pubblicazione: (2025)
di: Chatzimiltis, Sotiris, et al.
Pubblicazione: (2025)
Model Extraction Attacks Revisited
di: Liang, Jiacheng, et al.
Pubblicazione: (2023)
di: Liang, Jiacheng, et al.
Pubblicazione: (2023)
DivQAT: Enhancing Robustness of Quantized Convolutional Neural Networks against Model Extraction Attacks
di: Khaled, Kacem, et al.
Pubblicazione: (2025)
di: Khaled, Kacem, et al.
Pubblicazione: (2025)
Exploiting Defenses against GAN-Based Feature Inference Attacks in Federated Learning
di: Luo, Xinjian, et al.
Pubblicazione: (2020)
di: Luo, Xinjian, et al.
Pubblicazione: (2020)
Watermarking Without Standards Is Not AI Governance
di: Nemecek, Alexander, et al.
Pubblicazione: (2025)
di: Nemecek, Alexander, et al.
Pubblicazione: (2025)
Privacy-Preserving Data Linkage Across Private and Public Datasets for Collaborative Agriculture Research
di: Zafar, Osama, et al.
Pubblicazione: (2024)
di: Zafar, Osama, et al.
Pubblicazione: (2024)
XAI and Android Malware Models
di: Kulkarni, Maithili, et al.
Pubblicazione: (2024)
di: Kulkarni, Maithili, et al.
Pubblicazione: (2024)
Few-shot Model Extraction Attacks against Sequential Recommender Systems
di: Zhang, Hui, et al.
Pubblicazione: (2024)
di: Zhang, Hui, et al.
Pubblicazione: (2024)
A Systematic Study of Model Extraction Attacks on Graph Foundation Models
di: Xu, Haoyan, et al.
Pubblicazione: (2025)
di: Xu, Haoyan, et al.
Pubblicazione: (2025)
Analysis of Zero Day Attack Detection Using MLP and XAI
di: Dahal, Ashim, et al.
Pubblicazione: (2025)
di: Dahal, Ashim, et al.
Pubblicazione: (2025)
Validating GWAS Findings through Reverse Engineering of Contingency Tables
di: Jiang, Yuzhou, et al.
Pubblicazione: (2024)
di: Jiang, Yuzhou, et al.
Pubblicazione: (2024)
Neighborhood Blending: A Lightweight Inference-Time Defense Against Membership Inference Attacks
di: Zafar, Osama, et al.
Pubblicazione: (2026)
di: Zafar, Osama, et al.
Pubblicazione: (2026)
From Counterfactuals to Trees: Competitive Analysis of Model Extraction Attacks
di: Khouna, Awa, et al.
Pubblicazione: (2025)
di: Khouna, Awa, et al.
Pubblicazione: (2025)
Model Stealing Attack against Graph Classification with Authenticity, Uncertainty and Diversity
di: Zhu, Zhihao, et al.
Pubblicazione: (2023)
di: Zhu, Zhihao, et al.
Pubblicazione: (2023)
The End of Trust: How Agentic AI Breaks Security Assumptions
di: Zafar, Osama, et al.
Pubblicazione: (2026)
di: Zafar, Osama, et al.
Pubblicazione: (2026)
FDINet: Protecting against DNN Model Extraction via Feature Distortion Index
di: Yao, Hongwei, et al.
Pubblicazione: (2023)
di: Yao, Hongwei, et al.
Pubblicazione: (2023)
Towards a Re-evaluation of Data Forging Attacks in Practice
di: Suliman, Mohamed, et al.
Pubblicazione: (2024)
di: Suliman, Mohamed, et al.
Pubblicazione: (2024)
PROVGEN: A Privacy-Preserving Approach for Outcome Validation in Genomic Research
di: Jiang, Yuzhou, et al.
Pubblicazione: (2022)
di: Jiang, Yuzhou, et al.
Pubblicazione: (2022)
Privacy-Preserving Model and Preprocessing Verification for Machine Learning
di: Li, Wenbiao, et al.
Pubblicazione: (2025)
di: Li, Wenbiao, et al.
Pubblicazione: (2025)
Digital Agriculture Sandbox for Collaborative Research
di: Zafar, Osama, et al.
Pubblicazione: (2025)
di: Zafar, Osama, et al.
Pubblicazione: (2025)
Consistent Valid Physically-Realizable Adversarial Attack against Crowd-flow Prediction Models
di: Ali, Hassan, et al.
Pubblicazione: (2023)
di: Ali, Hassan, et al.
Pubblicazione: (2023)
A Large-Scale Exploit Instrumentation Study of AI/ML Supply Chain Attacks in Hugging Face Models
di: Casey, Beatrice, et al.
Pubblicazione: (2024)
di: Casey, Beatrice, et al.
Pubblicazione: (2024)
Privacy Policy Enforcement Guardrails for Data-Sensitive Retrieval-Augmented Generation
di: Zafar, Osama, et al.
Pubblicazione: (2026)
di: Zafar, Osama, et al.
Pubblicazione: (2026)
ATOM: A Framework of Detecting Query-Based Model Extraction Attacks for Graph Neural Networks
di: Cheng, Zhan, et al.
Pubblicazione: (2025)
di: Cheng, Zhan, et al.
Pubblicazione: (2025)
Thwarting Cybersecurity Attacks with Explainable Concept Drift
di: Shaer, Ibrahim, et al.
Pubblicazione: (2024)
di: Shaer, Ibrahim, et al.
Pubblicazione: (2024)
XAI-SOH-FL: Enhancing SOH-FL with Adaptive Aggregation and Explainable AI for Intrusion Detection in Heterogeneous IoT
di: Aslam, Ambreen, et al.
Pubblicazione: (2026)
di: Aslam, Ambreen, et al.
Pubblicazione: (2026)
CAN-Trace Attack: Exploit CAN Messages to Uncover Driving Trajectories
di: Lin, Xiaojie, et al.
Pubblicazione: (2025)
di: Lin, Xiaojie, et al.
Pubblicazione: (2025)
A Data-Driven Defense against Edge-case Model Poisoning Attacks on Federated Learning
di: Purohit, Kiran, et al.
Pubblicazione: (2023)
di: Purohit, Kiran, et al.
Pubblicazione: (2023)
Performance Evaluation of Knowledge Graph Embedding Approaches under Non-adversarial Attacks
di: Kapoor, Sourabh, et al.
Pubblicazione: (2024)
di: Kapoor, Sourabh, et al.
Pubblicazione: (2024)
SAME: Sample Reconstruction against Model Extraction Attacks
di: Xie, Yi, et al.
Pubblicazione: (2023)
di: Xie, Yi, et al.
Pubblicazione: (2023)
Documenti analoghi
-
LoMime: Query-Efficient Membership Inference using Model Extraction in Label-Only Settings
di: Oksuz, Abdullah Caglar, et al.
Pubblicazione: (2026) -
Privacy-Preserving Optimal Parameter Selection for Collaborative Clustering
di: Ghasemian, Maryam, et al.
Pubblicazione: (2024) -
Topic-Based Watermarks for Large Language Models
di: Nemecek, Alexander, et al.
Pubblicazione: (2024) -
ZKPROV: A Zero-Knowledge Approach to Dataset Provenance for Large Language Models
di: Namazi, Mina, et al.
Pubblicazione: (2025) -
Quantifying Memorization and Privacy Risks in Genomic Language Models
di: Nemecek, Alexander, et al.
Pubblicazione: (2026)