Explaining the Model, Protecting Your Data: Revealing and Mitigating the Data Privacy Risks of Post-Hoc Model Explanations via Membership Inference
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Catherine, Pawelczyk, Martin, Lakkaraju, Himabindu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
In-Context Unlearning: Language Models as Few Shot Unlearners
di: Pawelczyk, Martin, et al.
Pubblicazione: (2023)
di: Pawelczyk, Martin, et al.
Pubblicazione: (2023)
Mitigating Privacy Risk in Membership Inference by Convex-Concave Loss
di: Liu, Zhenlong, et al.
Pubblicazione: (2024)
di: Liu, Zhenlong, et al.
Pubblicazione: (2024)
Membership Inference Attacks Cannot Prove that a Model Was Trained On Your Data
di: Zhang, Jie, et al.
Pubblicazione: (2024)
di: Zhang, Jie, et al.
Pubblicazione: (2024)
Bits for Privacy: Evaluating Post-Training Quantization via Membership Inference
di: Zhang, Chenxiang, et al.
Pubblicazione: (2025)
di: Zhang, Chenxiang, et al.
Pubblicazione: (2025)
DeepLeak: Privacy Enhancing Hardening of Model Explanations Against Membership Leakage
di: Hmida, Firas Ben, et al.
Pubblicazione: (2026)
di: Hmida, Firas Ben, et al.
Pubblicazione: (2026)
Data Poisoning Attacks on Off-Policy Policy Evaluation Methods
di: Lobo, Elita, et al.
Pubblicazione: (2024)
di: Lobo, Elita, et al.
Pubblicazione: (2024)
Membership Inference Attacks and Privacy in Topic Modeling
di: Manzonelli, Nico, et al.
Pubblicazione: (2024)
di: Manzonelli, Nico, et al.
Pubblicazione: (2024)
Privacy Backdoors: Enhancing Membership Inference through Poisoning Pre-trained Models
di: Wen, Yuxin, et al.
Pubblicazione: (2024)
di: Wen, Yuxin, et al.
Pubblicazione: (2024)
The Sample Complexity of Membership Inference and Privacy Auditing
di: Haghifam, Mahdi, et al.
Pubblicazione: (2025)
di: Haghifam, Mahdi, et al.
Pubblicazione: (2025)
Mitigating Membership Inference Vulnerability in Personalized Federated Learning
di: Jung, Kangsoo, et al.
Pubblicazione: (2025)
di: Jung, Kangsoo, et al.
Pubblicazione: (2025)
Membership Inference Attacks on Sequence Models
di: Rossi, Lorenzo, et al.
Pubblicazione: (2025)
di: Rossi, Lorenzo, et al.
Pubblicazione: (2025)
Accuracy-Privacy Trade-off in the Mitigation of Membership Inference Attack in Federated Learning
di: Ahamed, Sayyed Farid, et al.
Pubblicazione: (2024)
di: Ahamed, Sayyed Farid, et al.
Pubblicazione: (2024)
VoxGuard: Evaluating User and Attribute Privacy in Speech via Membership Inference Attacks
di: Tsaprazlis, Efthymios, et al.
Pubblicazione: (2025)
di: Tsaprazlis, Efthymios, et al.
Pubblicazione: (2025)
Follow My Instruction and Spill the Beans: Scalable Data Extraction from Retrieval-Augmented Generation Systems
di: Qi, Zhenting, et al.
Pubblicazione: (2024)
di: Qi, Zhenting, et al.
Pubblicazione: (2024)
Ensembler: Protect Collaborative Inference Privacy from Model Inversion Attack via Selective Ensemble
di: Liu, Dancheng, et al.
Pubblicazione: (2024)
di: Liu, Dancheng, et al.
Pubblicazione: (2024)
Data Plagiarism Index: Characterizing the Privacy Risk of Data-Copying in Tabular Generative Models
di: Ward, Joshua, et al.
Pubblicazione: (2024)
di: Ward, Joshua, et al.
Pubblicazione: (2024)
A Critical Review on the Effectiveness and Privacy Threats of Membership Inference Attacks
di: Jebreel, Najeeb, et al.
Pubblicazione: (2026)
di: Jebreel, Najeeb, et al.
Pubblicazione: (2026)
WaKA: Data Attribution using K-Nearest Neighbors and Membership Privacy Principles
di: Mesana, Patrick, et al.
Pubblicazione: (2024)
di: Mesana, Patrick, et al.
Pubblicazione: (2024)
On the Effectiveness of Membership Inference in Targeted Data Extraction from Large Language Models
di: Sahili, Ali Al, et al.
Pubblicazione: (2025)
di: Sahili, Ali Al, et al.
Pubblicazione: (2025)
A Zero Auxiliary Knowledge Membership Inference Attack on Aggregate Location Data
di: Guan, Vincent, et al.
Pubblicazione: (2024)
di: Guan, Vincent, et al.
Pubblicazione: (2024)
Enhancing One-run Privacy Auditing with Quantile Regression-Based Membership Inference
di: Liu, Terrance, et al.
Pubblicazione: (2025)
di: Liu, Terrance, et al.
Pubblicazione: (2025)
ReproMIA: A Comprehensive Analysis of Model Reprogramming for Proactive Membership Inference Attacks
di: Huang, Chihan, et al.
Pubblicazione: (2026)
di: Huang, Chihan, et al.
Pubblicazione: (2026)
Enhancing Feature-Specific Data Protection via Bayesian Coordinate Differential Privacy
di: Aliakbarpour, Maryam, et al.
Pubblicazione: (2024)
di: Aliakbarpour, Maryam, et al.
Pubblicazione: (2024)
Does Training with Synthetic Data Truly Protect Privacy?
di: Zhao, Yunpeng, et al.
Pubblicazione: (2025)
di: Zhao, Yunpeng, et al.
Pubblicazione: (2025)
Order of Magnitude Speedups for LLM Membership Inference
di: Zhang, Rongting, et al.
Pubblicazione: (2024)
di: Zhang, Rongting, et al.
Pubblicazione: (2024)
Membership Inference Attacks on Large-Scale Models: A Survey
di: Wu, Hengyu, et al.
Pubblicazione: (2025)
di: Wu, Hengyu, et al.
Pubblicazione: (2025)
Ensembling Membership Inference Attacks Against Tabular Generative Models
di: Ward, Joshua, et al.
Pubblicazione: (2025)
di: Ward, Joshua, et al.
Pubblicazione: (2025)
In-Context Probing for Membership Inference in Fine-Tuned Language Models
di: Lu, Zhexi, et al.
Pubblicazione: (2025)
di: Lu, Zhexi, et al.
Pubblicazione: (2025)
Mitigating Downstream Model Risks via Model Provenance
di: Wang, Keyu, et al.
Pubblicazione: (2024)
di: Wang, Keyu, et al.
Pubblicazione: (2024)
Sanitize Your Responses: Mitigating Privacy Leakage in Large Language Models
di: Fu, Wenjie, et al.
Pubblicazione: (2025)
di: Fu, Wenjie, et al.
Pubblicazione: (2025)
Beyond Data Privacy: New Privacy Risks for Large Language Models
di: Du, Yuntao, et al.
Pubblicazione: (2025)
di: Du, Yuntao, et al.
Pubblicazione: (2025)
Winning the MIDST Challenge: New Membership Inference Attacks on Diffusion Models for Tabular Data Synthesis
di: Wu, Xiaoyu, et al.
Pubblicazione: (2025)
di: Wu, Xiaoyu, et al.
Pubblicazione: (2025)
Imitative Membership Inference Attack
di: Du, Yuntao, et al.
Pubblicazione: (2025)
di: Du, Yuntao, et al.
Pubblicazione: (2025)
Privacy Auditing of Multi-domain Graph Pre-trained Model under Membership Inference Attacks
di: Luo, Jiayi, et al.
Pubblicazione: (2025)
di: Luo, Jiayi, et al.
Pubblicazione: (2025)
Decoupling Generalizability and Membership Privacy Risks in Neural Networks
di: Fang, Xingli, et al.
Pubblicazione: (2026)
di: Fang, Xingli, et al.
Pubblicazione: (2026)
Do Parameters Reveal More than Loss for Membership Inference?
di: Suri, Anshuman, et al.
Pubblicazione: (2024)
di: Suri, Anshuman, et al.
Pubblicazione: (2024)
The Tail Tells All: Estimating Model-Level Membership Inference Vulnerability Without Reference Models
di: Dodd, Euodia, et al.
Pubblicazione: (2025)
di: Dodd, Euodia, et al.
Pubblicazione: (2025)
When Fairness Meets Privacy: Exploring Privacy Threats in Fair Binary Classifiers via Membership Inference Attacks
di: Tian, Huan, et al.
Pubblicazione: (2023)
di: Tian, Huan, et al.
Pubblicazione: (2023)
How does Graph Structure Modulate Membership-Inference Risk for Graph Neural Networks?
di: Khosla, Megha
Pubblicazione: (2026)
di: Khosla, Megha
Pubblicazione: (2026)
Membership Inference Attacks for Unseen Classes
di: Thaker, Pratiksha, et al.
Pubblicazione: (2025)
di: Thaker, Pratiksha, et al.
Pubblicazione: (2025)
Documenti analoghi
-
In-Context Unlearning: Language Models as Few Shot Unlearners
di: Pawelczyk, Martin, et al.
Pubblicazione: (2023) -
Mitigating Privacy Risk in Membership Inference by Convex-Concave Loss
di: Liu, Zhenlong, et al.
Pubblicazione: (2024) -
Membership Inference Attacks Cannot Prove that a Model Was Trained On Your Data
di: Zhang, Jie, et al.
Pubblicazione: (2024) -
Bits for Privacy: Evaluating Post-Training Quantization via Membership Inference
di: Zhang, Chenxiang, et al.
Pubblicazione: (2025) -
DeepLeak: Privacy Enhancing Hardening of Model Explanations Against Membership Leakage
di: Hmida, Firas Ben, et al.
Pubblicazione: (2026)