Blind Baselines Beat Membership Inference Attacks for Foundation Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Das, Debeshee, Zhang, Jie, Tramèr, Florian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Membership Inference Attacks Cannot Prove that a Model Was Trained On Your Data
por: Zhang, Jie, et al.
Publicado: (2024)
por: Zhang, Jie, et al.
Publicado: (2024)
Membership Inference Attacks on Sequence Models
por: Rossi, Lorenzo, et al.
Publicado: (2025)
por: Rossi, Lorenzo, et al.
Publicado: (2025)
Membership Inference Attacks and Privacy in Topic Modeling
por: Manzonelli, Nico, et al.
Publicado: (2024)
por: Manzonelli, Nico, et al.
Publicado: (2024)
DocMIA: Document-Level Membership Inference Attacks against DocVQA Models
por: Nguyen, Khanh, et al.
Publicado: (2025)
por: Nguyen, Khanh, et al.
Publicado: (2025)
The Hidden Cost of Modeling P(X): Vulnerability to Membership Inference Attacks in Generative Text Classifiers
por: Makroo, Owais, et al.
Publicado: (2025)
por: Makroo, Owais, et al.
Publicado: (2025)
SoK: Membership Inference Attacks on LLMs are Rushing Nowhere (and How to Fix It)
por: Meeus, Matthieu, et al.
Publicado: (2024)
por: Meeus, Matthieu, et al.
Publicado: (2024)
Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration
por: Fu, Wenjie, et al.
Publicado: (2023)
por: Fu, Wenjie, et al.
Publicado: (2023)
Universal Jailbreak Backdoors from Poisoned Human Feedback
por: Rando, Javier, et al.
Publicado: (2023)
por: Rando, Javier, et al.
Publicado: (2023)
Context-Aware Membership Inference Attacks against Pre-trained Large Language Models
por: Chang, Hongyan, et al.
Publicado: (2024)
por: Chang, Hongyan, et al.
Publicado: (2024)
On the Effectiveness of Membership Inference in Targeted Data Extraction from Large Language Models
por: Sahili, Ali Al, et al.
Publicado: (2025)
por: Sahili, Ali Al, et al.
Publicado: (2025)
Did the Neurons Read your Book? Document-level Membership Inference for Large Language Models
por: Meeus, Matthieu, et al.
Publicado: (2023)
por: Meeus, Matthieu, et al.
Publicado: (2023)
Synthetic Data Can Mislead Evaluations: Membership Inference as Machine Text Detection
por: Naseh, Ali, et al.
Publicado: (2025)
por: Naseh, Ali, et al.
Publicado: (2025)
User Inference Attacks on Large Language Models
por: Kandpal, Nikhil, et al.
Publicado: (2023)
por: Kandpal, Nikhil, et al.
Publicado: (2023)
Membership Inference Attacks on LLM-based Recommender Systems
por: He, Jiajie, et al.
Publicado: (2025)
por: He, Jiajie, et al.
Publicado: (2025)
Membership Inference Attacks against Large Vision-Language Models
por: Li, Zhan, et al.
Publicado: (2024)
por: Li, Zhan, et al.
Publicado: (2024)
Evaluations of Machine Learning Privacy Defenses are Misleading
por: Aerni, Michael, et al.
Publicado: (2024)
por: Aerni, Michael, et al.
Publicado: (2024)
Imitative Membership Inference Attack
por: Du, Yuntao, et al.
Publicado: (2025)
por: Du, Yuntao, et al.
Publicado: (2025)
Membership Inference Attacks Against In-Context Learning
por: Wen, Rui, et al.
Publicado: (2024)
por: Wen, Rui, et al.
Publicado: (2024)
Cascading and Proxy Membership Inference Attacks
por: Du, Yuntao, et al.
Publicado: (2025)
por: Du, Yuntao, et al.
Publicado: (2025)
Privacy Backdoors: Stealing Data with Corrupted Pretrained Models
por: Feng, Shanglun, et al.
Publicado: (2024)
por: Feng, Shanglun, et al.
Publicado: (2024)
Query-Based Adversarial Prompt Generation
por: Hayase, Jonathan, et al.
Publicado: (2024)
por: Hayase, Jonathan, et al.
Publicado: (2024)
Membership Inference Attacks for Unseen Classes
por: Thaker, Pratiksha, et al.
Publicado: (2025)
por: Thaker, Pratiksha, et al.
Publicado: (2025)
Membership Inference Attacks Beyond Overfitting
por: Khalil, Mona, et al.
Publicado: (2025)
por: Khalil, Mona, et al.
Publicado: (2025)
Membership Inference Attacks on Large-Scale Models: A Survey
por: Wu, Hengyu, et al.
Publicado: (2025)
por: Wu, Hengyu, et al.
Publicado: (2025)
Ensembling Membership Inference Attacks Against Tabular Generative Models
por: Ward, Joshua, et al.
Publicado: (2025)
por: Ward, Joshua, et al.
Publicado: (2025)
An Adversarial Perspective on Machine Unlearning for AI Safety
por: Łucki, Jakub, et al.
Publicado: (2024)
por: Łucki, Jakub, et al.
Publicado: (2024)
Practical Bayes-Optimal Membership Inference Attacks
por: Lassila, Marcus, et al.
Publicado: (2025)
por: Lassila, Marcus, et al.
Publicado: (2025)
AgentDojo: A Dynamic Environment to Evaluate Prompt Injection Attacks and Defenses for LLM Agents
por: Debenedetti, Edoardo, et al.
Publicado: (2024)
por: Debenedetti, Edoardo, et al.
Publicado: (2024)
SeqMIA: Sequential-Metric Based Membership Inference Attack
por: Li, Hao, et al.
Publicado: (2024)
por: Li, Hao, et al.
Publicado: (2024)
Laundering AI Authority with Adversarial Examples
por: Zhang, Jie, et al.
Publicado: (2026)
por: Zhang, Jie, et al.
Publicado: (2026)
Adversarial ML Problems Are Getting Harder to Solve and to Evaluate
por: Rando, Javier, et al.
Publicado: (2025)
por: Rando, Javier, et al.
Publicado: (2025)
STAMP Your Content: Proving Dataset Membership via Watermarked Rephrasings
por: Rastogi, Saksham, et al.
Publicado: (2025)
por: Rastogi, Saksham, et al.
Publicado: (2025)
MIST: Defending Against Membership Inference Attacks Through Membership-Invariant Subspace Training
por: Li, Jiacheng, et al.
Publicado: (2023)
por: Li, Jiacheng, et al.
Publicado: (2023)
Secure Aggregation is Not Private Against Membership Inference Attacks
por: Ngo, Khac-Hoang, et al.
Publicado: (2024)
por: Ngo, Khac-Hoang, et al.
Publicado: (2024)
Rethinking Membership Inference Attacks Against Transfer Learning
por: Wu, Cong, et al.
Publicado: (2025)
por: Wu, Cong, et al.
Publicado: (2025)
MRMMIA: Membership Inference Attacks on Memory in Chat Agents
por: Chen, Kai, et al.
Publicado: (2026)
por: Chen, Kai, et al.
Publicado: (2026)
Low-Cost High-Power Membership Inference Attacks
por: Zarifzadeh, Sajjad, et al.
Publicado: (2023)
por: Zarifzadeh, Sajjad, et al.
Publicado: (2023)
On Membership Inference Attacks in Knowledge Distillation
por: Cui, Ziyao, et al.
Publicado: (2025)
por: Cui, Ziyao, et al.
Publicado: (2025)
Composite Backdoor Attacks Against Large Language Models
por: Huang, Hai, et al.
Publicado: (2023)
por: Huang, Hai, et al.
Publicado: (2023)
Adversarial Search Engine Optimization for Large Language Models
por: Nestaas, Fredrik, et al.
Publicado: (2024)
por: Nestaas, Fredrik, et al.
Publicado: (2024)
Ejemplares similares
-
Membership Inference Attacks Cannot Prove that a Model Was Trained On Your Data
por: Zhang, Jie, et al.
Publicado: (2024) -
Membership Inference Attacks on Sequence Models
por: Rossi, Lorenzo, et al.
Publicado: (2025) -
Membership Inference Attacks and Privacy in Topic Modeling
por: Manzonelli, Nico, et al.
Publicado: (2024) -
DocMIA: Document-Level Membership Inference Attacks against DocVQA Models
por: Nguyen, Khanh, et al.
Publicado: (2025) -
The Hidden Cost of Modeling P(X): Vulnerability to Membership Inference Attacks in Generative Text Classifiers
por: Makroo, Owais, et al.
Publicado: (2025)