SoK: Reducing the Vulnerability of Fine-tuned Language Models to Membership Inference Attacks
Fuente:
arXiv
Salvato in:
| Autori principali: | Amit, Guy, Goldsteen, Abigail, Farkash, Ariel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improved Membership Inference Attacks Against Language Classification Models
di: Shachor, Shlomit, et al.
Pubblicazione: (2023)
di: Shachor, Shlomit, et al.
Pubblicazione: (2023)
Is My Data in Your Retrieval Database? Membership Inference Attacks Against Retrieval Augmented Generation
di: Anderson, Maya, et al.
Pubblicazione: (2024)
di: Anderson, Maya, et al.
Pubblicazione: (2024)
Membership Inference Attacks Against Time-Series Models
di: Koren, Noam, et al.
Pubblicazione: (2024)
di: Koren, Noam, et al.
Pubblicazione: (2024)
SoK: Membership Inference Attacks on LLMs are Rushing Nowhere (and How to Fix It)
di: Meeus, Matthieu, et al.
Pubblicazione: (2024)
di: Meeus, Matthieu, et al.
Pubblicazione: (2024)
SoK: Machine Unlearning for Large Language Models
di: Ren, Jie, et al.
Pubblicazione: (2025)
di: Ren, Jie, et al.
Pubblicazione: (2025)
SoK: Data Reconstruction Attacks Against Machine Learning Models: Definition, Metrics, and Benchmark
di: Wen, Rui, et al.
Pubblicazione: (2025)
di: Wen, Rui, et al.
Pubblicazione: (2025)
SoK: Data Minimization in Machine Learning
di: Staab, Robin, et al.
Pubblicazione: (2025)
di: Staab, Robin, et al.
Pubblicazione: (2025)
SoK: Benchmarking Poisoning Attacks and Defenses in Federated Learning
di: Zhang, Heyi, et al.
Pubblicazione: (2025)
di: Zhang, Heyi, et al.
Pubblicazione: (2025)
Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration
di: Fu, Wenjie, et al.
Pubblicazione: (2023)
di: Fu, Wenjie, et al.
Pubblicazione: (2023)
SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity
di: McFadden, Shae, et al.
Pubblicazione: (2026)
di: McFadden, Shae, et al.
Pubblicazione: (2026)
SoK: What Makes Private Learning Unfair?
di: Yao, Kai, et al.
Pubblicazione: (2025)
di: Yao, Kai, et al.
Pubblicazione: (2025)
SoK: Unlearnability and Unlearning for Model Dememorization
di: Zhang, Mengying, et al.
Pubblicazione: (2026)
di: Zhang, Mengying, et al.
Pubblicazione: (2026)
SoK: Dataset Copyright Auditing in Machine Learning Systems
di: Du, Linkang, et al.
Pubblicazione: (2024)
di: Du, Linkang, et al.
Pubblicazione: (2024)
SoK: Can Trajectory Generation Combine Privacy and Utility?
di: Buchholz, Erik, et al.
Pubblicazione: (2024)
di: Buchholz, Erik, et al.
Pubblicazione: (2024)
Membership Inference Attacks on Sequence Models
di: Rossi, Lorenzo, et al.
Pubblicazione: (2025)
di: Rossi, Lorenzo, et al.
Pubblicazione: (2025)
In-Context Probing for Membership Inference in Fine-Tuned Language Models
di: Lu, Zhexi, et al.
Pubblicazione: (2025)
di: Lu, Zhexi, et al.
Pubblicazione: (2025)
SoK: Unintended Interactions among Machine Learning Defenses and Risks
di: Duddu, Vasisht, et al.
Pubblicazione: (2023)
di: Duddu, Vasisht, et al.
Pubblicazione: (2023)
SoK: Verifiable Cross-Silo FL
di: Korneev, Aleksei, et al.
Pubblicazione: (2024)
di: Korneev, Aleksei, et al.
Pubblicazione: (2024)
SoK: Watermarking for AI-Generated Content
di: Zhao, Xuandong, et al.
Pubblicazione: (2024)
di: Zhao, Xuandong, et al.
Pubblicazione: (2024)
Imitative Membership Inference Attack
di: Du, Yuntao, et al.
Pubblicazione: (2025)
di: Du, Yuntao, et al.
Pubblicazione: (2025)
On Reliability of Efficient Membership Inference Vulnerability Evaluation
di: Jälkö, Joonas, et al.
Pubblicazione: (2026)
di: Jälkö, Joonas, et al.
Pubblicazione: (2026)
SoK: Realistic Adversarial Attacks and Defenses for Intelligent Network Intrusion Detection
di: Vitorino, João, et al.
Pubblicazione: (2023)
di: Vitorino, João, et al.
Pubblicazione: (2023)
SoK: Analyzing Adversarial Examples: A Framework to Study Adversary Knowledge
di: Fenaux, Lucas, et al.
Pubblicazione: (2024)
di: Fenaux, Lucas, et al.
Pubblicazione: (2024)
SoK: Privacy-aware LLM in Healthcare: Threat Model, Privacy Techniques, Challenges and Recommendations
di: Tahera, Mohoshin Ara, et al.
Pubblicazione: (2026)
di: Tahera, Mohoshin Ara, et al.
Pubblicazione: (2026)
SoK: Pitfalls in Evaluating Black-Box Attacks
di: Suya, Fnu, et al.
Pubblicazione: (2023)
di: Suya, Fnu, et al.
Pubblicazione: (2023)
SoK: Security and Privacy Risks of Healthcare AI
di: Chang, Yuanhaur, et al.
Pubblicazione: (2024)
di: Chang, Yuanhaur, et al.
Pubblicazione: (2024)
Membership Inference Attacks for Unseen Classes
di: Thaker, Pratiksha, et al.
Pubblicazione: (2025)
di: Thaker, Pratiksha, et al.
Pubblicazione: (2025)
Membership Inference Attacks Beyond Overfitting
di: Khalil, Mona, et al.
Pubblicazione: (2025)
di: Khalil, Mona, et al.
Pubblicazione: (2025)
Cascading and Proxy Membership Inference Attacks
di: Du, Yuntao, et al.
Pubblicazione: (2025)
di: Du, Yuntao, et al.
Pubblicazione: (2025)
SoK: Privacy Preserving Machine Learning using Functional Encryption: Opportunities and Challenges
di: Panzade, Prajwal, et al.
Pubblicazione: (2022)
di: Panzade, Prajwal, et al.
Pubblicazione: (2022)
Mitigating Membership Inference Vulnerability in Personalized Federated Learning
di: Jung, Kangsoo, et al.
Pubblicazione: (2025)
di: Jung, Kangsoo, et al.
Pubblicazione: (2025)
SoK: On the Offensive Potential of AI
di: Schröer, Saskia Laura, et al.
Pubblicazione: (2024)
di: Schröer, Saskia Laura, et al.
Pubblicazione: (2024)
SoK: Understanding Vulnerabilities in the Large Language Model Supply Chain
di: Wang, Shenao, et al.
Pubblicazione: (2025)
di: Wang, Shenao, et al.
Pubblicazione: (2025)
Membership Inference Attacks on Large-Scale Models: A Survey
di: Wu, Hengyu, et al.
Pubblicazione: (2025)
di: Wu, Hengyu, et al.
Pubblicazione: (2025)
Ensembling Membership Inference Attacks Against Tabular Generative Models
di: Ward, Joshua, et al.
Pubblicazione: (2025)
di: Ward, Joshua, et al.
Pubblicazione: (2025)
Practical Bayes-Optimal Membership Inference Attacks
di: Lassila, Marcus, et al.
Pubblicazione: (2025)
di: Lassila, Marcus, et al.
Pubblicazione: (2025)
SoK: Blockchain-Based Decentralized AI (DeAI)
di: Lui, Elizabeth, et al.
Pubblicazione: (2024)
di: Lui, Elizabeth, et al.
Pubblicazione: (2024)
SoK: Enhancing Cryptographic Collaborative Learning with Differential Privacy
di: Capano, Francesco, et al.
Pubblicazione: (2026)
di: Capano, Francesco, et al.
Pubblicazione: (2026)
The Hidden Cost of Modeling P(X): Vulnerability to Membership Inference Attacks in Generative Text Classifiers
di: Makroo, Owais, et al.
Pubblicazione: (2025)
di: Makroo, Owais, et al.
Pubblicazione: (2025)
MIST: Defending Against Membership Inference Attacks Through Membership-Invariant Subspace Training
di: Li, Jiacheng, et al.
Pubblicazione: (2023)
di: Li, Jiacheng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Improved Membership Inference Attacks Against Language Classification Models
di: Shachor, Shlomit, et al.
Pubblicazione: (2023) -
Is My Data in Your Retrieval Database? Membership Inference Attacks Against Retrieval Augmented Generation
di: Anderson, Maya, et al.
Pubblicazione: (2024) -
Membership Inference Attacks Against Time-Series Models
di: Koren, Noam, et al.
Pubblicazione: (2024) -
SoK: Membership Inference Attacks on LLMs are Rushing Nowhere (and How to Fix It)
di: Meeus, Matthieu, et al.
Pubblicazione: (2024) -
SoK: Machine Unlearning for Large Language Models
di: Ren, Jie, et al.
Pubblicazione: (2025)