Exposing Privacy Gaps: Membership Inference Attack on Preference Data for LLM Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Feng, Qizhang, Kasa, Siva Rajesh, Kasa, Santhosh Kumar, Yun, Hyokun, Teo, Choon Hui, Bodapati, Sravan Babu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Hidden Cost of Modeling P(X): Vulnerability to Membership Inference Attacks in Generative Text Classifiers
par: Makroo, Owais, et autres
Publié: (2025)
par: Makroo, Owais, et autres
Publié: (2025)
Mixture-Models: a one-stop Python Library for Model-based Clustering using various Mixture Models
par: Kasa, Siva Rajesh, et autres
Publié: (2024)
par: Kasa, Siva Rajesh, et autres
Publié: (2024)
DIVERSED: Relaxed Speculative Decoding via Dynamic Ensemble Verification
par: Wang, Ziyi, et autres
Publié: (2026)
par: Wang, Ziyi, et autres
Publié: (2026)
Approximating innovation potential with neurofuzzy robust model
par: Richard Kasa
Publié: (2015)
par: Richard Kasa
Publié: (2015)
Generative or Discriminative? Revisiting Text Classification in the Era of Transformers
par: Kasa, Siva Rajesh, et autres
Publié: (2025)
par: Kasa, Siva Rajesh, et autres
Publié: (2025)
Machine Learning‐Based Surrogate Model Development for the Estimation of State‐of‐Charge and Minimization of Charging Time for Batteries of Lithium‐Ion in Electric Vehicles
par: Tekalign Kasa Guya, et autres
Publié: (2025)
par: Tekalign Kasa Guya, et autres
Publié: (2025)
Membership Inference Attacks Expose Participation Privacy in ECG Foundation Encoders
par: Wang, Ziyu, et autres
Publié: (2026)
par: Wang, Ziyu, et autres
Publié: (2026)
Agronomic performance and dry matter yield stability of Napier grass (Pennisetum purpureum) genotypes in Southwestern Ethiopia
par: Tesfa Mossie, et autres
Publié: (2024)
par: Tesfa Mossie, et autres
Publié: (2024)
Exploring Ordinality in Text Classification: A Comparative Study of Explicit and Implicit Techniques
par: Kasa, Siva Rajesh, et autres
Publié: (2024)
par: Kasa, Siva Rajesh, et autres
Publié: (2024)
Membership Inference Attacks and Privacy in Topic Modeling
par: Manzonelli, Nico, et autres
Publié: (2024)
par: Manzonelli, Nico, et autres
Publié: (2024)
Adapting Prediction Sets to Distribution Shifts Without Labels
par: Kasa, Kevin, et autres
Publié: (2024)
par: Kasa, Kevin, et autres
Publié: (2024)
Privacy-Preserving Low-Rank Adaptation against Membership Inference Attacks for Latent Diffusion Models
par: Luo, Zihao, et autres
Publié: (2024)
par: Luo, Zihao, et autres
Publié: (2024)
Productive Performance of Lactating Crossbred Dairy Cows Fed with Wheat Straw‐Based Densified Complete Feed Block
par: Kasa Biratu, et autres
Publié: (2024)
par: Kasa Biratu, et autres
Publié: (2024)
Development of Spraying Based Liquid Phase Microextraction Method for the Preconcentration of Flibanserin From Urine Samples via GC–MS Analyses
par: Nursu Aylin Kasa, et autres
Publié: (2025)
par: Nursu Aylin Kasa, et autres
Publié: (2025)
On the Relationship Between Frailty, Nutritional Status, Depression and Quality of Life Among Older People
par: Ayele Semachew Kasa, et autres
Publié: (2024)
par: Ayele Semachew Kasa, et autres
Publié: (2024)
Evaluation of a quantitative radiographic technique for differentiating normal and unilateral luxation of sacroiliac joints in cats: a pilot study analysis
par: T. Kasa, et autres
Publié: (2025)
par: T. Kasa, et autres
Publié: (2025)
Exposing the Vulnerability of Decentralized Learning to Membership Inference Attacks Through the Lens of Graph Mixing
par: Touat, Ousmane, et autres
Publié: (2024)
par: Touat, Ousmane, et autres
Publié: (2024)
Bayes-Nash Generative Privacy Against Membership Inference Attacks
par: Zhang, Tao, et autres
Publié: (2024)
par: Zhang, Tao, et autres
Publié: (2024)
Privacy Leaks by Adversaries: Adversarial Iterations for Membership Inference Attack
par: Xue, Jing, et autres
Publié: (2025)
par: Xue, Jing, et autres
Publié: (2025)
Membership Inference Attacks as Privacy Tools: Reliability, Disparity and Ensemble
par: Wang, Zhiqi, et autres
Publié: (2025)
par: Wang, Zhiqi, et autres
Publié: (2025)
PHARMACOLOGY AND IT'S ADVERSE REACTIONS OF IMMUNETHERAPY DRUGS IN ONCOLOGY
par: Lella Janaki*, Nali Mallikarjuna Rao, Kasa Aswini, Jonnalagadda Pravallika, Maradani Sirisha
Publié: (2025)
par: Lella Janaki*, Nali Mallikarjuna Rao, Kasa Aswini, Jonnalagadda Pravallika, Maradani Sirisha
Publié: (2025)
VoxGuard: Evaluating User and Attribute Privacy in Speech via Membership Inference Attacks
par: Tsaprazlis, Efthymios, et autres
Publié: (2025)
par: Tsaprazlis, Efthymios, et autres
Publié: (2025)
SeRA: Self-Reviewing and Alignment of Large Language Models using Implicit Reward Margins
par: Ko, Jongwoo, et autres
Publié: (2024)
par: Ko, Jongwoo, et autres
Publié: (2024)
Membership Inference Attacks on LLM-based Recommender Systems
par: He, Jiajie, et autres
Publié: (2025)
par: He, Jiajie, et autres
Publié: (2025)
MCMC for Bayesian estimation of Differential Privacy from Membership Inference Attacks
par: Yildirim, Ceren, et autres
Publié: (2025)
par: Yildirim, Ceren, et autres
Publié: (2025)
Defending Membership Inference Attacks via Privacy-aware Sparsity Tuning
par: Hu, Qiang, et autres
Publié: (2024)
par: Hu, Qiang, et autres
Publié: (2024)
A Critical Review on the Effectiveness and Privacy Threats of Membership Inference Attacks
par: Jebreel, Najeeb, et autres
Publié: (2026)
par: Jebreel, Najeeb, et autres
Publié: (2026)
Safeguarding Privacy of Retrieval Data against Membership Inference Attacks: Is This Query Too Close to Home?
par: Choi, Yujin, et autres
Publié: (2025)
par: Choi, Yujin, et autres
Publié: (2025)
Enantiomeric Resolution of Odevixibat via Immobilized Polysaccharide Columns: Impact of NP, RP, and PO Modes on LC–MS‐Compatible Method Design
par: S. R. Krishna Murthy Kasa, et autres
Publié: (2025)
par: S. R. Krishna Murthy Kasa, et autres
Publié: (2025)
TAMIS: Tailored Membership Inference Attacks on Synthetic Data
par: Andrey, Paul, et autres
Publié: (2025)
par: Andrey, Paul, et autres
Publié: (2025)
Accuracy-Privacy Trade-off in the Mitigation of Membership Inference Attack in Federated Learning
par: Ahamed, Sayyed Farid, et autres
Publié: (2024)
par: Ahamed, Sayyed Farid, et autres
Publié: (2024)
Ensemble Privacy Defense for Knowledge-Intensive LLMs against Membership Inference Attacks
par: Fu, Haowei, et autres
Publié: (2025)
par: Fu, Haowei, et autres
Publié: (2025)
Range Membership Inference Attacks
par: Tao, Jiashu, et autres
Publié: (2024)
par: Tao, Jiashu, et autres
Publié: (2024)
Imitative Membership Inference Attack
par: Du, Yuntao, et autres
Publié: (2025)
par: Du, Yuntao, et autres
Publié: (2025)
Sequential Membership Inference Attacks
par: Michel, Thomas, et autres
Publié: (2026)
par: Michel, Thomas, et autres
Publié: (2026)
SOFT: Selective Data Obfuscation for Protecting LLM Fine-tuning against Membership Inference Attacks
par: Zhang, Kaiyuan, et autres
Publié: (2025)
par: Zhang, Kaiyuan, et autres
Publié: (2025)
Leveraging Membership Inference Attacks for Privacy Measurement in Federated Learning for Remote Sensing Images
par: Duong, Anh-Kiet, et autres
Publié: (2026)
par: Duong, Anh-Kiet, et autres
Publié: (2026)
AttenMIA: LLM Membership Inference Attack through Attention Signals
par: Zaree, Pedram, et autres
Publié: (2026)
par: Zaree, Pedram, et autres
Publié: (2026)
Mitigating Privacy Risk in Membership Inference by Convex-Concave Loss
par: Liu, Zhenlong, et autres
Publié: (2024)
par: Liu, Zhenlong, et autres
Publié: (2024)
Membership Inference Attacks on Sequence Models
par: Rossi, Lorenzo, et autres
Publié: (2025)
par: Rossi, Lorenzo, et autres
Publié: (2025)
Documents similaires
-
The Hidden Cost of Modeling P(X): Vulnerability to Membership Inference Attacks in Generative Text Classifiers
par: Makroo, Owais, et autres
Publié: (2025) -
Mixture-Models: a one-stop Python Library for Model-based Clustering using various Mixture Models
par: Kasa, Siva Rajesh, et autres
Publié: (2024) -
DIVERSED: Relaxed Speculative Decoding via Dynamic Ensemble Verification
par: Wang, Ziyi, et autres
Publié: (2026) -
Approximating innovation potential with neurofuzzy robust model
par: Richard Kasa
Publié: (2015) -
Generative or Discriminative? Revisiting Text Classification in the Era of Transformers
par: Kasa, Siva Rajesh, et autres
Publié: (2025)