Automatic Calibration for Membership Inference Attack on Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zade, Saleh Zare, Qiang, Yao, Zhou, Xiangyu, Zhu, Hui, Roshani, Mohammad Amin, Khanduri, Prashant, Zhu, Dongxiao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Learning to Poison Large Language Models for Downstream Manipulation
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2024)
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2024)
Hijacking Large Language Models via Adversarial In-Context Learning
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2023)
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2023)
Attention Smoothing Is All You Need For Unlearning
von: Zade, Saleh Zare, et al.
Veröffentlicht: (2026)
von: Zade, Saleh Zare, et al.
Veröffentlicht: (2026)
Not All Tokens Are Meant to Be Forgotten
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2025)
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2025)
Fairness-aware Vision Transformer via Debiased Self-Attention
von: Qiang, Yao, et al.
Veröffentlicht: (2023)
von: Qiang, Yao, et al.
Veröffentlicht: (2023)
Generative LLM Powered Conversational AI Application for Personalized Risk Assessment: A Case Study in COVID-19
von: Roshani, Mohammad Amin, et al.
Veröffentlicht: (2024)
von: Roshani, Mohammad Amin, et al.
Veröffentlicht: (2024)
AutoProSAM: Automated Prompting SAM for 3D Multi-Organ Segmentation
von: Li, Chengyin, et al.
Veröffentlicht: (2023)
von: Li, Chengyin, et al.
Veröffentlicht: (2023)
Res-MIA: A Training-Free Resolution-Based Membership Inference Attack on Federated Learning Models
von: Zare, Mohammad, et al.
Veröffentlicht: (2026)
von: Zare, Mohammad, et al.
Veröffentlicht: (2026)
GeoSAM: Fine-tuning SAM with Multi-Modal Prompts for Mobility Infrastructure Segmentation
von: Sultan, Rafi Ibn, et al.
Veröffentlicht: (2023)
von: Sultan, Rafi Ibn, et al.
Veröffentlicht: (2023)
Membership Inference Attacks on Tokenizers of Large Language Models
von: Tong, Meng, et al.
Veröffentlicht: (2025)
von: Tong, Meng, et al.
Veröffentlicht: (2025)
Interpretability-Aware Vision Transformer
von: Qiang, Yao, et al.
Veröffentlicht: (2023)
von: Qiang, Yao, et al.
Veröffentlicht: (2023)
Membership Inference Attacks on Discrete Diffusion Language Models
von: Kasivelrajan, Shailesh
Veröffentlicht: (2026)
von: Kasivelrajan, Shailesh
Veröffentlicht: (2026)
Membership Inference Attacks Against Vision-Language Models
von: Hu, Yuke, et al.
Veröffentlicht: (2025)
von: Hu, Yuke, et al.
Veröffentlicht: (2025)
Learning-Based Difficulty Calibration for Enhanced Membership Inference Attacks
von: Shi, Haonan, et al.
Veröffentlicht: (2024)
von: Shi, Haonan, et al.
Veröffentlicht: (2024)
A Statistical and Multi-Perspective Revisiting of the Membership Inference Attack in Large Language Models
von: Chen, Bowen, et al.
Veröffentlicht: (2024)
von: Chen, Bowen, et al.
Veröffentlicht: (2024)
Generalization and Membership Inference Attack a Practical Perspective
von: Rahmani, Fateme, et al.
Veröffentlicht: (2026)
von: Rahmani, Fateme, et al.
Veröffentlicht: (2026)
Membership Inference Attack with Partial Features
von: Wang, Xurun, et al.
Veröffentlicht: (2025)
von: Wang, Xurun, et al.
Veröffentlicht: (2025)
Membership Inference Attacks against Large Vision-Language Models
von: Li, Zhan, et al.
Veröffentlicht: (2024)
von: Li, Zhan, et al.
Veröffentlicht: (2024)
Membership Inference Attacks against Large Audio Language Models
von: Dong, Jia-Kai, et al.
Veröffentlicht: (2026)
von: Dong, Jia-Kai, et al.
Veröffentlicht: (2026)
Defending Membership Inference Attacks via Privacy-aware Sparsity Tuning
von: Hu, Qiang, et al.
Veröffentlicht: (2024)
von: Hu, Qiang, et al.
Veröffentlicht: (2024)
Membership Inference Attacks Against Fine-tuned Diffusion Language Models
von: Chen, Yuetian, et al.
Veröffentlicht: (2026)
von: Chen, Yuetian, et al.
Veröffentlicht: (2026)
Win-k: Improved Membership Inference Attacks on Small Language Models
von: Arkhmammadova, Roya, et al.
Veröffentlicht: (2025)
von: Arkhmammadova, Roya, et al.
Veröffentlicht: (2025)
Window-based Membership Inference Attacks Against Fine-tuned Large Language Models
von: Chen, Yuetian, et al.
Veröffentlicht: (2026)
von: Chen, Yuetian, et al.
Veröffentlicht: (2026)
Scaling Up Membership Inference: When and How Attacks Succeed on Large Language Models
von: Puerto, Haritz, et al.
Veröffentlicht: (2024)
von: Puerto, Haritz, et al.
Veröffentlicht: (2024)
Improved Membership Inference Attacks Against Language Classification Models
von: Shachor, Shlomit, et al.
Veröffentlicht: (2023)
von: Shachor, Shlomit, et al.
Veröffentlicht: (2023)
Membership Inference Attacks Against Time-Series Models
von: Koren, Noam, et al.
Veröffentlicht: (2024)
von: Koren, Noam, et al.
Veröffentlicht: (2024)
Context-Aware Membership Inference Attacks against Pre-trained Large Language Models
von: Chang, Hongyan, et al.
Veröffentlicht: (2024)
von: Chang, Hongyan, et al.
Veröffentlicht: (2024)
Black-Box Membership Inference Attack for LVLMs via Prior Knowledge-Calibrated Memory Probing
von: Yin, Jinhua, et al.
Veröffentlicht: (2025)
von: Yin, Jinhua, et al.
Veröffentlicht: (2025)
Exploring Membership Inference Vulnerabilities in Clinical Large Language Models
von: Nemecek, Alexander, et al.
Veröffentlicht: (2025)
von: Nemecek, Alexander, et al.
Veröffentlicht: (2025)
DCMI: A Differential Calibration Membership Inference Attack Against Retrieval-Augmented Generation
von: Gao, Xinyu, et al.
Veröffentlicht: (2025)
von: Gao, Xinyu, et al.
Veröffentlicht: (2025)
How does Bayesian Sampling help Membership Inference Attacks?
von: Liu, Zhenlong, et al.
Veröffentlicht: (2025)
von: Liu, Zhenlong, et al.
Veröffentlicht: (2025)
Exposing Privacy Gaps: Membership Inference Attack on Preference Data for LLM Alignment
von: Feng, Qizhang, et al.
Veröffentlicht: (2024)
von: Feng, Qizhang, et al.
Veröffentlicht: (2024)
WalkGPT: Grounded Vision-Language Conversation with Depth-Aware Segmentation for Pedestrian Navigation
von: Sultan, Rafi Ibn, et al.
Veröffentlicht: (2026)
von: Sultan, Rafi Ibn, et al.
Veröffentlicht: (2026)
Vid-SME: Membership Inference Attacks against Large Video Understanding Models
von: Li, Qi, et al.
Veröffentlicht: (2025)
von: Li, Qi, et al.
Veröffentlicht: (2025)
Fundamental Limits of Membership Inference Attacks on Machine Learning Models
von: Aubinais, Eric, et al.
Veröffentlicht: (2023)
von: Aubinais, Eric, et al.
Veröffentlicht: (2023)
Hyperparameters in Score-Based Membership Inference Attacks
von: Pradhan, Gauri, et al.
Veröffentlicht: (2025)
von: Pradhan, Gauri, et al.
Veröffentlicht: (2025)
Membership Inference Attack against Large Language Model-based Recommendation Systems: A New Distillation-based Paradigm
von: Cuihong, Li, et al.
Veröffentlicht: (2025)
von: Cuihong, Li, et al.
Veröffentlicht: (2025)
On Membership Inference Attacks in Knowledge Distillation
von: Cui, Ziyao, et al.
Veröffentlicht: (2025)
von: Cui, Ziyao, et al.
Veröffentlicht: (2025)
Lost in Modality: Evaluating the Effectiveness of Text-Based Membership Inference Attacks on Large Multimodal Models
von: Tong, Ziyi, et al.
Veröffentlicht: (2025)
von: Tong, Ziyi, et al.
Veröffentlicht: (2025)
LeakBoost: Perceptual-Loss-Based Membership Inference Attack
von: Taub, Amit Kravchik, et al.
Veröffentlicht: (2026)
von: Taub, Amit Kravchik, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Learning to Poison Large Language Models for Downstream Manipulation
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2024) -
Hijacking Large Language Models via Adversarial In-Context Learning
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2023) -
Attention Smoothing Is All You Need For Unlearning
von: Zade, Saleh Zare, et al.
Veröffentlicht: (2026) -
Not All Tokens Are Meant to Be Forgotten
von: Zhou, Xiangyu, et al.
Veröffentlicht: (2025) -
Fairness-aware Vision Transformer via Debiased Self-Attention
von: Qiang, Yao, et al.
Veröffentlicht: (2023)