Neural Breadcrumbs: Membership Inference Attacks on LLMs Through Hidden State and Attention Pattern Analysis
Fuente:
arXiv
Saved in:
| Main Authors: | Makhija, Disha, Arivazhagan, Manoj Ghuhan, Kumar, Vinayshekhar Bannihatti, Gangadharaiah, Rashmi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Syntax Without Semantics: Teaching Large Language Models to Code in an Unseen Language
by: Kumar, Vinayshekhar Bannihatti, et al.
Published: (2026)
by: Kumar, Vinayshekhar Bannihatti, et al.
Published: (2026)
Probing the Prompt KV Cache: Where It Becomes Dispensable
by: Kumar, Vinayshekhar Bannihatti, et al.
Published: (2026)
by: Kumar, Vinayshekhar Bannihatti, et al.
Published: (2026)
When Facts Change: Probing LLMs on Evolving Knowledge with evolveQA
by: Nakshatri, Nishanth Sridhar, et al.
Published: (2025)
by: Nakshatri, Nishanth Sridhar, et al.
Published: (2025)
FairGen: Controlling Sensitive Attributes for Fair Generations in Diffusion Models via Adaptive Latent Guidance
by: Kang, Mintong, et al.
Published: (2025)
by: Kang, Mintong, et al.
Published: (2025)
Steering Without Breaking: Mechanistically Informed Interventions for Discrete Diffusion Language Models
by: Zhou, Hanhan, et al.
Published: (2026)
by: Zhou, Hanhan, et al.
Published: (2026)
Hyperparameters in Score-Based Membership Inference Attacks
by: Pradhan, Gauri, et al.
Published: (2025)
by: Pradhan, Gauri, et al.
Published: (2025)
Graph-Level Label-Only Membership Inference Attack against Graph Neural Networks
by: Dai, Jiazhu, et al.
Published: (2025)
by: Dai, Jiazhu, et al.
Published: (2025)
Membership Inference Attack with Partial Features
by: Wang, Xurun, et al.
Published: (2025)
by: Wang, Xurun, et al.
Published: (2025)
On Membership Inference Attacks in Knowledge Distillation
by: Cui, Ziyao, et al.
Published: (2025)
by: Cui, Ziyao, et al.
Published: (2025)
Bring Your Own KG: Self-Supervised Program Synthesis for Zero-Shot KGQA
by: Agarwal, Dhruv, et al.
Published: (2023)
by: Agarwal, Dhruv, et al.
Published: (2023)
Membership Inference Attacks on Discrete Diffusion Language Models
by: Kasivelrajan, Shailesh
Published: (2026)
by: Kasivelrajan, Shailesh
Published: (2026)
Generalization and Membership Inference Attack a Practical Perspective
by: Rahmani, Fateme, et al.
Published: (2026)
by: Rahmani, Fateme, et al.
Published: (2026)
Membership Inference Attacks Against Time-Series Models
by: Koren, Noam, et al.
Published: (2024)
by: Koren, Noam, et al.
Published: (2024)
On the Privacy Risks of Spiking Neural Networks: A Membership Inference Analysis
by: Guan, Junyi, et al.
Published: (2025)
by: Guan, Junyi, et al.
Published: (2025)
Fundamental Limits of Membership Inference Attacks on Machine Learning Models
by: Aubinais, Eric, et al.
Published: (2023)
by: Aubinais, Eric, et al.
Published: (2023)
How does Bayesian Sampling help Membership Inference Attacks?
by: Liu, Zhenlong, et al.
Published: (2025)
by: Liu, Zhenlong, et al.
Published: (2025)
Automatic Calibration for Membership Inference Attack on Large Language Models
by: Zade, Saleh Zare, et al.
Published: (2025)
by: Zade, Saleh Zare, et al.
Published: (2025)
Multi-Faceted Evaluation of Tool-Augmented Dialogue Systems
by: Hou, Zhaoyi Joey, et al.
Published: (2025)
by: Hou, Zhaoyi Joey, et al.
Published: (2025)
Membership Inference Attacks Against Fine-tuned Diffusion Language Models
by: Chen, Yuetian, et al.
Published: (2026)
by: Chen, Yuetian, et al.
Published: (2026)
Defending Membership Inference Attacks via Privacy-aware Sparsity Tuning
by: Hu, Qiang, et al.
Published: (2024)
by: Hu, Qiang, et al.
Published: (2024)
GLiRA: Black-Box Membership Inference Attack via Knowledge Distillation
by: Galichin, Andrey V., et al.
Published: (2024)
by: Galichin, Andrey V., et al.
Published: (2024)
AdaMixup: A Dynamic Defense Framework for Membership Inference Attack Mitigation
by: Chen, Ying, et al.
Published: (2025)
by: Chen, Ying, et al.
Published: (2025)
EL-MIA: Quantifying Membership Inference Risks of Sensitive Entities in LLMs
by: Satvaty, Ali, et al.
Published: (2025)
by: Satvaty, Ali, et al.
Published: (2025)
Center-Based Relaxed Learning Against Membership Inference Attacks
by: Fang, Xingli, et al.
Published: (2024)
by: Fang, Xingli, et al.
Published: (2024)
CLMIA: Membership Inference Attacks via Unsupervised Contrastive Learning
by: Chen, Depeng, et al.
Published: (2024)
by: Chen, Depeng, et al.
Published: (2024)
Learning-Based Difficulty Calibration for Enhanced Membership Inference Attacks
by: Shi, Haonan, et al.
Published: (2024)
by: Shi, Haonan, et al.
Published: (2024)
Improved Membership Inference Attacks Against Language Classification Models
by: Shachor, Shlomit, et al.
Published: (2023)
by: Shachor, Shlomit, et al.
Published: (2023)
Graph Transductive Defense: a Two-Stage Defense for Graph Membership Inference Attacks
by: Niu, Peizhi, et al.
Published: (2024)
by: Niu, Peizhi, et al.
Published: (2024)
G-Drift MIA: Membership Inference via Gradient-Induced Feature Drift in LLMs
by: Ranjan, Ravi, et al.
Published: (2026)
by: Ranjan, Ravi, et al.
Published: (2026)
Accuracy-Privacy Trade-off in the Mitigation of Membership Inference Attack in Federated Learning
by: Ahamed, Sayyed Farid, et al.
Published: (2024)
by: Ahamed, Sayyed Farid, et al.
Published: (2024)
Bayesian Inference of Training Dataset Membership
by: Huang, Yongchao
Published: (2025)
by: Huang, Yongchao
Published: (2025)
Membership Inference Attacks on LLM-based Recommender Systems
by: He, Jiajie, et al.
Published: (2025)
by: He, Jiajie, et al.
Published: (2025)
DistortBench: Benchmarking Vision Language Models on Image Distortion Identification
by: Goyal, Divyanshu, et al.
Published: (2026)
by: Goyal, Divyanshu, et al.
Published: (2026)
DCMI: A Differential Calibration Membership Inference Attack Against Retrieval-Augmented Generation
by: Gao, Xinyu, et al.
Published: (2025)
by: Gao, Xinyu, et al.
Published: (2025)
Double-Dip: Thwarting Label-Only Membership Inference Attacks with Transfer Learning and Randomization
by: Rajabi, Arezoo, et al.
Published: (2024)
by: Rajabi, Arezoo, et al.
Published: (2024)
Scaling Up Membership Inference: When and How Attacks Succeed on Large Language Models
by: Puerto, Haritz, et al.
Published: (2024)
by: Puerto, Haritz, et al.
Published: (2024)
Towards Black-Box Membership Inference Attack for Diffusion Models
by: Li, Jingwei, et al.
Published: (2024)
by: Li, Jingwei, et al.
Published: (2024)
Privacy Auditing of Multi-domain Graph Pre-trained Model under Membership Inference Attacks
by: Luo, Jiayi, et al.
Published: (2025)
by: Luo, Jiayi, et al.
Published: (2025)
Winning the MIDST Challenge: New Membership Inference Attacks on Diffusion Models for Tabular Data Synthesis
by: Wu, Xiaoyu, et al.
Published: (2025)
by: Wu, Xiaoyu, et al.
Published: (2025)
Res-MIA: A Training-Free Resolution-Based Membership Inference Attack on Federated Learning Models
by: Zare, Mohammad, et al.
Published: (2026)
by: Zare, Mohammad, et al.
Published: (2026)
Similar Items
-
Syntax Without Semantics: Teaching Large Language Models to Code in an Unseen Language
by: Kumar, Vinayshekhar Bannihatti, et al.
Published: (2026) -
Probing the Prompt KV Cache: Where It Becomes Dispensable
by: Kumar, Vinayshekhar Bannihatti, et al.
Published: (2026) -
When Facts Change: Probing LLMs on Evolving Knowledge with evolveQA
by: Nakshatri, Nishanth Sridhar, et al.
Published: (2025) -
FairGen: Controlling Sensitive Attributes for Fair Generations in Diffusion Models via Adaptive Latent Guidance
by: Kang, Mintong, et al.
Published: (2025) -
Steering Without Breaking: Mechanistically Informed Interventions for Discrete Diffusion Language Models
by: Zhou, Hanhan, et al.
Published: (2026)