Membership Inference Attacks Against In-Context Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wen, Rui, Li, Zheng, Backes, Michael, Zhang, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models
di: Chen, Zeyuan, et al.
Pubblicazione: (2026)
di: Chen, Zeyuan, et al.
Pubblicazione: (2026)
ICLGuard: Controlling In-Context Learning Behavior for Applicability Authorization
di: Si, Wai Man, et al.
Pubblicazione: (2024)
di: Si, Wai Man, et al.
Pubblicazione: (2024)
SOS! Soft Prompt Attack Against Open-Source Large Language Models
di: Yang, Ziqing, et al.
Pubblicazione: (2024)
di: Yang, Ziqing, et al.
Pubblicazione: (2024)
Window-based Membership Inference Attacks Against Fine-tuned Large Language Models
di: Chen, Yuetian, et al.
Pubblicazione: (2026)
di: Chen, Yuetian, et al.
Pubblicazione: (2026)
Composite Backdoor Attacks Against Large Language Models
di: Huang, Hai, et al.
Pubblicazione: (2023)
di: Huang, Hai, et al.
Pubblicazione: (2023)
Membership Inference Attack Against Masked Image Modeling
di: Li, Zheng, et al.
Pubblicazione: (2024)
di: Li, Zheng, et al.
Pubblicazione: (2024)
MPMA: Preference Manipulation Attack Against Model Context Protocol
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
Membership Inference Attacks and Privacy in Topic Modeling
di: Manzonelli, Nico, et al.
Pubblicazione: (2024)
di: Manzonelli, Nico, et al.
Pubblicazione: (2024)
LoRA-Leak: Membership Inference Attacks Against LoRA Fine-tuned Language Models
di: Ran, Delong, et al.
Pubblicazione: (2025)
di: Ran, Delong, et al.
Pubblicazione: (2025)
AttackPilot: Autonomous Inference Attacks Against ML Services With LLM-Based Agents
di: Wu, Yixin, et al.
Pubblicazione: (2025)
di: Wu, Yixin, et al.
Pubblicazione: (2025)
Towards Label-Only Membership Inference Attack against Pre-trained Large Language Models
di: He, Yu, et al.
Pubblicazione: (2025)
di: He, Yu, et al.
Pubblicazione: (2025)
Securing Genomic Data Against Inference Attacks in Federated Learning Environments
di: Pathade, Chetan, et al.
Pubblicazione: (2025)
di: Pathade, Chetan, et al.
Pubblicazione: (2025)
Blind Baselines Beat Membership Inference Attacks for Foundation Models
di: Das, Debeshee, et al.
Pubblicazione: (2024)
di: Das, Debeshee, et al.
Pubblicazione: (2024)
Tab-MIA: A Benchmark Dataset for Membership Inference Attacks on Tabular Data in LLMs
di: German, Eyal, et al.
Pubblicazione: (2025)
di: German, Eyal, et al.
Pubblicazione: (2025)
JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs
di: Chu, Junjie, et al.
Pubblicazione: (2024)
di: Chu, Junjie, et al.
Pubblicazione: (2024)
Defending LLM Watermarking Against Spoofing Attacks with Contrastive Representation Learning
di: An, Li, et al.
Pubblicazione: (2025)
di: An, Li, et al.
Pubblicazione: (2025)
BadBone: Backdoor Attacks Against Backbone Models in Visual Prompt Learning
di: Yang, Ziqing, et al.
Pubblicazione: (2026)
di: Yang, Ziqing, et al.
Pubblicazione: (2026)
Tag&Tab: Pretraining Data Detection in Large Language Models Using Keyword-Based Membership Inference Attack
di: Antebi, Sagiv, et al.
Pubblicazione: (2025)
di: Antebi, Sagiv, et al.
Pubblicazione: (2025)
SoK: Data Reconstruction Attacks Against Machine Learning Models: Definition, Metrics, and Benchmark
di: Wen, Rui, et al.
Pubblicazione: (2025)
di: Wen, Rui, et al.
Pubblicazione: (2025)
Membership Inference Attacks Against Vision-Language Models
di: Hu, Yuke, et al.
Pubblicazione: (2025)
di: Hu, Yuke, et al.
Pubblicazione: (2025)
Prompt Stealing Attacks Against Large Language Models
di: Sha, Zeyang, et al.
Pubblicazione: (2024)
di: Sha, Zeyang, et al.
Pubblicazione: (2024)
VidLeaks: Membership Inference Attacks Against Text-to-Video Models
di: Wang, Li, et al.
Pubblicazione: (2026)
di: Wang, Li, et al.
Pubblicazione: (2026)
Context-Aware Membership Inference Attacks against Pre-trained Large Language Models
di: Chang, Hongyan, et al.
Pubblicazione: (2024)
di: Chang, Hongyan, et al.
Pubblicazione: (2024)
SafeReview: Defending LLM-based Review Systems Against Adversarial Hidden Prompts
di: Xin, Yuan, et al.
Pubblicazione: (2026)
di: Xin, Yuan, et al.
Pubblicazione: (2026)
Fast-MIA: Efficient and Scalable Membership Inference for LLMs
di: Takahashi, Hiromu, et al.
Pubblicazione: (2025)
di: Takahashi, Hiromu, et al.
Pubblicazione: (2025)
SoK: Membership Inference Attacks on LLMs are Rushing Nowhere (and How to Fix It)
di: Meeus, Matthieu, et al.
Pubblicazione: (2024)
di: Meeus, Matthieu, et al.
Pubblicazione: (2024)
Rethinking Membership Inference Attacks Against Transfer Learning
di: Wu, Cong, et al.
Pubblicazione: (2025)
di: Wu, Cong, et al.
Pubblicazione: (2025)
DocMIA: Document-Level Membership Inference Attacks against DocVQA Models
di: Nguyen, Khanh, et al.
Pubblicazione: (2025)
di: Nguyen, Khanh, et al.
Pubblicazione: (2025)
The Hidden Cost of Modeling P(X): Vulnerability to Membership Inference Attacks in Generative Text Classifiers
di: Makroo, Owais, et al.
Pubblicazione: (2025)
di: Makroo, Owais, et al.
Pubblicazione: (2025)
Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration
di: Fu, Wenjie, et al.
Pubblicazione: (2023)
di: Fu, Wenjie, et al.
Pubblicazione: (2023)
Instruction Backdoor Attacks Against Customized LLMs
di: Zhang, Rui, et al.
Pubblicazione: (2024)
di: Zhang, Rui, et al.
Pubblicazione: (2024)
Bayes-Nash Generative Privacy Against Membership Inference Attacks
di: Zhang, Tao, et al.
Pubblicazione: (2024)
di: Zhang, Tao, et al.
Pubblicazione: (2024)
Membership Inference Attacks Against Video Large Language Models
di: Song, Wei, et al.
Pubblicazione: (2026)
di: Song, Wei, et al.
Pubblicazione: (2026)
The Art of (Mis)alignment: How Fine-Tuning Methods Effectively Misalign and Realign LLMs in Post-Training
di: Zhang, Rui, et al.
Pubblicazione: (2026)
di: Zhang, Rui, et al.
Pubblicazione: (2026)
Understanding Data Importance in Machine Learning Attacks: Does Valuable Data Pose Greater Harm?
di: Wen, Rui, et al.
Pubblicazione: (2024)
di: Wen, Rui, et al.
Pubblicazione: (2024)
Iron Sharpens Iron: Defending Against Attacks in Machine-Generated Text Detection with Adversarial Training
di: Li, Yuanfan, et al.
Pubblicazione: (2025)
di: Li, Yuanfan, et al.
Pubblicazione: (2025)
Auditing Data Membership in Reinforcement Learning With Verifiable Rewards
di: Liu, Yule, et al.
Pubblicazione: (2025)
di: Liu, Yule, et al.
Pubblicazione: (2025)
LLM Anonymization Against Agentic Re-Identification
di: Li, Ziwen, et al.
Pubblicazione: (2026)
di: Li, Ziwen, et al.
Pubblicazione: (2026)
LingoLoop Attack: Trapping MLLMs via Linguistic Context and State Entrapment into Endless Loops
di: Fu, Jiyuan, et al.
Pubblicazione: (2025)
di: Fu, Jiyuan, et al.
Pubblicazione: (2025)
MIST: Defending Against Membership Inference Attacks Through Membership-Invariant Subspace Training
di: Li, Jiacheng, et al.
Pubblicazione: (2023)
di: Li, Jiacheng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models
di: Chen, Zeyuan, et al.
Pubblicazione: (2026) -
ICLGuard: Controlling In-Context Learning Behavior for Applicability Authorization
di: Si, Wai Man, et al.
Pubblicazione: (2024) -
SOS! Soft Prompt Attack Against Open-Source Large Language Models
di: Yang, Ziqing, et al.
Pubblicazione: (2024) -
Window-based Membership Inference Attacks Against Fine-tuned Large Language Models
di: Chen, Yuetian, et al.
Pubblicazione: (2026) -
Composite Backdoor Attacks Against Large Language Models
di: Huang, Hai, et al.
Pubblicazione: (2023)