Prompt Stealing Attacks Against Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sha, Zeyang, Zhang, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PRSA: Prompt Stealing Attacks against Real-World Prompt Services
par: Yang, Yong, et autres
Publié: (2024)
par: Yang, Yong, et autres
Publié: (2024)
SOS! Soft Prompt Attack Against Open-Source Large Language Models
par: Yang, Ziqing, et autres
Publié: (2024)
par: Yang, Ziqing, et autres
Publié: (2024)
Composite Backdoor Attacks Against Large Language Models
par: Huang, Hai, et autres
Publié: (2023)
par: Huang, Hai, et autres
Publié: (2023)
Prompt Stealing Attacks Against Text-to-Image Generation Models
par: Shen, Xinyue, et autres
Publié: (2023)
par: Shen, Xinyue, et autres
Publié: (2023)
Is Your Prompt Safe? Investigating Prompt Injection Attacks Against Open-Source LLMs
par: Wang, Jiawen, et autres
Publié: (2025)
par: Wang, Jiawen, et autres
Publié: (2025)
SPML: A DSL for Defending Language Models Against Prompt Attacks
par: Sharma, Reshabh K, et autres
Publié: (2024)
par: Sharma, Reshabh K, et autres
Publié: (2024)
$PD^3F$: A Pluggable and Dynamic DoS-Defense Framework Against Resource Consumption Attacks Targeting Large Language Models
par: Zhang, Yuanhe, et autres
Publié: (2025)
par: Zhang, Yuanhe, et autres
Publié: (2025)
GraphSteal: Structural Knowledge Stealing from Graph RAG via Traversal Reconstruction
par: Gu, Jinze, et autres
Publié: (2026)
par: Gu, Jinze, et autres
Publié: (2026)
Goal-guided Generative Prompt Injection Attack on Large Language Models
par: Zhang, Chong, et autres
Publié: (2024)
par: Zhang, Chong, et autres
Publié: (2024)
Membership Inference Attacks Against In-Context Learning
par: Wen, Rui, et autres
Publié: (2024)
par: Wen, Rui, et autres
Publié: (2024)
An Early Categorization of Prompt Injection Attacks on Large Language Models
par: Rossi, Sippo, et autres
Publié: (2024)
par: Rossi, Sippo, et autres
Publié: (2024)
JailbreakLens: Visual Analysis of Jailbreak Attacks Against Large Language Models
par: Feng, Yingchaojie, et autres
Publié: (2024)
par: Feng, Yingchaojie, et autres
Publié: (2024)
Enhance Robustness of Language Models Against Variation Attack through Graph Integration
par: Xiong, Zi, et autres
Publié: (2024)
par: Xiong, Zi, et autres
Publié: (2024)
Window-based Membership Inference Attacks Against Fine-tuned Large Language Models
par: Chen, Yuetian, et autres
Publié: (2026)
par: Chen, Yuetian, et autres
Publié: (2026)
Denial-of-Service Poisoning Attacks against Large Language Models
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
Securing Large Language Models (LLMs) from Prompt Injection Attacks
par: Suri, Omar Farooq Khan, et autres
Publié: (2025)
par: Suri, Omar Farooq Khan, et autres
Publié: (2025)
Prefix Guidance: A Steering Wheel for Large Language Models to Defend Against Jailbreak Attacks
par: Zhao, Jiawei, et autres
Publié: (2024)
par: Zhao, Jiawei, et autres
Publié: (2024)
SCOUT: A Defense Against Data Poisoning Attacks in Fine-Tuned Language Models
par: Afane, Mohamed, et autres
Publié: (2025)
par: Afane, Mohamed, et autres
Publié: (2025)
Reconstruct Your Previous Conversations! Comprehensively Investigating Privacy Leakage Risks in Conversations with GPT Models
par: Chu, Junjie, et autres
Publié: (2024)
par: Chu, Junjie, et autres
Publié: (2024)
MPMA: Preference Manipulation Attack Against Model Context Protocol
par: Wang, Zihan, et autres
Publié: (2025)
par: Wang, Zihan, et autres
Publié: (2025)
Defending Against Indirect Prompt Injection Attacks With Spotlighting
par: Hines, Keegan, et autres
Publié: (2024)
par: Hines, Keegan, et autres
Publié: (2024)
Privacy in Large Language Models: Attacks, Defenses and Future Directions
par: Li, Haoran, et autres
Publié: (2023)
par: Li, Haoran, et autres
Publié: (2023)
Defending LLM Watermarking Against Spoofing Attacks with Contrastive Representation Learning
par: An, Li, et autres
Publié: (2025)
par: An, Li, et autres
Publié: (2025)
Stealing User Prompts from Mixture of Experts
par: Yona, Itay, et autres
Publié: (2024)
par: Yona, Itay, et autres
Publié: (2024)
Don't Listen To Me: Understanding and Exploring Jailbreak Prompts of Large Language Models
par: Yu, Zhiyuan, et autres
Publié: (2024)
par: Yu, Zhiyuan, et autres
Publié: (2024)
BadLingual: A Novel Lingual-Backdoor Attack against Large Language Models
par: Wang, Zihan, et autres
Publié: (2025)
par: Wang, Zihan, et autres
Publié: (2025)
Why Are My Prompts Leaked? Unraveling Prompt Extraction Threats in Customized Large Language Models
par: Liang, Zi, et autres
Publié: (2024)
par: Liang, Zi, et autres
Publié: (2024)
Now You Hear Me: Audio Narrative Attacks Against Large Audio-Language Models
par: Yu, Ye, et autres
Publié: (2026)
par: Yu, Ye, et autres
Publié: (2026)
Data Defenses Against Large Language Models
par: Agnew, William, et autres
Publié: (2024)
par: Agnew, William, et autres
Publié: (2024)
Teach LLMs to Phish: Stealing Private Information from Language Models
par: Panda, Ashwinee, et autres
Publié: (2024)
par: Panda, Ashwinee, et autres
Publié: (2024)
You Can't Steal Nothing: Mitigating Prompt Leakages in LLMs via System Vectors
par: Cao, Bochuan, et autres
Publié: (2025)
par: Cao, Bochuan, et autres
Publié: (2025)
Harnessing Task Overload for Scalable Jailbreak Attacks on Large Language Models
par: Dong, Yiting, et autres
Publié: (2024)
par: Dong, Yiting, et autres
Publié: (2024)
SafeReview: Defending LLM-based Review Systems Against Adversarial Hidden Prompts
par: Xin, Yuan, et autres
Publié: (2026)
par: Xin, Yuan, et autres
Publié: (2026)
Against All Odds: Overcoming Typology, Script, and Language Confusion in Multilingual Embedding Inversion Attacks
par: Chen, Yiyi, et autres
Publié: (2024)
par: Chen, Yiyi, et autres
Publié: (2024)
Large Language Models are Good Attackers: Efficient and Stealthy Textual Backdoor Attacks
par: Li, Ziqiang, et autres
Publié: (2024)
par: Li, Ziqiang, et autres
Publié: (2024)
Breaking Down the Defenses: A Comparative Survey of Attacks on Large Language Models
par: Chowdhury, Arijit Ghosh, et autres
Publié: (2024)
par: Chowdhury, Arijit Ghosh, et autres
Publié: (2024)
PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails
par: Mangaokar, Neal, et autres
Publié: (2024)
par: Mangaokar, Neal, et autres
Publié: (2024)
PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts
par: Zhu, Kaijie, et autres
Publié: (2023)
par: Zhu, Kaijie, et autres
Publié: (2023)
Jailbreak Attacks and Defenses Against Large Language Models: A Survey
par: Yi, Sibo, et autres
Publié: (2024)
par: Yi, Sibo, et autres
Publié: (2024)
BadApex: Backdoor Attack Based on Adaptive Optimization Mechanism of Black-box Large Language Models
par: Wu, Zhengxian, et autres
Publié: (2025)
par: Wu, Zhengxian, et autres
Publié: (2025)
Documents similaires
-
PRSA: Prompt Stealing Attacks against Real-World Prompt Services
par: Yang, Yong, et autres
Publié: (2024) -
SOS! Soft Prompt Attack Against Open-Source Large Language Models
par: Yang, Ziqing, et autres
Publié: (2024) -
Composite Backdoor Attacks Against Large Language Models
par: Huang, Hai, et autres
Publié: (2023) -
Prompt Stealing Attacks Against Text-to-Image Generation Models
par: Shen, Xinyue, et autres
Publié: (2023) -
Is Your Prompt Safe? Investigating Prompt Injection Attacks Against Open-Source LLMs
par: Wang, Jiawen, et autres
Publié: (2025)