Prompt Inversion Attack against Collaborative Inference of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qu, Wenjie, Zhou, Yuguang, Wu, Yongji, Xiao, Tingsong, Yuan, Binhang, Li, Yiming, Zhang, Jiaheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Effective Prompt Stealing Attack against Text-to-Image Diffusion Models
par: Zhao, Shiqian, et autres
Publié: (2025)
par: Zhao, Shiqian, et autres
Publié: (2025)
RepoMark: A Data-Usage Auditing Framework for Code Large Language Models
par: Qu, Wenjie, et autres
Publié: (2025)
par: Qu, Wenjie, et autres
Publié: (2025)
Prompt Inference Attack on Distributed Large Language Model Inference Frameworks
par: Luo, Xinjian, et autres
Publié: (2025)
par: Luo, Xinjian, et autres
Publié: (2025)
BitHydra: Towards Bit-flip Inference Cost Attack against Large Language Models
par: Yan, Xiaobei, et autres
Publié: (2025)
par: Yan, Xiaobei, et autres
Publié: (2025)
What Hard Tokens Reveal: Exploiting Low-confidence Tokens for Membership Inference Attacks against Large Language Models
par: Jawad, Md Tasnim, et autres
Publié: (2026)
par: Jawad, Md Tasnim, et autres
Publié: (2026)
External Data Extraction Attacks against Retrieval-Augmented Large Language Models
par: He, Yu, et autres
Publié: (2025)
par: He, Yu, et autres
Publié: (2025)
Towards Label-Only Membership Inference Attack against Pre-trained Large Language Models
par: He, Yu, et autres
Publié: (2025)
par: He, Yu, et autres
Publié: (2025)
Model Inversion Attack against Federated Unlearning
par: Zhou, Lei, et autres
Publié: (2025)
par: Zhou, Lei, et autres
Publié: (2025)
Inhibitory Attacks on Backdoor-based Fingerprinting for Large Language Models
par: Fu, Hang, et autres
Publié: (2026)
par: Fu, Hang, et autres
Publié: (2026)
AgentTypo: Adaptive Typographic Prompt Injection Attacks against Black-box Multimodal Agents
par: Li, Yanjie, et autres
Publié: (2025)
par: Li, Yanjie, et autres
Publié: (2025)
PLeak: Prompt Leaking Attacks against Large Language Model Applications
par: Hui, Bo, et autres
Publié: (2024)
par: Hui, Bo, et autres
Publié: (2024)
System Prompt Extraction Attacks and Defenses in Large Language Models
par: Das, Badhan Chandra, et autres
Publié: (2025)
par: Das, Badhan Chandra, et autres
Publié: (2025)
How Breakable Is Privacy: Probing and Resisting Model Inversion Attacks in Collaborative Inference
par: Liu, Rongke, et autres
Publié: (2025)
par: Liu, Rongke, et autres
Publié: (2025)
Jailbreaking Prompt Attack: A Controllable Adversarial Attack against Diffusion Models
par: Ma, Jiachen, et autres
Publié: (2024)
par: Ma, Jiachen, et autres
Publié: (2024)
Ensembler: Protect Collaborative Inference Privacy from Model Inversion Attack via Selective Ensemble
par: Liu, Dancheng, et autres
Publié: (2024)
par: Liu, Dancheng, et autres
Publié: (2024)
Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration
par: Fu, Wenjie, et autres
Publié: (2023)
par: Fu, Wenjie, et autres
Publié: (2023)
Stealing Training Data from Large Language Models in Decentralized Training through Activation Inversion Attack
par: Dai, Chenxi, et autres
Publié: (2025)
par: Dai, Chenxi, et autres
Publié: (2025)
Counterfactual Explainable Incremental Prompt Attack Analysis on Large Language Models
par: Shu, Dong, et autres
Publié: (2024)
par: Shu, Dong, et autres
Publié: (2024)
System-Level Defense against Indirect Prompt Injection Attacks: An Information Flow Control Perspective
par: Wu, Fangzhou, et autres
Publié: (2024)
par: Wu, Fangzhou, et autres
Publié: (2024)
Image Corruption-Inspired Membership Inference Attacks against Large Vision-Language Models
par: Wu, Zongyu, et autres
Publié: (2025)
par: Wu, Zongyu, et autres
Publié: (2025)
Membership Inference Attacks Against Video Large Language Models
par: Song, Wei, et autres
Publié: (2026)
par: Song, Wei, et autres
Publié: (2026)
DMark: Order-Agnostic Watermarking for Diffusion Large Language Models
par: Wu, Linyu, et autres
Publié: (2025)
par: Wu, Linyu, et autres
Publié: (2025)
Cachemir: Fully Homomorphic Encrypted Inference of Generative Large Language Model with KV Cache
par: Yu, Ye, et autres
Publié: (2026)
par: Yu, Ye, et autres
Publié: (2026)
White-box Membership Inference Attacks against Diffusion Models
par: Pang, Yan, et autres
Publié: (2023)
par: Pang, Yan, et autres
Publié: (2023)
IMMACULATE: A Practical LLM Auditing Framework via Verifiable Computation
par: Guo, Yanpei, et autres
Publié: (2026)
par: Guo, Yanpei, et autres
Publié: (2026)
Enhancing Privacy of Spatiotemporal Federated Learning against Gradient Inversion Attacks
par: Zheng, Lele, et autres
Publié: (2024)
par: Zheng, Lele, et autres
Publié: (2024)
Securing Large Language Models: Addressing Bias, Misinformation, and Prompt Attacks
par: Peng, Benji, et autres
Publié: (2024)
par: Peng, Benji, et autres
Publié: (2024)
Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models
par: Chen, Zeyuan, et autres
Publié: (2026)
par: Chen, Zeyuan, et autres
Publié: (2026)
Membership Inference Attacks on Tokenizers of Large Language Models
par: Tong, Meng, et autres
Publié: (2025)
par: Tong, Meng, et autres
Publié: (2025)
ProxyPrompt: Securing System Prompts against Prompt Extraction Attacks
par: Zhuang, Zhixiong, et autres
Publié: (2025)
par: Zhuang, Zhixiong, et autres
Publié: (2025)
Prompt Stealing Attacks Against Large Language Models
par: Sha, Zeyang, et autres
Publié: (2024)
par: Sha, Zeyang, et autres
Publié: (2024)
Label Inference Attacks against Federated Unlearning
par: Wang, Wei, et autres
Publié: (2025)
par: Wang, Wei, et autres
Publié: (2025)
PINA: Prompt Injection Attack against Navigation Agents
par: Liu, Jiani, et autres
Publié: (2026)
par: Liu, Jiani, et autres
Publié: (2026)
Membership Inference Attacks on Vision-Language-Action Models
par: Peng, Yuefeng, et autres
Publié: (2026)
par: Peng, Yuefeng, et autres
Publié: (2026)
ExtendAttack: Attacking Servers of LRMs via Extending Reasoning
par: Zhu, Zhenhao, et autres
Publié: (2025)
par: Zhu, Zhenhao, et autres
Publié: (2025)
Hijacking Large Audio-Language Models via Context-Agnostic and Imperceptible Auditory Prompt Injection
par: Chen, Meng, et autres
Publié: (2026)
par: Chen, Meng, et autres
Publié: (2026)
Merge Hijacking: Backdoor Attacks to Model Merging of Large Language Models
par: Yuan, Zenghui, et autres
Publié: (2025)
par: Yuan, Zenghui, et autres
Publié: (2025)
ShadowCode: Towards (Automatic) External Prompt Injection Attack against Code LLMs
par: Yang, Yuchen, et autres
Publié: (2024)
par: Yang, Yuchen, et autres
Publié: (2024)
Echoes within the Reasoning: Stealthy and Effective Watermarking via Chain of Thought
par: Lu, Jiacheng, et autres
Publié: (2026)
par: Lu, Jiacheng, et autres
Publié: (2026)
Robustness via Referencing: Defending against Prompt Injection Attacks by Referencing the Executed Instruction
par: Chen, Yulin, et autres
Publié: (2025)
par: Chen, Yulin, et autres
Publié: (2025)
Documents similaires
-
Towards Effective Prompt Stealing Attack against Text-to-Image Diffusion Models
par: Zhao, Shiqian, et autres
Publié: (2025) -
RepoMark: A Data-Usage Auditing Framework for Code Large Language Models
par: Qu, Wenjie, et autres
Publié: (2025) -
Prompt Inference Attack on Distributed Large Language Model Inference Frameworks
par: Luo, Xinjian, et autres
Publié: (2025) -
BitHydra: Towards Bit-flip Inference Cost Attack against Large Language Models
par: Yan, Xiaobei, et autres
Publié: (2025) -
What Hard Tokens Reveal: Exploiting Low-confidence Tokens for Membership Inference Attacks against Large Language Models
par: Jawad, Md Tasnim, et autres
Publié: (2026)