Unlocking Memorization in Large Language Models with Dynamic Soft Prompting
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Zhepeng, Bao, Runxue, Wu, Yawen, Taylor, Jackson, Xiao, Cao, Zheng, Feng, Jiang, Weiwen, Gao, Shangqian, Zhang, Yanfu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AttackEval: A Systematic Empirical Study of Prompt Injection Attack Effectiveness Against Large Language Models
por: Wang, Jackson
Publicado: (2026)
por: Wang, Jackson
Publicado: (2026)
PerProb: Indirectly Evaluating Memorization in Large Language Models
por: Liao, Yihan, et al.
Publicado: (2025)
por: Liao, Yihan, et al.
Publicado: (2025)
Prompt Inversion Attack against Collaborative Inference of Large Language Models
por: Qu, Wenjie, et al.
Publicado: (2025)
por: Qu, Wenjie, et al.
Publicado: (2025)
Prompt Inference Attack on Distributed Large Language Model Inference Frameworks
por: Luo, Xinjian, et al.
Publicado: (2025)
por: Luo, Xinjian, et al.
Publicado: (2025)
System Prompt Extraction Attacks and Defenses in Large Language Models
por: Das, Badhan Chandra, et al.
Publicado: (2025)
por: Das, Badhan Chandra, et al.
Publicado: (2025)
PILOT: Command-line Interface Fuzzing via Path-Guided, Iterative Large Language Model Prompting
por: Shiraishi, Momoko, et al.
Publicado: (2025)
por: Shiraishi, Momoko, et al.
Publicado: (2025)
Securing Large Language Models: Addressing Bias, Misinformation, and Prompt Attacks
por: Peng, Benji, et al.
Publicado: (2024)
por: Peng, Benji, et al.
Publicado: (2024)
Chain-of-Thought Prompting of Large Language Models for Discovering and Fixing Software Vulnerabilities
por: Nong, Yu, et al.
Publicado: (2024)
por: Nong, Yu, et al.
Publicado: (2024)
Practical Secure Inference Algorithm for Fine-tuned Large Language Model Based on Fully Homomorphic Encryption
por: Ruoyan, Zhang, et al.
Publicado: (2025)
por: Ruoyan, Zhang, et al.
Publicado: (2025)
DictPFL: Efficient and Private Federated Learning on Encrypted Gradients
por: Xue, Jiaqi, et al.
Publicado: (2025)
por: Xue, Jiaqi, et al.
Publicado: (2025)
Privacy-Preserving LLMs Routing
por: Wu, Xidong, et al.
Publicado: (2026)
por: Wu, Xidong, et al.
Publicado: (2026)
Quantifying Memorization and Privacy Risks in Genomic Language Models
por: Nemecek, Alexander, et al.
Publicado: (2026)
por: Nemecek, Alexander, et al.
Publicado: (2026)
MemHunter: Automated and Verifiable Memorization Detection at Dataset-scale in LLMs
por: Wu, Zhenpeng, et al.
Publicado: (2024)
por: Wu, Zhenpeng, et al.
Publicado: (2024)
Private Memorization Editing: Turning Memorization into a Defense to Strengthen Data Privacy in Large Language Models
por: Ruzzetti, Elena Sofia, et al.
Publicado: (2025)
por: Ruzzetti, Elena Sofia, et al.
Publicado: (2025)
Differentially Private and Communication Efficient Large Language Model Split Inference via Stochastic Quantization and Soft Prompt
por: Gu, Yujie, et al.
Publicado: (2026)
por: Gu, Yujie, et al.
Publicado: (2026)
Why Are My Prompts Leaked? Unraveling Prompt Extraction Threats in Customized Large Language Models
por: Liang, Zi, et al.
Publicado: (2024)
por: Liang, Zi, et al.
Publicado: (2024)
SOS! Soft Prompt Attack Against Open-Source Large Language Models
por: Yang, Ziqing, et al.
Publicado: (2024)
por: Yang, Ziqing, et al.
Publicado: (2024)
CoSPED: Consistent Soft Prompt Targeted Data Extraction and Defense
por: Yang, Zhuochen, et al.
Publicado: (2025)
por: Yang, Zhuochen, et al.
Publicado: (2025)
Counterfactual Explainable Incremental Prompt Attack Analysis on Large Language Models
por: Shu, Dong, et al.
Publicado: (2024)
por: Shu, Dong, et al.
Publicado: (2024)
Token Highlighter: Inspecting and Mitigating Jailbreak Prompts for Large Language Models
por: Hu, Xiaomeng, et al.
Publicado: (2024)
por: Hu, Xiaomeng, et al.
Publicado: (2024)
Consiglieres in the Shadow: Understanding the Use of Uncensored Large Language Models in Cybercrimes
por: Lin, Zilong, et al.
Publicado: (2025)
por: Lin, Zilong, et al.
Publicado: (2025)
Leveraging Soft Prompts for Privacy Attacks in Federated Prompt Tuning
por: Nguyen, Quan Minh, et al.
Publicado: (2026)
por: Nguyen, Quan Minh, et al.
Publicado: (2026)
Privacy-preserving Prompt Personalization in Federated Learning for Multimodal Large Language Models
por: Hou, Sizai, et al.
Publicado: (2025)
por: Hou, Sizai, et al.
Publicado: (2025)
Code Vulnerability Repair with Large Language Model using Context-Aware Prompt Tuning
por: Khan, Arshiya, et al.
Publicado: (2024)
por: Khan, Arshiya, et al.
Publicado: (2024)
BadChain: Backdoor Chain-of-Thought Prompting for Large Language Models
por: Xiang, Zhen, et al.
Publicado: (2024)
por: Xiang, Zhen, et al.
Publicado: (2024)
Detecting Scams Using Large Language Models
por: Jiang, Liming
Publicado: (2024)
por: Jiang, Liming
Publicado: (2024)
Prompt Obfuscation for Large Language Models
por: Pape, David, et al.
Publicado: (2024)
por: Pape, David, et al.
Publicado: (2024)
Don't Listen To Me: Understanding and Exploring Jailbreak Prompts of Large Language Models
por: Yu, Zhiyuan, et al.
Publicado: (2024)
por: Yu, Zhiyuan, et al.
Publicado: (2024)
System-Level Defense against Indirect Prompt Injection Attacks: An Information Flow Control Perspective
por: Wu, Fangzhou, et al.
Publicado: (2024)
por: Wu, Fangzhou, et al.
Publicado: (2024)
SoK: Taxonomy and Evaluation of Prompt Security in Large Language Models
por: Hong, Hanbin, et al.
Publicado: (2025)
por: Hong, Hanbin, et al.
Publicado: (2025)
Your Code Secret Belongs to Me: Neural Code Completion Tools Can Memorize Hard-Coded Credentials
por: Huang, Yizhan, et al.
Publicado: (2023)
por: Huang, Yizhan, et al.
Publicado: (2023)
SecPE: Secure Prompt Ensembling for Private and Robust Large Language Models
por: Zhang, Jiawen, et al.
Publicado: (2025)
por: Zhang, Jiawen, et al.
Publicado: (2025)
A Survey on Privacy Risks and Protection in Large Language Models
por: Chen, Kang, et al.
Publicado: (2025)
por: Chen, Kang, et al.
Publicado: (2025)
Resource Consumption Red-Teaming for Large Vision-Language Models
por: Gao, Haoran, et al.
Publicado: (2025)
por: Gao, Haoran, et al.
Publicado: (2025)
What Hard Tokens Reveal: Exploiting Low-confidence Tokens for Membership Inference Attacks against Large Language Models
por: Jawad, Md Tasnim, et al.
Publicado: (2026)
por: Jawad, Md Tasnim, et al.
Publicado: (2026)
Localizing Paragraph Memorization in Language Models
por: Stoehr, Niklas, et al.
Publicado: (2024)
por: Stoehr, Niklas, et al.
Publicado: (2024)
Prompt Public Large Language Models to Synthesize Data for Private On-device Applications
por: Wu, Shanshan, et al.
Publicado: (2024)
por: Wu, Shanshan, et al.
Publicado: (2024)
Extracting Spatiotemporal Data from Gradients with Large Language Models
por: Zheng, Lele, et al.
Publicado: (2024)
por: Zheng, Lele, et al.
Publicado: (2024)
Text Steganography with Dynamic Codebook and Multimodal Large Language Model
por: Gao, Jianxin, et al.
Publicado: (2026)
por: Gao, Jianxin, et al.
Publicado: (2026)
Defenses at Odds: Measuring and Explaining Defense Conflicts in Large Language Models
por: Meng, Xiangtao, et al.
Publicado: (2026)
por: Meng, Xiangtao, et al.
Publicado: (2026)
Ejemplares similares
-
AttackEval: A Systematic Empirical Study of Prompt Injection Attack Effectiveness Against Large Language Models
por: Wang, Jackson
Publicado: (2026) -
PerProb: Indirectly Evaluating Memorization in Large Language Models
por: Liao, Yihan, et al.
Publicado: (2025) -
Prompt Inversion Attack against Collaborative Inference of Large Language Models
por: Qu, Wenjie, et al.
Publicado: (2025) -
Prompt Inference Attack on Distributed Large Language Model Inference Frameworks
por: Luo, Xinjian, et al.
Publicado: (2025) -
System Prompt Extraction Attacks and Defenses in Large Language Models
por: Das, Badhan Chandra, et al.
Publicado: (2025)