Private Memorization Editing: Turning Memorization into a Defense to Strengthen Data Privacy in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ruzzetti, Elena Sofia, Xompero, Giancarlo A., Venditti, Davide, Zanzotto, Fabio Massimo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Data Privacy in Large Language Models through Private Association Editing
par: Venditti, Davide, et autres
Publié: (2024)
par: Venditti, Davide, et autres
Publié: (2024)
Preserving Privacy in Large Language Models: A Survey on Current Threats and Solutions
par: Miranda, Michele, et autres
Publié: (2024)
par: Miranda, Michele, et autres
Publié: (2024)
PreCog: Exploring the Relation between Memorization and Performance in Pre-trained Language Models
par: Ranaldi, Leonardo, et autres
Publié: (2023)
par: Ranaldi, Leonardo, et autres
Publié: (2023)
Position: Privacy Is Not Just Memorization!
par: Mireshghallah, Niloofar, et autres
Publié: (2025)
par: Mireshghallah, Niloofar, et autres
Publié: (2025)
Unlocking Memorization in Large Language Models with Dynamic Soft Prompting
par: Wang, Zhepeng, et autres
Publié: (2024)
par: Wang, Zhepeng, et autres
Publié: (2024)
Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models
par: Dong, Yihong, et autres
Publié: (2024)
par: Dong, Yihong, et autres
Publié: (2024)
Data-centric NLP Backdoor Defense from the Lens of Memorization
par: Wang, Zhenting, et autres
Publié: (2024)
par: Wang, Zhenting, et autres
Publié: (2024)
A Trip Towards Fairness: Bias and De-Biasing in Large Language Models
par: Ranaldi, Leonardo, et autres
Publié: (2023)
par: Ranaldi, Leonardo, et autres
Publié: (2023)
Localizing Paragraph Memorization in Language Models
par: Stoehr, Niklas, et autres
Publié: (2024)
par: Stoehr, Niklas, et autres
Publié: (2024)
MeMo: Towards Language Models with Associative Memory Mechanisms
par: Zanzotto, Fabio Massimo, et autres
Publié: (2025)
par: Zanzotto, Fabio Massimo, et autres
Publié: (2025)
Unveiling Privacy, Memorization, and Input Curvature Links
par: Ravikumar, Deepak, et autres
Publié: (2024)
par: Ravikumar, Deepak, et autres
Publié: (2024)
Privacy in Large Language Models: Attacks, Defenses and Future Directions
par: Li, Haoran, et autres
Publié: (2023)
par: Li, Haoran, et autres
Publié: (2023)
Quantifying Memorization and Privacy Risks in Genomic Language Models
par: Nemecek, Alexander, et autres
Publié: (2026)
par: Nemecek, Alexander, et autres
Publié: (2026)
Extracting Memorized Training Data via Decomposition
par: Su, Ellen, et autres
Publié: (2024)
par: Su, Ellen, et autres
Publié: (2024)
PerProb: Indirectly Evaluating Memorization in Large Language Models
par: Liao, Yihan, et autres
Publié: (2025)
par: Liao, Yihan, et autres
Publié: (2025)
Contextualized Privacy Defense for LLM Agents
par: Wen, Yule, et autres
Publié: (2026)
par: Wen, Yule, et autres
Publié: (2026)
One Turn Too Late: Response-Aware Defense Against Hidden Malicious Intent in Multi-Turn Dialogue
par: Shen, Xinjie, et autres
Publié: (2026)
par: Shen, Xinjie, et autres
Publié: (2026)
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
par: Zhao, Shuai, et autres
Publié: (2024)
par: Zhao, Shuai, et autres
Publié: (2024)
Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models
par: Ying, Zonghao, et autres
Publié: (2025)
par: Ying, Zonghao, et autres
Publié: (2025)
Tempest: Autonomous Multi-Turn Jailbreaking of Large Language Models with Tree Search
par: Zhou, Andy, et autres
Publié: (2025)
par: Zhou, Andy, et autres
Publié: (2025)
The Landscape of Memorization in LLMs: Mechanisms, Measurement, and Mitigation
par: Xiong, Alexander, et autres
Publié: (2025)
par: Xiong, Alexander, et autres
Publié: (2025)
DELMAN: Dynamic Defense Against Large Language Model Jailbreaking with Model Editing
par: Wang, Yi, et autres
Publié: (2025)
par: Wang, Yi, et autres
Publié: (2025)
Pattern Enhanced Multi-Turn Jailbreaking: Exploiting Structural Vulnerabilities in Large Language Models
par: Nihal, Ragib Amin, et autres
Publié: (2025)
par: Nihal, Ragib Amin, et autres
Publié: (2025)
ADVERSA: Measuring Multi-Turn Guardrail Degradation and Judge Reliability in Large Language Models
par: Owiredu-Ashley, Harry
Publié: (2026)
par: Owiredu-Ashley, Harry
Publié: (2026)
Security and Privacy Challenges of Large Language Models: A Survey
par: Das, Badhan Chandra, et autres
Publié: (2024)
par: Das, Badhan Chandra, et autres
Publié: (2024)
Reverse-Engineering Model Editing on Language Models
par: Sun, Zhiyu, et autres
Publié: (2026)
par: Sun, Zhiyu, et autres
Publié: (2026)
Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models
par: Yu, Yongcan, et autres
Publié: (2025)
par: Yu, Yongcan, et autres
Publié: (2025)
Quantifying Association Capabilities of Large Language Models and Its Implications on Privacy Leakage
par: Shao, Hanyin, et autres
Publié: (2023)
par: Shao, Hanyin, et autres
Publié: (2023)
Leaky Thoughts: Large Reasoning Models Are Not Private Thinkers
par: Green, Tommaso, et autres
Publié: (2025)
par: Green, Tommaso, et autres
Publié: (2025)
Scrub It Out! Erasing Sensitive Memorization in Code Language Models via Machine Unlearning
par: Chu, Zhaoyang, et autres
Publié: (2025)
par: Chu, Zhaoyang, et autres
Publié: (2025)
Learning the Signature of Memorization in Autoregressive Language Models
par: Ilić, David, et autres
Publié: (2026)
par: Ilić, David, et autres
Publié: (2026)
PrivacyLens: Evaluating Privacy Norm Awareness of Language Models in Action
par: Shao, Yijia, et autres
Publié: (2024)
par: Shao, Yijia, et autres
Publié: (2024)
Data Defenses Against Large Language Models
par: Agnew, William, et autres
Publié: (2024)
par: Agnew, William, et autres
Publié: (2024)
EvoDefense: Co-Evolving Black-Box Defense with Large Language Models
par: Li, Yu, et autres
Publié: (2026)
par: Li, Yu, et autres
Publié: (2026)
Adversarial Text Purification: A Large Language Model Approach for Defense
par: Moraffah, Raha, et autres
Publié: (2024)
par: Moraffah, Raha, et autres
Publié: (2024)
Jailbreak Attacks and Defenses Against Large Language Models: A Survey
par: Yi, Sibo, et autres
Publié: (2024)
par: Yi, Sibo, et autres
Publié: (2024)
Randomized Masked Finetuning: An Efficient Way to Mitigate Memorization of PIIs in LLMs
par: Joshi, Kunj, et autres
Publié: (2025)
par: Joshi, Kunj, et autres
Publié: (2025)
Empowering Multi-step Reasoning across Languages via Tree-of-Thoughts
par: Ranaldi, Leonardo, et autres
Publié: (2023)
par: Ranaldi, Leonardo, et autres
Publié: (2023)
Emerging Safety Attack and Defense in Federated Instruction Tuning of Large Language Models
par: Ye, Rui, et autres
Publié: (2024)
par: Ye, Rui, et autres
Publié: (2024)
Enhancing Security and Strengthening Defenses in Automated Short-Answer Grading Systems
par: Yarmohammadtoosky, Sahar, et autres
Publié: (2025)
par: Yarmohammadtoosky, Sahar, et autres
Publié: (2025)
Documents similaires
-
Enhancing Data Privacy in Large Language Models through Private Association Editing
par: Venditti, Davide, et autres
Publié: (2024) -
Preserving Privacy in Large Language Models: A Survey on Current Threats and Solutions
par: Miranda, Michele, et autres
Publié: (2024) -
PreCog: Exploring the Relation between Memorization and Performance in Pre-trained Language Models
par: Ranaldi, Leonardo, et autres
Publié: (2023) -
Position: Privacy Is Not Just Memorization!
par: Mireshghallah, Niloofar, et autres
Publié: (2025) -
Unlocking Memorization in Large Language Models with Dynamic Soft Prompting
par: Wang, Zhepeng, et autres
Publié: (2024)