Position: Privacy Is Not Just Memorization!
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mireshghallah, Niloofar, Li, Tianshi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Differentially Private Learning Needs Better Model Initialization and Self-Distillation
par: Ngong, Ivoline C., et autres
Publié: (2024)
par: Ngong, Ivoline C., et autres
Publié: (2024)
Synthetic Data Can Mislead Evaluations: Membership Inference as Machine Text Detection
par: Naseh, Ali, et autres
Publié: (2025)
par: Naseh, Ali, et autres
Publié: (2025)
Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory
par: Mireshghallah, Niloofar, et autres
Publié: (2023)
par: Mireshghallah, Niloofar, et autres
Publié: (2023)
A False Sense of Privacy: Evaluating Textual Data Sanitization Beyond Surface-level Privacy Leakage
par: Xin, Rui, et autres
Publié: (2025)
par: Xin, Rui, et autres
Publié: (2025)
Unlocking Memorization in Large Language Models with Dynamic Soft Prompting
par: Wang, Zhepeng, et autres
Publié: (2024)
par: Wang, Zhepeng, et autres
Publié: (2024)
PrivacyLens: Evaluating Privacy Norm Awareness of Language Models in Action
par: Shao, Yijia, et autres
Publié: (2024)
par: Shao, Yijia, et autres
Publié: (2024)
Trustworthy AI: Safety, Bias, and Privacy -- A Survey
par: Fang, Xingli, et autres
Publié: (2025)
par: Fang, Xingli, et autres
Publié: (2025)
Do Phone-Use Agents Respect Your Privacy?
par: Tang, Zhengyang, et autres
Publié: (2026)
par: Tang, Zhengyang, et autres
Publié: (2026)
Unveiling Privacy, Memorization, and Input Curvature Links
par: Ravikumar, Deepak, et autres
Publié: (2024)
par: Ravikumar, Deepak, et autres
Publié: (2024)
Private Memorization Editing: Turning Memorization into a Defense to Strengthen Data Privacy in Large Language Models
par: Ruzzetti, Elena Sofia, et autres
Publié: (2025)
par: Ruzzetti, Elena Sofia, et autres
Publié: (2025)
Fine-Tuning Language Models with Differential Privacy through Adaptive Noise Allocation
par: Li, Xianzhi, et autres
Publié: (2024)
par: Li, Xianzhi, et autres
Publié: (2024)
EIA: Environmental Injection Attack on Generalist Web Agents for Privacy Leakage
par: Liao, Zeyi, et autres
Publié: (2024)
par: Liao, Zeyi, et autres
Publié: (2024)
Learnable Privacy Neurons Localization in Language Models
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models
par: Dong, Yihong, et autres
Publié: (2024)
par: Dong, Yihong, et autres
Publié: (2024)
Beyond Gradient and Priors in Privacy Attacks: Leveraging Pooler Layer Inputs of Language Models in Federated Learning
par: Li, Jianwei, et autres
Publié: (2023)
par: Li, Jianwei, et autres
Publié: (2023)
How Private is Your Attention? Bridging Privacy with In-Context Learning
par: Bonnerjee, Soham, et autres
Publié: (2025)
par: Bonnerjee, Soham, et autres
Publié: (2025)
HARMONIC: Harnessing LLMs for Tabular Data Synthesis and Privacy Protection
par: Wang, Yuxin, et autres
Publié: (2024)
par: Wang, Yuxin, et autres
Publié: (2024)
Just Do It!? Computer-Use Agents Exhibit Blind Goal-Directedness
par: Shayegani, Erfan, et autres
Publié: (2025)
par: Shayegani, Erfan, et autres
Publié: (2025)
Preserving Privacy in Large Language Models: A Survey on Current Threats and Solutions
par: Miranda, Michele, et autres
Publié: (2024)
par: Miranda, Michele, et autres
Publié: (2024)
FedMentor: Domain-Aware Differential Privacy for Heterogeneous Federated LLMs in Mental Health
par: Sarwar, Nobin, et autres
Publié: (2025)
par: Sarwar, Nobin, et autres
Publié: (2025)
PBa-LLM: Privacy- and Bias-aware NLP using Named-Entity Recognition (NER)
par: Mancera, Gonzalo, et autres
Publié: (2025)
par: Mancera, Gonzalo, et autres
Publié: (2025)
The Janus Interface: How Fine-Tuning in Large Language Models Amplifies the Privacy Risks
par: Chen, Xiaoyi, et autres
Publié: (2023)
par: Chen, Xiaoyi, et autres
Publié: (2023)
DP-MemArc: Differential Privacy Transfer Learning for Memory Efficient Language Models
par: Liu, Yanming, et autres
Publié: (2024)
par: Liu, Yanming, et autres
Publié: (2024)
Privacy-Preserving Data Deduplication for Enhancing Federated Learning of Language Models (Extended Version)
par: Abadi, Aydin, et autres
Publié: (2024)
par: Abadi, Aydin, et autres
Publié: (2024)
BinaryShield: Cross-Service Threat Intelligence in LLM Services using Privacy-Preserving Fingerprints
par: Gill, Waris, et autres
Publié: (2025)
par: Gill, Waris, et autres
Publié: (2025)
Reconstruct Your Previous Conversations! Comprehensively Investigating Privacy Leakage Risks in Conversations with GPT Models
par: Chu, Junjie, et autres
Publié: (2024)
par: Chu, Junjie, et autres
Publié: (2024)
MetaMoE: Diversity-Aware Proxy Selection for Privacy-Preserving Mixture-of-Experts Unification
par: Jiang, Weisen, et autres
Publié: (2026)
par: Jiang, Weisen, et autres
Publié: (2026)
IncogniText: Privacy-enhancing Conditional Text Anonymization via LLM-based Private Attribute Randomization
par: Frikha, Ahmed, et autres
Publié: (2024)
par: Frikha, Ahmed, et autres
Publié: (2024)
Operationalizing Data Minimization for Privacy-Preserving LLM Prompting
par: Zhou, Jijie, et autres
Publié: (2025)
par: Zhou, Jijie, et autres
Publié: (2025)
Optimizing the Privacy-Utility Balance using Synthetic Data and Configurable Perturbation Pipelines
par: Sharma, Anantha, et autres
Publié: (2025)
par: Sharma, Anantha, et autres
Publié: (2025)
Clio: Privacy-Preserving Insights into Real-World AI Use
par: Tamkin, Alex, et autres
Publié: (2024)
par: Tamkin, Alex, et autres
Publié: (2024)
The Resurgence of GCG Adversarial Attacks on Large Language Models
par: Tan, Yuting, et autres
Publié: (2025)
par: Tan, Yuting, et autres
Publié: (2025)
Safety Alignment Can Be Not Superficial With Explicit Safety Signals
par: Li, Jianwei, et autres
Publié: (2025)
par: Li, Jianwei, et autres
Publié: (2025)
Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models
par: Li, Xiao, et autres
Publié: (2024)
par: Li, Xiao, et autres
Publié: (2024)
SentinelLMs: Encrypted Input Adaptation and Fine-tuning of Language Models for Private and Secure Inference
par: Mishra, Abhijit, et autres
Publié: (2023)
par: Mishra, Abhijit, et autres
Publié: (2023)
Revealing Weaknesses in Text Watermarking Through Self-Information Rewrite Attacks
par: Cheng, Yixin, et autres
Publié: (2025)
par: Cheng, Yixin, et autres
Publié: (2025)
Scalable Defense against In-the-wild Jailbreaking Attacks with Safety Context Retrieval
par: Chen, Taiye, et autres
Publié: (2025)
par: Chen, Taiye, et autres
Publié: (2025)
Federated In-Context LLM Agent Learning
par: Wu, Panlong, et autres
Publié: (2024)
par: Wu, Panlong, et autres
Publié: (2024)
On Evaluating The Performance of Watermarked Machine-Generated Texts Under Adversarial Attacks
par: Liu, Zesen, et autres
Publié: (2024)
par: Liu, Zesen, et autres
Publié: (2024)
Preference Tuning For Toxicity Mitigation Generalizes Across Languages
par: Li, Xiaochen, et autres
Publié: (2024)
par: Li, Xiaochen, et autres
Publié: (2024)
Documents similaires
-
Differentially Private Learning Needs Better Model Initialization and Self-Distillation
par: Ngong, Ivoline C., et autres
Publié: (2024) -
Synthetic Data Can Mislead Evaluations: Membership Inference as Machine Text Detection
par: Naseh, Ali, et autres
Publié: (2025) -
Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory
par: Mireshghallah, Niloofar, et autres
Publié: (2023) -
A False Sense of Privacy: Evaluating Textual Data Sanitization Beyond Surface-level Privacy Leakage
par: Xin, Rui, et autres
Publié: (2025) -
Unlocking Memorization in Large Language Models with Dynamic Soft Prompting
par: Wang, Zhepeng, et autres
Publié: (2024)