Token-Level Privacy in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Harel, Re'em, Gilboa, Niv, Pinter, Yuval |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Protecting Privacy in Classifiers by Token Manipulation
por: Harel, Re'em, et al.
Publicado: (2024)
por: Harel, Re'em, et al.
Publicado: (2024)
Privacy-Preserving Instructions for Aligning Large Language Models
por: Yu, Da, et al.
Publicado: (2024)
por: Yu, Da, et al.
Publicado: (2024)
Tag&Tab: Pretraining Data Detection in Large Language Models Using Keyword-Based Membership Inference Attack
por: Antebi, Sagiv, et al.
Publicado: (2025)
por: Antebi, Sagiv, et al.
Publicado: (2025)
Privacy in Large Language Models: Attacks, Defenses and Future Directions
por: Li, Haoran, et al.
Publicado: (2023)
por: Li, Haoran, et al.
Publicado: (2023)
Privacy-Preserving Parameter-Efficient Fine-Tuning for Large Language Model Services
por: Li, Yansong, et al.
Publicado: (2023)
por: Li, Yansong, et al.
Publicado: (2023)
Mind the Privacy Unit! User-Level Differential Privacy for Language Model Fine-Tuning
por: Chua, Lynn, et al.
Publicado: (2024)
por: Chua, Lynn, et al.
Publicado: (2024)
GoldCoin: Grounding Large Language Models in Privacy Laws via Contextual Integrity Theory
por: Fan, Wei, et al.
Publicado: (2024)
por: Fan, Wei, et al.
Publicado: (2024)
One Trigger Token Is Enough: A Defense Strategy for Balancing Safety and Usability in Large Language Models
por: Gu, Haoran, et al.
Publicado: (2025)
por: Gu, Haoran, et al.
Publicado: (2025)
Broken-Token: Filtering Obfuscated Prompts by Counting Characters-Per-Token
por: Zychlinski, Shaked, et al.
Publicado: (2025)
por: Zychlinski, Shaked, et al.
Publicado: (2025)
Differentially Private Next-Token Prediction of Large Language Models
por: Flemings, James, et al.
Publicado: (2024)
por: Flemings, James, et al.
Publicado: (2024)
The Model's Language Matters: A Comparative Privacy Analysis of LLMs
por: Mishra, Abhishek K., et al.
Publicado: (2025)
por: Mishra, Abhishek K., et al.
Publicado: (2025)
Privacy Preserving In-Context-Learning Framework for Large Language Models
por: Bhusal, Bishnu, et al.
Publicado: (2025)
por: Bhusal, Bishnu, et al.
Publicado: (2025)
Security and Privacy Challenges of Large Language Models: A Survey
por: Das, Badhan Chandra, et al.
Publicado: (2024)
por: Das, Badhan Chandra, et al.
Publicado: (2024)
MBTSAD: Mitigating Backdoors in Language Models Based on Token Splitting and Attention Distillation
por: Ding, Yidong, et al.
Publicado: (2025)
por: Ding, Yidong, et al.
Publicado: (2025)
Fine-Tuning Large Language Models with User-Level Differential Privacy
por: Charles, Zachary, et al.
Publicado: (2024)
por: Charles, Zachary, et al.
Publicado: (2024)
PAPILLON: Privacy Preservation from Internet-based and Local Language Model Ensembles
por: Siyan, Li, et al.
Publicado: (2024)
por: Siyan, Li, et al.
Publicado: (2024)
Sanitize Your Responses: Mitigating Privacy Leakage in Large Language Models
por: Fu, Wenjie, et al.
Publicado: (2025)
por: Fu, Wenjie, et al.
Publicado: (2025)
Token-Specific Watermarking with Enhanced Detectability and Semantic Coherence for Large Language Models
por: Huo, Mingjia, et al.
Publicado: (2024)
por: Huo, Mingjia, et al.
Publicado: (2024)
Privacy Ripple Effects from Adding or Removing Personal Information in Language Model Training
por: Borkar, Jaydeep, et al.
Publicado: (2025)
por: Borkar, Jaydeep, et al.
Publicado: (2025)
PrivLM-Bench: A Multi-level Privacy Evaluation Benchmark for Language Models
por: Li, Haoran, et al.
Publicado: (2023)
por: Li, Haoran, et al.
Publicado: (2023)
Quantifying Association Capabilities of Large Language Models and Its Implications on Privacy Leakage
por: Shao, Hanyin, et al.
Publicado: (2023)
por: Shao, Hanyin, et al.
Publicado: (2023)
TrojanStego: Your Language Model Can Secretly Be A Steganographic Privacy Leaking Agent
por: Meier, Dominik, et al.
Publicado: (2025)
por: Meier, Dominik, et al.
Publicado: (2025)
PATCH: Mitigating PII Leakage in Language Models with Privacy-Aware Targeted Circuit PatcHing
por: Hughes, Anthony, et al.
Publicado: (2025)
por: Hughes, Anthony, et al.
Publicado: (2025)
Direct Token Optimization: A Self-contained Approach to Large Language Model Unlearning
por: Lee, Hong kyu, et al.
Publicado: (2025)
por: Lee, Hong kyu, et al.
Publicado: (2025)
STShield: Single-Token Sentinel for Real-Time Jailbreak Detection in Large Language Models
por: Wang, Xunguang, et al.
Publicado: (2025)
por: Wang, Xunguang, et al.
Publicado: (2025)
Token Inflation: How Dishonest Providers Can Overcharge for Large Language Model Usage
por: Hoque, Shahinul, et al.
Publicado: (2026)
por: Hoque, Shahinul, et al.
Publicado: (2026)
Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens
por: Zhang, Anqi, et al.
Publicado: (2024)
por: Zhang, Anqi, et al.
Publicado: (2024)
Copyright Traps for Large Language Models
por: Meeus, Matthieu, et al.
Publicado: (2024)
por: Meeus, Matthieu, et al.
Publicado: (2024)
Time Will Tell: Timing Side Channels via Output Token Count in Large Language Models
por: Zhang, Tianchen, et al.
Publicado: (2024)
por: Zhang, Tianchen, et al.
Publicado: (2024)
PrivacyLens: Evaluating Privacy Norm Awareness of Language Models in Action
por: Shao, Yijia, et al.
Publicado: (2024)
por: Shao, Yijia, et al.
Publicado: (2024)
Yet Another Watermark for Large Language Models
por: Bao, Siyuan, et al.
Publicado: (2025)
por: Bao, Siyuan, et al.
Publicado: (2025)
Large Language Models as Carriers of Hidden Messages
por: Hoscilowicz, Jakub, et al.
Publicado: (2024)
por: Hoscilowicz, Jakub, et al.
Publicado: (2024)
Lateral Phishing With Large Language Models: A Large Organization Comparative Study
por: Bethany, Mazal, et al.
Publicado: (2024)
por: Bethany, Mazal, et al.
Publicado: (2024)
Majority Bit-Aware Watermarking For Large Language Models
por: Xu, Jiahao, et al.
Publicado: (2025)
por: Xu, Jiahao, et al.
Publicado: (2025)
Prompt Stealing Attacks Against Large Language Models
por: Sha, Zeyang, et al.
Publicado: (2024)
por: Sha, Zeyang, et al.
Publicado: (2024)
Interpreting the Repeated Token Phenomenon in Large Language Models
por: Yona, Itay, et al.
Publicado: (2025)
por: Yona, Itay, et al.
Publicado: (2025)
AlienLM: Alienization of Language for API-Boundary Privacy in Black-Box LLMs
por: Kim, Jaehee, et al.
Publicado: (2026)
por: Kim, Jaehee, et al.
Publicado: (2026)
Private Memorization Editing: Turning Memorization into a Defense to Strengthen Data Privacy in Large Language Models
por: Ruzzetti, Elena Sofia, et al.
Publicado: (2025)
por: Ruzzetti, Elena Sofia, et al.
Publicado: (2025)
What Does the Server See? Understanding Privacy Leakage from Large Language Models in Split Inference
por: Fan, Mingyuan, et al.
Publicado: (2026)
por: Fan, Mingyuan, et al.
Publicado: (2026)
Resource Consumption Red-Teaming for Large Vision-Language Models
por: Gao, Haoran, et al.
Publicado: (2025)
por: Gao, Haoran, et al.
Publicado: (2025)
Ejemplares similares
-
Protecting Privacy in Classifiers by Token Manipulation
por: Harel, Re'em, et al.
Publicado: (2024) -
Privacy-Preserving Instructions for Aligning Large Language Models
por: Yu, Da, et al.
Publicado: (2024) -
Tag&Tab: Pretraining Data Detection in Large Language Models Using Keyword-Based Membership Inference Attack
por: Antebi, Sagiv, et al.
Publicado: (2025) -
Privacy in Large Language Models: Attacks, Defenses and Future Directions
por: Li, Haoran, et al.
Publicado: (2023) -
Privacy-Preserving Parameter-Efficient Fine-Tuning for Large Language Model Services
por: Li, Yansong, et al.
Publicado: (2023)