Tokens for Learning, Tokens for Unlearning: Mitigating Membership Inference Attacks in Large Language Models via Dual-Purpose Training
Fuente:
arXiv
Guardado en:
| Autores principales: | Tran, Toan, Liu, Ruixuan, Xiong, Li |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Differentially Private Tabular Data Synthesis using Large Language Models
por: Tran, Toan V., et al.
Publicado: (2024)
por: Tran, Toan V., et al.
Publicado: (2024)
Dual-Model Defense: Safeguarding Diffusion Models from Membership Inference Attacks through Disjoint Data Splitting
por: Tran, Bao Q., et al.
Publicado: (2024)
por: Tran, Bao Q., et al.
Publicado: (2024)
Temporal Tokenization Strategies for Event Sequence Modeling with Large Language Models
por: Liu, Zefang, et al.
Publicado: (2025)
por: Liu, Zefang, et al.
Publicado: (2025)
Direct Token Optimization: A Self-contained Approach to Large Language Model Unlearning
por: Lee, Hong kyu, et al.
Publicado: (2025)
por: Lee, Hong kyu, et al.
Publicado: (2025)
Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration
por: Fu, Wenjie, et al.
Publicado: (2023)
por: Fu, Wenjie, et al.
Publicado: (2023)
Turning Trash into Treasure: Accelerating Inference of Large Language Models with Token Recycling
por: Luo, Xianzhen, et al.
Publicado: (2024)
por: Luo, Xianzhen, et al.
Publicado: (2024)
Automated Membership Inference Attacks: Discovering MIA Signal Computations using LLM Agents
por: Tran, Toan, et al.
Publicado: (2026)
por: Tran, Toan, et al.
Publicado: (2026)
From Token to Token Pair: Efficient Prompt Compression for Large Language Models in Clinical Prediction
por: Zhu, Mingcheng, et al.
Publicado: (2026)
por: Zhu, Mingcheng, et al.
Publicado: (2026)
Membership Inference Attacks against Large Vision-Language Models
por: Li, Zhan, et al.
Publicado: (2024)
por: Li, Zhan, et al.
Publicado: (2024)
Understanding and Mitigating Tokenization Bias in Language Models
por: Phan, Buu, et al.
Publicado: (2024)
por: Phan, Buu, et al.
Publicado: (2024)
Scaling Up Membership Inference: When and How Attacks Succeed on Large Language Models
por: Puerto, Haritz, et al.
Publicado: (2024)
por: Puerto, Haritz, et al.
Publicado: (2024)
Language Modeling with Learned Meta-Tokens
por: Shah, Alok N., et al.
Publicado: (2025)
por: Shah, Alok N., et al.
Publicado: (2025)
TLPO: Token-Level Policy Optimization for Mitigating Language Confusion in Large Language Models
por: Choo, Jinho, et al.
Publicado: (2026)
por: Choo, Jinho, et al.
Publicado: (2026)
Unlocking Full Efficiency of Token Filtering in Large Language Model Training
por: Chai, Di, et al.
Publicado: (2025)
por: Chai, Di, et al.
Publicado: (2025)
Membership Inference Attacks and Privacy in Topic Modeling
por: Manzonelli, Nico, et al.
Publicado: (2024)
por: Manzonelli, Nico, et al.
Publicado: (2024)
Training Large Language Models To Reason In Parallel With Global Forking Tokens
por: Jia, Sheng, et al.
Publicado: (2025)
por: Jia, Sheng, et al.
Publicado: (2025)
Token-Efficient Leverage Learning in Large Language Models
por: Zeng, Yuanhao, et al.
Publicado: (2024)
por: Zeng, Yuanhao, et al.
Publicado: (2024)
Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing
por: Liu, Tianci, et al.
Publicado: (2025)
por: Liu, Tianci, et al.
Publicado: (2025)
The Geometry of Tokens in Internal Representations of Large Language Models
por: Viswanathan, Karthik, et al.
Publicado: (2025)
por: Viswanathan, Karthik, et al.
Publicado: (2025)
DP-Fusion: Token-Level Differentially Private Inference for Large Language Models
por: Thareja, Rushil, et al.
Publicado: (2025)
por: Thareja, Rushil, et al.
Publicado: (2025)
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models
por: Zhang, Yang, et al.
Publicado: (2025)
por: Zhang, Yang, et al.
Publicado: (2025)
CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing
por: Zheng, Wenhao, et al.
Publicado: (2025)
por: Zheng, Wenhao, et al.
Publicado: (2025)
Boundary-targeted Membership Inference Attacks on Safety Classifiers
por: Hughes, Anthony, et al.
Publicado: (2026)
por: Hughes, Anthony, et al.
Publicado: (2026)
Context-Aware Membership Inference Attacks against Pre-trained Large Language Models
por: Chang, Hongyan, et al.
Publicado: (2024)
por: Chang, Hongyan, et al.
Publicado: (2024)
Efficient Training of Language Models with Compact and Consistent Next Token Distributions
por: Sathe, Ashutosh, et al.
Publicado: (2024)
por: Sathe, Ashutosh, et al.
Publicado: (2024)
Evaluation of Large Language Models via Coupled Token Generation
por: Benz, Nina Corvelo, et al.
Publicado: (2025)
por: Benz, Nina Corvelo, et al.
Publicado: (2025)
Data Mixture Inference: What do BPE Tokenizers Reveal about their Training Data?
por: Hayase, Jonathan, et al.
Publicado: (2024)
por: Hayase, Jonathan, et al.
Publicado: (2024)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
por: Shao, Chenze, et al.
Publicado: (2024)
por: Shao, Chenze, et al.
Publicado: (2024)
Efficient Temporal Tokenization for Mobility Prediction with Large Language Models
por: He, Haoyu, et al.
Publicado: (2025)
por: He, Haoyu, et al.
Publicado: (2025)
Probabilistic Token Alignment for Large Language Model Fusion
por: Zeng, Runjia, et al.
Publicado: (2025)
por: Zeng, Runjia, et al.
Publicado: (2025)
Lossless Compression of Large Language Model-Generated Text via Next-Token Prediction
por: Mao, Yu, et al.
Publicado: (2025)
por: Mao, Yu, et al.
Publicado: (2025)
Token Sparse Attention: Efficient Long-Context Inference with Interleaved Token Selection
por: Jo, Dongwon, et al.
Publicado: (2026)
por: Jo, Dongwon, et al.
Publicado: (2026)
PrefixQuant: Eliminating Outliers by Prefixed Tokens for Large Language Models Quantization
por: Chen, Mengzhao, et al.
Publicado: (2024)
por: Chen, Mengzhao, et al.
Publicado: (2024)
Counterfactual Token Generation in Large Language Models
por: Chatzi, Ivi, et al.
Publicado: (2024)
por: Chatzi, Ivi, et al.
Publicado: (2024)
Not All Tokens Matter: Towards Efficient LLM Reasoning via Token Significance in Reinforcement Learning
por: Liu, Hanbing, et al.
Publicado: (2025)
por: Liu, Hanbing, et al.
Publicado: (2025)
Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models
por: Jain, Neel, et al.
Publicado: (2024)
por: Jain, Neel, et al.
Publicado: (2024)
Towards Linguistically-Aware and Language-Independent Tokenization for Large Language Models (LLMs)
por: Rahman, Abrar, et al.
Publicado: (2024)
por: Rahman, Abrar, et al.
Publicado: (2024)
Blind Baselines Beat Membership Inference Attacks for Foundation Models
por: Das, Debeshee, et al.
Publicado: (2024)
por: Das, Debeshee, et al.
Publicado: (2024)
Blackbox Model Provenance via Palimpsestic Membership Inference
por: Kuditipudi, Rohith, et al.
Publicado: (2025)
por: Kuditipudi, Rohith, et al.
Publicado: (2025)
TIDE: Token-Informed Depth Execution for Per-Token Early Exit in LLM Inference
por: Jaber, Jaber, et al.
Publicado: (2026)
por: Jaber, Jaber, et al.
Publicado: (2026)
Ejemplares similares
-
Differentially Private Tabular Data Synthesis using Large Language Models
por: Tran, Toan V., et al.
Publicado: (2024) -
Dual-Model Defense: Safeguarding Diffusion Models from Membership Inference Attacks through Disjoint Data Splitting
por: Tran, Bao Q., et al.
Publicado: (2024) -
Temporal Tokenization Strategies for Event Sequence Modeling with Large Language Models
por: Liu, Zefang, et al.
Publicado: (2025) -
Direct Token Optimization: A Self-contained Approach to Large Language Model Unlearning
por: Lee, Hong kyu, et al.
Publicado: (2025) -
Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration
por: Fu, Wenjie, et al.
Publicado: (2023)