Understanding and Mitigating Cross-lingual Privacy Leakage via Language-specific and Universal Privacy Neurons
Fuente:
arXiv
Saved in:
| Main Authors: | Dong, Wenshuo, Yang, Qingsong, Yang, Shu, Hu, Lijie, Ding, Meng, Lin, Wanyu, Zheng, Tianhang, Wang, Di |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Privacy-Aware Decoding: Mitigating Privacy Leakage of Large Language Models in Retrieval-Augmented Generation
by: Wang, Haoran, et al.
Published: (2025)
by: Wang, Haoran, et al.
Published: (2025)
Faithful Interpretation for Graph Neural Networks
by: Hu, Lijie, et al.
Published: (2024)
by: Hu, Lijie, et al.
Published: (2024)
Mitigating Semantic Leakage in Cross-lingual Embeddings via Orthogonality Constraint
by: Ki, Dayeon, et al.
Published: (2024)
by: Ki, Dayeon, et al.
Published: (2024)
EAP-GP: Mitigating Saturation Effect in Gradient-based Automated Circuit Identification
by: Zhang, Lin, et al.
Published: (2025)
by: Zhang, Lin, et al.
Published: (2025)
The Compositional Architecture of Regret in Large Language Models
by: Cui, Xiangxiang, et al.
Published: (2025)
by: Cui, Xiangxiang, et al.
Published: (2025)
Learnable Privacy Neurons Localization in Language Models
by: Chen, Ruizhe, et al.
Published: (2024)
by: Chen, Ruizhe, et al.
Published: (2024)
Defeating Cerberus: Concept-Guided Privacy-Leakage Mitigation in Multimodal Language Models
by: Zhang, Boyang, et al.
Published: (2025)
by: Zhang, Boyang, et al.
Published: (2025)
Understanding How Value Neurons Shape the Generation of Specified Values in LLMs
by: Su, Yi, et al.
Published: (2025)
by: Su, Yi, et al.
Published: (2025)
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
by: Dong, Jiangwen, et al.
Published: (2025)
by: Dong, Jiangwen, et al.
Published: (2025)
Sanitize Your Responses: Mitigating Privacy Leakage in Large Language Models
by: Fu, Wenjie, et al.
Published: (2025)
by: Fu, Wenjie, et al.
Published: (2025)
Tracing Privacy Leakage of Language Models to Training Data via Adjusted Influence Functions
by: Liu, Jinxin, et al.
Published: (2024)
by: Liu, Jinxin, et al.
Published: (2024)
The Hidden Cost of Correlation: Rethinking Privacy Leakage in Local Differential Privacy
by: Jayawardana, Sandaru, et al.
Published: (2025)
by: Jayawardana, Sandaru, et al.
Published: (2025)
Linguistic Neuron Overlap Patterns to Facilitate Cross-lingual Transfer on Low-resource Languages
by: Xu, Yuemei, et al.
Published: (2025)
by: Xu, Yuemei, et al.
Published: (2025)
Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images
by: You, Liangliang, et al.
Published: (2025)
by: You, Liangliang, et al.
Published: (2025)
Real-Time Privacy Risk Measurement with Privacy Tokens for Gradient Leakage
by: Meng, Jiayang, et al.
Published: (2025)
by: Meng, Jiayang, et al.
Published: (2025)
Game-Theoretic Machine Unlearning: Mitigating Extra Privacy Leakage
by: Liu, Hengzhu, et al.
Published: (2024)
by: Liu, Hengzhu, et al.
Published: (2024)
Maximal $α$-Leakage for Quantum Privacy Mechanisms
by: Yang, Bo-Yu, et al.
Published: (2024)
by: Yang, Bo-Yu, et al.
Published: (2024)
Tracing and Mitigating Hallucinations in Multimodal LLMs via Dynamic Attention Localization
by: Yang, Tiancheng, et al.
Published: (2025)
by: Yang, Tiancheng, et al.
Published: (2025)
Benchmarking and Mitigating Sycophancy in Medical Vision Language Models
by: Xu, Juangui, et al.
Published: (2025)
by: Xu, Juangui, et al.
Published: (2025)
Word Recovery in Large Language Models Enables Character-Level Tokenization Robustness
by: Yang, Zhipeng, et al.
Published: (2026)
by: Yang, Zhipeng, et al.
Published: (2026)
Fair Text-to-Image Diffusion via Fair Mapping
by: Li, Jia, et al.
Published: (2023)
by: Li, Jia, et al.
Published: (2023)
PATCH: Mitigating PII Leakage in Language Models with Privacy-Aware Targeted Circuit PatcHing
by: Hughes, Anthony, et al.
Published: (2025)
by: Hughes, Anthony, et al.
Published: (2025)
Understanding and Mitigating Political Stance Cross-topic Generalization in Large Language Models
by: Zhang, Jiayi, et al.
Published: (2025)
by: Zhang, Jiayi, et al.
Published: (2025)
SoK: The Privacy Paradox of Large Language Models: Advancements, Privacy Risks, and Mitigation
by: Shanmugarasa, Yashothara, et al.
Published: (2025)
by: Shanmugarasa, Yashothara, et al.
Published: (2025)
Visual Self-Fulfilling Alignment: Shaping Safety-Oriented Personas via Threat-Related Images
by: Yang, Qishun, et al.
Published: (2026)
by: Yang, Qishun, et al.
Published: (2026)
Enhanced Privacy Leakage from Noise-Perturbed Gradients via Gradient-Guided Conditional Diffusion Models
by: Meng, Jiayang, et al.
Published: (2025)
by: Meng, Jiayang, et al.
Published: (2025)
Analysis of Privacy Leakage in Federated Large Language Models
by: Vu, Minh N., et al.
Published: (2024)
by: Vu, Minh N., et al.
Published: (2024)
Adaptive Multi-Subspace Representation Steering for Attribute Alignment in Large Language Models
by: Jiang, Xinyan, et al.
Published: (2025)
by: Jiang, Xinyan, et al.
Published: (2025)
Understanding Generalization and Forgetting in In-Context Continual Learning
by: Li, Guangyu, et al.
Published: (2026)
by: Li, Guangyu, et al.
Published: (2026)
Understanding the Repeat Curse in Large Language Models from a Feature Perspective
by: Yao, Junchi, et al.
Published: (2025)
by: Yao, Junchi, et al.
Published: (2025)
Neural Gate: Mitigating Privacy Risks in LVLMs via Neuron-Level Gradient Gating
by: Cao, Xiangkui, et al.
Published: (2026)
by: Cao, Xiangkui, et al.
Published: (2026)
Algorithmic Recourse of In-Context Learning for Tabular Data
by: Dong, Wenshuo, et al.
Published: (2026)
by: Dong, Wenshuo, et al.
Published: (2026)
Quantifying Association Capabilities of Large Language Models and Its Implications on Privacy Leakage
by: Shao, Hanyin, et al.
Published: (2023)
by: Shao, Hanyin, et al.
Published: (2023)
Zero-shot Cross-lingual NER via Mitigating Language Difference: An Entity-aligned Translation Perspective
by: Zhang, Zhihao, et al.
Published: (2025)
by: Zhang, Zhihao, et al.
Published: (2025)
Evaluating Privacy Leakage in Split Learning
by: Qiu, Xinchi, et al.
Published: (2023)
by: Qiu, Xinchi, et al.
Published: (2023)
Spurious Privacy Leakage in Neural Networks
by: Zhang, Chenxiang, et al.
Published: (2025)
by: Zhang, Chenxiang, et al.
Published: (2025)
An Empirical Study of Privacy Leakage Chains via Prompt Injection in Black-Box Chatbot Environments
by: Yang, Hongjang, et al.
Published: (2026)
by: Yang, Hongjang, et al.
Published: (2026)
APPLE: Adversarial Privacy-aware Perturbations on Latent Embedding for Unfairness Mitigation
by: Xu, Zikang, et al.
Published: (2024)
by: Xu, Zikang, et al.
Published: (2024)
Estimating Privacy Leakage of Augmented Contextual Knowledge in Language Models
by: Flemings, James, et al.
Published: (2024)
by: Flemings, James, et al.
Published: (2024)
The Phantom Menace: Unmasking Privacy Leakages in Vision-Language Models
by: Caldarella, Simone, et al.
Published: (2024)
by: Caldarella, Simone, et al.
Published: (2024)
Similar Items
-
Privacy-Aware Decoding: Mitigating Privacy Leakage of Large Language Models in Retrieval-Augmented Generation
by: Wang, Haoran, et al.
Published: (2025) -
Faithful Interpretation for Graph Neural Networks
by: Hu, Lijie, et al.
Published: (2024) -
Mitigating Semantic Leakage in Cross-lingual Embeddings via Orthogonality Constraint
by: Ki, Dayeon, et al.
Published: (2024) -
EAP-GP: Mitigating Saturation Effect in Gradient-based Automated Circuit Identification
by: Zhang, Lin, et al.
Published: (2025) -
The Compositional Architecture of Regret in Large Language Models
by: Cui, Xiangxiang, et al.
Published: (2025)