Defeating Cerberus: Concept-Guided Privacy-Leakage Mitigation in Multimodal Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Boyang, Akkus, Istemi Ekin, Chen, Ruichuan, Dethise, Alice, Satzke, Klaus, Rimac, Ivica, Zhang, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Protecting Confidentiality, Privacy and Integrity in Collaborative Learning
di: Chen, Dong, et al.
Pubblicazione: (2024)
di: Chen, Dong, et al.
Pubblicazione: (2024)
Model Hijacking Attack in Federated Learning
di: Li, Zheng, et al.
Pubblicazione: (2024)
di: Li, Zheng, et al.
Pubblicazione: (2024)
Propelling Innovation to Defeat Data-Leakage Hardware Trojans: From Theory to Practice
di: Kwiat, Kevin, et al.
Pubblicazione: (2024)
di: Kwiat, Kevin, et al.
Pubblicazione: (2024)
Mitigating Data Poisoning Attacks to Local Differential Privacy
di: Li, Xiaolin, et al.
Pubblicazione: (2025)
di: Li, Xiaolin, et al.
Pubblicazione: (2025)
Sanitize Your Responses: Mitigating Privacy Leakage in Large Language Models
di: Fu, Wenjie, et al.
Pubblicazione: (2025)
di: Fu, Wenjie, et al.
Pubblicazione: (2025)
PATCH: Mitigating PII Leakage in Language Models with Privacy-Aware Targeted Circuit PatcHing
di: Hughes, Anthony, et al.
Pubblicazione: (2025)
di: Hughes, Anthony, et al.
Pubblicazione: (2025)
Generated Data with Fake Privacy: Hidden Dangers of Fine-tuning Large Language Models on Generated Data
di: Akkus, Atilla, et al.
Pubblicazione: (2024)
di: Akkus, Atilla, et al.
Pubblicazione: (2024)
Analysis of Privacy Leakage in Federated Large Language Models
di: Vu, Minh N., et al.
Pubblicazione: (2024)
di: Vu, Minh N., et al.
Pubblicazione: (2024)
Enhanced Privacy Leakage from Noise-Perturbed Gradients via Gradient-Guided Conditional Diffusion Models
di: Meng, Jiayang, et al.
Pubblicazione: (2025)
di: Meng, Jiayang, et al.
Pubblicazione: (2025)
Computing Maximal Per-Record Leakage and Leakage-Distortion Functions for Privacy Mechanisms under Entropy-Constrained Adversaries
di: Wu, Genqiang, et al.
Pubblicazione: (2026)
di: Wu, Genqiang, et al.
Pubblicazione: (2026)
CRFU: Compressive Representation Forgetting Against Privacy Leakage on Machine Unlearning
di: Wang, Weiqi, et al.
Pubblicazione: (2025)
di: Wang, Weiqi, et al.
Pubblicazione: (2025)
On Defeating Graph Analysis of Anonymous Transactions
di: Egger, Christoph, et al.
Pubblicazione: (2024)
di: Egger, Christoph, et al.
Pubblicazione: (2024)
HTTP Request Synchronization Defeats Discrepancy Attacks
di: Topcuoglu, Cem, et al.
Pubblicazione: (2025)
di: Topcuoglu, Cem, et al.
Pubblicazione: (2025)
Symmetry Defeats Auditing
di: Merrill, Nick, et al.
Pubblicazione: (2026)
di: Merrill, Nick, et al.
Pubblicazione: (2026)
Privacy Leakage Overshadowed by Views of AI: A Study on Human Oversight of Privacy in Language Model Agent
di: Zhang, Zhiping, et al.
Pubblicazione: (2024)
di: Zhang, Zhiping, et al.
Pubblicazione: (2024)
Gradient-Free Privacy Leakage in Federated Language Models through Selective Weight Tampering
di: Rashid, Md Rafi Ur, et al.
Pubblicazione: (2023)
di: Rashid, Md Rafi Ur, et al.
Pubblicazione: (2023)
Resurrection Attack: Defeating Xilinx MPU's Memory Protection
di: Madabhushi, Bharadwaj, et al.
Pubblicazione: (2024)
di: Madabhushi, Bharadwaj, et al.
Pubblicazione: (2024)
Tracing Privacy Leakage of Language Models to Training Data via Adjusted Influence Functions
di: Liu, Jinxin, et al.
Pubblicazione: (2024)
di: Liu, Jinxin, et al.
Pubblicazione: (2024)
PriRoAgg: Achieving Robust Model Aggregation with Minimum Privacy Leakage for Federated Learning
di: Hou, Sizai, et al.
Pubblicazione: (2024)
di: Hou, Sizai, et al.
Pubblicazione: (2024)
"Training robust watermarking model may hurt authentication!'' Exploring and Mitigating the Identity Leakage in Robust Watermarking
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
Driving Privacy Forward: Mitigating Information Leakage within Smart Vehicles through Synthetic Data Generation
di: Parikh, Krish
Pubblicazione: (2024)
di: Parikh, Krish
Pubblicazione: (2024)
SMOTE and Mirrors: Exposing Privacy Leakage from Synthetic Minority Oversampling
di: Ganev, Georgi, et al.
Pubblicazione: (2025)
di: Ganev, Georgi, et al.
Pubblicazione: (2025)
Defeating Prompt Injections by Design
di: Debenedetti, Edoardo, et al.
Pubblicazione: (2025)
di: Debenedetti, Edoardo, et al.
Pubblicazione: (2025)
Zebrafix: Mitigating Memory-Centric Side-Channel Leakage via Interleaving
di: Pätschke, Anna, et al.
Pubblicazione: (2025)
di: Pätschke, Anna, et al.
Pubblicazione: (2025)
POLARIS: Explainable Artificial Intelligence for Mitigating Power Side-Channel Leakage
di: Mahfuz, Tanzim, et al.
Pubblicazione: (2025)
di: Mahfuz, Tanzim, et al.
Pubblicazione: (2025)
Privacy-Preserving Federated Learning Scheme with Mitigating Model Poisoning Attacks: Vulnerabilities and Countermeasures
di: Wu, Jiahui, et al.
Pubblicazione: (2025)
di: Wu, Jiahui, et al.
Pubblicazione: (2025)
PrivTru: A Privacy-by-Design Data Trustee Minimizing Information Leakage
di: Gehring, Lukas, et al.
Pubblicazione: (2025)
di: Gehring, Lukas, et al.
Pubblicazione: (2025)
Revisiting Privacy Leakage in Machine Unlearning: Membership Inference Beyond the Forgotten Set
di: Fu, Jie, et al.
Pubblicazione: (2026)
di: Fu, Jie, et al.
Pubblicazione: (2026)
Observable Channels, Not Just Storage: Evaluating Privacy Leakage in LLM Agent Pipelines
di: Huang, Tao, et al.
Pubblicazione: (2026)
di: Huang, Tao, et al.
Pubblicazione: (2026)
Privacy-preserving Prompt Personalization in Federated Learning for Multimodal Large Language Models
di: Hou, Sizai, et al.
Pubblicazione: (2025)
di: Hou, Sizai, et al.
Pubblicazione: (2025)
Fuzzing at Scale: The Untold Story of the Scheduler
di: Nikolic, Ivica, et al.
Pubblicazione: (2024)
di: Nikolic, Ivica, et al.
Pubblicazione: (2024)
The Hidden Cost of Correlation: Rethinking Privacy Leakage in Local Differential Privacy
di: Jayawardana, Sandaru, et al.
Pubblicazione: (2025)
di: Jayawardana, Sandaru, et al.
Pubblicazione: (2025)
Real-Time Privacy Risk Measurement with Privacy Tokens for Gradient Leakage
di: Meng, Jiayang, et al.
Pubblicazione: (2025)
di: Meng, Jiayang, et al.
Pubblicazione: (2025)
CompLeak: Deep Learning Model Compression Exacerbates Privacy Leakage
di: Li, Na, et al.
Pubblicazione: (2025)
di: Li, Na, et al.
Pubblicazione: (2025)
InferDPT: Privacy-Preserving Inference for Closed-box Large Language Model
di: Tong, Meng, et al.
Pubblicazione: (2023)
di: Tong, Meng, et al.
Pubblicazione: (2023)
Quantifying Privacy Leakage in Split Inference via Fisher-Approximated Shannon Information Analysis
di: Deng, Ruijun, et al.
Pubblicazione: (2025)
di: Deng, Ruijun, et al.
Pubblicazione: (2025)
CTIGuardian: A Few-Shot Framework for Mitigating Privacy Leakage in Fine-Tuned LLMs
di: Arachchige, Shashie Dilhara Batan, et al.
Pubblicazione: (2025)
di: Arachchige, Shashie Dilhara Batan, et al.
Pubblicazione: (2025)
The Gradient Puppeteer: Adversarial Domination in Gradient Leakage Attacks through Model Poisoning
di: Xiang, Kunlan, et al.
Pubblicazione: (2025)
di: Xiang, Kunlan, et al.
Pubblicazione: (2025)
CircuitGuard: Mitigating LLM Memorization in RTL Code Generation Against IP Leakage
di: Mashnoor, Nowfel, et al.
Pubblicazione: (2025)
di: Mashnoor, Nowfel, et al.
Pubblicazione: (2025)
SWAT: A System-Wide Approach to Tunable Leakage Mitigation in Encrypted Data Stores
di: Zheng, Leqian, et al.
Pubblicazione: (2023)
di: Zheng, Leqian, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Protecting Confidentiality, Privacy and Integrity in Collaborative Learning
di: Chen, Dong, et al.
Pubblicazione: (2024) -
Model Hijacking Attack in Federated Learning
di: Li, Zheng, et al.
Pubblicazione: (2024) -
Propelling Innovation to Defeat Data-Leakage Hardware Trojans: From Theory to Practice
di: Kwiat, Kevin, et al.
Pubblicazione: (2024) -
Mitigating Data Poisoning Attacks to Local Differential Privacy
di: Li, Xiaolin, et al.
Pubblicazione: (2025) -
Sanitize Your Responses: Mitigating Privacy Leakage in Large Language Models
di: Fu, Wenjie, et al.
Pubblicazione: (2025)