LLM-based Privacy Data Augmentation Guided by Knowledge Distillation with a Distribution Tutor for Medical Text Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Song, Yiping, Zhang, Juhua, Tian, Zhiliang, Yang, Yuxin, Huang, Minlie, Li, Dongsheng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Double-edged Sword of LLM-based Data Reconstruction: Understanding and Mitigating Contextual Vulnerability in Word-level Differential Privacy Text Sanitization
par: Meisenbacher, Stephen, et autres
Publié: (2025)
par: Meisenbacher, Stephen, et autres
Publié: (2025)
Beyond Text: Unveiling Privacy Vulnerabilities in Multi-modal Retrieval-Augmented Generation
par: Zhang, Jiankun, et autres
Publié: (2025)
par: Zhang, Jiankun, et autres
Publié: (2025)
MaskSQL: Safeguarding Privacy for LLM-Based Text-to-SQL via Abstraction
par: Abedini, Sepideh, et autres
Publié: (2025)
par: Abedini, Sepideh, et autres
Publié: (2025)
DistillGuard: Evaluating Defenses Against LLM Knowledge Distillation
par: Jiang, Bo
Publié: (2026)
par: Jiang, Bo
Publié: (2026)
Factuality Beyond Coherence: Evaluating LLM Watermarking Methods for Medical Texts
par: Hastuti, Rochana Prih, et autres
Publié: (2025)
par: Hastuti, Rochana Prih, et autres
Publié: (2025)
Spend Your Budget Wisely: Towards an Intelligent Distribution of the Privacy Budget in Differentially Private Text Rewriting
par: Meisenbacher, Stephen, et autres
Publié: (2025)
par: Meisenbacher, Stephen, et autres
Publié: (2025)
Differentially Private Knowledge Distillation via Synthetic Text Generation
par: Flemings, James, et autres
Publié: (2024)
par: Flemings, James, et autres
Publié: (2024)
TextSeal: A Localized LLM Watermark for Provenance & Distillation Protection
par: Sander, Tom, et autres
Publié: (2026)
par: Sander, Tom, et autres
Publié: (2026)
The Canary's Echo: Auditing Privacy Risks of LLM-Generated Synthetic Text
par: Meeus, Matthieu, et autres
Publié: (2025)
par: Meeus, Matthieu, et autres
Publié: (2025)
Beyond Theoretical Bounds: Empirical Privacy Loss Calibration for Text Rewriting Under Local Differential Privacy
par: Li, Weijun, et autres
Publié: (2026)
par: Li, Weijun, et autres
Publié: (2026)
SoK: Privacy Risks and Mitigations in Retrieval-Augmented Generation Systems
par: Bodea, Andreea-Elena, et autres
Publié: (2026)
par: Bodea, Andreea-Elena, et autres
Publié: (2026)
Privacy-R1: Privacy-Aware Multi-LLM Agent Collaboration via Reinforcement Learning
par: Hui, Zheng, et autres
Publié: (2025)
par: Hui, Zheng, et autres
Publié: (2025)
Deep Active Learning with Crowdsourcing Data for Privacy Policy Classification
par: Qiu, Wenjun, et autres
Publié: (2020)
par: Qiu, Wenjun, et autres
Publié: (2020)
Confidential Prompting: Privacy-preserving LLM Inference on Cloud
par: Li, Caihua, et autres
Publié: (2024)
par: Li, Caihua, et autres
Publié: (2024)
Privacy-Preserving Retrieval-Augmented Generation with Differential Privacy
par: Koga, Tatsuki, et autres
Publié: (2024)
par: Koga, Tatsuki, et autres
Publié: (2024)
DP-BART for Privatized Text Rewriting under Local Differential Privacy
par: Igamberdiev, Timour, et autres
Publié: (2023)
par: Igamberdiev, Timour, et autres
Publié: (2023)
IncogniText: Privacy-enhancing Conditional Text Anonymization via LLM-based Private Attribute Randomization
par: Frikha, Ahmed, et autres
Publié: (2024)
par: Frikha, Ahmed, et autres
Publié: (2024)
GuidedBench: Measuring and Mitigating the Evaluation Discrepancies of In-the-wild LLM Jailbreak Methods
par: Huang, Ruixuan, et autres
Publié: (2025)
par: Huang, Ruixuan, et autres
Publié: (2025)
Hidden Data Privacy Breaches in Federated Learning
par: Gong, Xueluan, et autres
Publié: (2024)
par: Gong, Xueluan, et autres
Publié: (2024)
Privacy Checklist: Privacy Violation Detection Grounding on Contextual Integrity Theory
par: Li, Haoran, et autres
Publié: (2024)
par: Li, Haoran, et autres
Publié: (2024)
KnowledgeSG: Privacy-Preserving Synthetic Text Generation with Knowledge Distillation from Server
par: Wang, Wenhao, et autres
Publié: (2024)
par: Wang, Wenhao, et autres
Publié: (2024)
SafeSearch: Automated Red-Teaming of LLM-Based Search Agents
par: Dong, Jianshuo, et autres
Publié: (2025)
par: Dong, Jianshuo, et autres
Publié: (2025)
"Yes, My LoRD." Guiding Language Model Extraction with Locality Reinforced Distillation
par: Liang, Zi, et autres
Publié: (2024)
par: Liang, Zi, et autres
Publié: (2024)
RAG Safety: Exploring Knowledge Poisoning Attacks to Retrieval-Augmented Generation
par: Zhao, Tianzhe, et autres
Publié: (2025)
par: Zhao, Tianzhe, et autres
Publié: (2025)
DiDOTS: Knowledge Distillation from Large-Language-Models for Dementia Obfuscation in Transcribed Speech
par: Woszczyk, Dominika, et autres
Publié: (2024)
par: Woszczyk, Dominika, et autres
Publié: (2024)
GLiGuard: Schema-Conditioned Classification for LLM Safeguard
par: Zaratiana, Urchade, et autres
Publié: (2026)
par: Zaratiana, Urchade, et autres
Publié: (2026)
MemPrivacy: Privacy-Preserving Personalized Memory Management for Edge-Cloud Agents
par: Chen, Yining, et autres
Publié: (2026)
par: Chen, Yining, et autres
Publié: (2026)
Continual Pretraining on Encrypted Synthetic Data for Privacy-Preserving LLMs
par: Liu, Honghao, et autres
Publié: (2026)
par: Liu, Honghao, et autres
Publié: (2026)
A General Pseudonymization Framework for Cloud-Based LLMs: Replacing Privacy Information in Controlled Text Generation
par: Hou, Shilong, et autres
Publié: (2025)
par: Hou, Shilong, et autres
Publié: (2025)
On the Hidden Costs of Counterfactual Knowledge Training in LLM Unlearning
par: Ye, Xiaotian, et autres
Publié: (2026)
par: Ye, Xiaotian, et autres
Publié: (2026)
HARMONIC: Harnessing LLMs for Tabular Data Synthesis and Privacy Protection
par: Wang, Yuxin, et autres
Publié: (2024)
par: Wang, Yuxin, et autres
Publié: (2024)
Feedback-Guided Extraction of Knowledge Base from Retrieval-Augmented LLM Applications
par: Jiang, Changyue, et autres
Publié: (2024)
par: Jiang, Changyue, et autres
Publié: (2024)
Federated Domain-Specific Knowledge Transfer on Large Language Models Using Synthetic Data
par: Li, Haoran, et autres
Publié: (2024)
par: Li, Haoran, et autres
Publié: (2024)
PRISM: Privacy-Aware Routing for Adaptive Cloud-Edge LLM Inference via Semantic Sketch Collaboration
par: Zhan, Junfei, et autres
Publié: (2025)
par: Zhan, Junfei, et autres
Publié: (2025)
Contextualized Privacy Defense for LLM Agents
par: Wen, Yule, et autres
Publié: (2026)
par: Wen, Yule, et autres
Publié: (2026)
When Machine Unlearning Meets Retrieval-Augmented Generation (RAG): Keep Secret or Forget Knowledge?
par: Wang, Shang, et autres
Publié: (2024)
par: Wang, Shang, et autres
Publié: (2024)
CERT-ED: Certifiably Robust Text Classification for Edit Distance
par: Huang, Zhuoqun, et autres
Publié: (2024)
par: Huang, Zhuoqun, et autres
Publié: (2024)
StructuralSleight: Automated Jailbreak Attacks on Large Language Models Utilizing Uncommon Text-Organization Structures
par: Li, Bangxin, et autres
Publié: (2024)
par: Li, Bangxin, et autres
Publié: (2024)
Data Extraction Attacks in Retrieval-Augmented Generation via Backdoors
par: Peng, Yuefeng, et autres
Publié: (2024)
par: Peng, Yuefeng, et autres
Publié: (2024)
Efficiently and Effectively: A Two-stage Approach to Balance Plaintext and Encrypted Text for Traffic Classification
par: Peng, Wei, et autres
Publié: (2024)
par: Peng, Wei, et autres
Publié: (2024)
Documents similaires
-
The Double-edged Sword of LLM-based Data Reconstruction: Understanding and Mitigating Contextual Vulnerability in Word-level Differential Privacy Text Sanitization
par: Meisenbacher, Stephen, et autres
Publié: (2025) -
Beyond Text: Unveiling Privacy Vulnerabilities in Multi-modal Retrieval-Augmented Generation
par: Zhang, Jiankun, et autres
Publié: (2025) -
MaskSQL: Safeguarding Privacy for LLM-Based Text-to-SQL via Abstraction
par: Abedini, Sepideh, et autres
Publié: (2025) -
DistillGuard: Evaluating Defenses Against LLM Knowledge Distillation
par: Jiang, Bo
Publié: (2026) -
Factuality Beyond Coherence: Evaluating LLM Watermarking Methods for Medical Texts
par: Hastuti, Rochana Prih, et autres
Publié: (2025)