Safeguarding Text-to-Image Generative Models Against Unauthorized Knowledge Distillation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gao, Yilan, Huang, Sida, Zhang, Hongyuan, Li, Xuelong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Do Not Merge My Model! Safeguarding Open-Source LLMs Against Unauthorized Model Merging
par: Li, Qinfeng, et autres
Publié: (2025)
par: Li, Qinfeng, et autres
Publié: (2025)
DistilLock: Safeguarding LLMs from Unauthorized Knowledge Distillation on the Edge
par: Mohanty, Asmita, et autres
Publié: (2025)
par: Mohanty, Asmita, et autres
Publié: (2025)
Encrypted Prompt: Securing LLM Applications Against Unauthorized Actions
par: Chan, Shih-Han
Publié: (2025)
par: Chan, Shih-Han
Publié: (2025)
TransLinkGuard: Safeguarding Transformer Models Against Model Stealing in Edge Deployment
par: Li, Qinfeng, et autres
Publié: (2024)
par: Li, Qinfeng, et autres
Publié: (2024)
TERD: A Unified Framework for Safeguarding Diffusion Models Against Backdoors
par: Mo, Yichuan, et autres
Publié: (2024)
par: Mo, Yichuan, et autres
Publié: (2024)
KnowledgeSG: Privacy-Preserving Synthetic Text Generation with Knowledge Distillation from Server
par: Wang, Wenhao, et autres
Publié: (2024)
par: Wang, Wenhao, et autres
Publié: (2024)
Membership Inference for Contrastive Pre-training Models with Text-only PII Queries
par: Cheng, Ruoxi, et autres
Publié: (2026)
par: Cheng, Ruoxi, et autres
Publié: (2026)
CoopGuard: Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Round Attacks
par: Li, Siyuan, et autres
Publié: (2026)
par: Li, Siyuan, et autres
Publié: (2026)
Safeguarding Large Language Models: A Survey
par: Dong, Yi, et autres
Publié: (2024)
par: Dong, Yi, et autres
Publié: (2024)
Re-Triggering Safeguards within LLMs for Jailbreak Detection
par: Lin, Zheng, et autres
Publié: (2026)
par: Lin, Zheng, et autres
Publié: (2026)
Web Intellectual Property at Risk: Preventing Unauthorized Real-Time Retrieval by Large Language Models
par: Zhong, Yisheng, et autres
Publié: (2025)
par: Zhong, Yisheng, et autres
Publié: (2025)
DistillGuard: Evaluating Defenses Against LLM Knowledge Distillation
par: Jiang, Bo
Publié: (2026)
par: Jiang, Bo
Publié: (2026)
Safeguarding Multimodal Knowledge Copyright in the RAG-as-a-Service Environment
par: Chen, Tianyu, et autres
Publié: (2025)
par: Chen, Tianyu, et autres
Publié: (2025)
Shattering the Echo Chamber: Hidden Safeguards in Manuscripts Against the AI Takeover of Peer Review
par: Ma, Oubo, et autres
Publié: (2026)
par: Ma, Oubo, et autres
Publié: (2026)
ExpShield: Safeguarding Web Text from Unauthorized Crawling and LLM Exploitation
par: Liu, Ruixuan, et autres
Publié: (2024)
par: Liu, Ruixuan, et autres
Publié: (2024)
GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
par: Liu, Yue, et autres
Publié: (2025)
par: Liu, Yue, et autres
Publié: (2025)
Exploring and Developing a Pre-Model Safeguard with Draft Models
par: Cai, Hongyu, et autres
Publié: (2026)
par: Cai, Hongyu, et autres
Publié: (2026)
On Evaluating the Durability of Safeguards for Open-Weight LLMs
par: Qi, Xiangyu, et autres
Publié: (2024)
par: Qi, Xiangyu, et autres
Publié: (2024)
CrossGuard: Safeguarding MLLMs against Joint-Modal Implicit Malicious Attacks
par: Zhang, Xu, et autres
Publié: (2025)
par: Zhang, Xu, et autres
Publié: (2025)
LLMs Caught in the Crossfire: Malware Requests and Jailbreak Challenges
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Evidencing Unauthorized Training Data from AI Generated Content using Information Isotopes
par: Tao, Qi, et autres
Publié: (2025)
par: Tao, Qi, et autres
Publié: (2025)
Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security
par: Dai, Muzhi, et autres
Publié: (2025)
par: Dai, Muzhi, et autres
Publié: (2025)
ART: Automatic Red-teaming for Text-to-Image Models to Protect Benign Users
par: Li, Guanlin, et autres
Publié: (2024)
par: Li, Guanlin, et autres
Publié: (2024)
Automatic Jailbreaking of the Text-to-Image Generative AI Systems
par: Kim, Minseon, et autres
Publié: (2024)
par: Kim, Minseon, et autres
Publié: (2024)
Embedding with Large Language Models for Classification of HIPAA Safeguard Compliance Rules
par: Rahman, Md Abdur, et autres
Publié: (2024)
par: Rahman, Md Abdur, et autres
Publié: (2024)
Nightshade: Prompt-Specific Poisoning Attacks on Text-to-Image Generative Models
par: Shan, Shawn, et autres
Publié: (2023)
par: Shan, Shawn, et autres
Publié: (2023)
CoreGuard: Safeguarding Foundational Capabilities of LLMs Against Model Stealing in Edge Deployment
par: Li, Qinfeng, et autres
Publié: (2024)
par: Li, Qinfeng, et autres
Publié: (2024)
Safeguarding Voice Privacy: Harnessing Near-Ultrasonic Interference To Protect Against Unauthorized Audio Recording
par: McKee, Forrest, et autres
Publié: (2024)
par: McKee, Forrest, et autres
Publié: (2024)
PromptKeeper: Safeguarding System Prompts for LLMs
par: Jiang, Zhifeng, et autres
Publié: (2024)
par: Jiang, Zhifeng, et autres
Publié: (2024)
Semantic-level Backdoor Attack against Text-to-Image Diffusion Models
par: Chen, Tianxin, et autres
Publié: (2026)
par: Chen, Tianxin, et autres
Publié: (2026)
Reflect-Guard: Enhancing LLM Safeguards against Adversarial Prompts via Logical Self-Reflection
par: Lin, Lixing, et autres
Publié: (2026)
par: Lin, Lixing, et autres
Publié: (2026)
Safeguarding Federated Learning-based Road Condition Classification
par: Liu, Sheng, et autres
Publié: (2025)
par: Liu, Sheng, et autres
Publié: (2025)
Safeguarding AI Agents: Developing and Analyzing Safety Architectures
par: Domkundwar, Ishaan, et autres
Publié: (2024)
par: Domkundwar, Ishaan, et autres
Publié: (2024)
GRID: Graph Representation of Intelligence Data for Security Text Knowledge Graph Construction
par: Huang, Liangyi, et autres
Publié: (2026)
par: Huang, Liangyi, et autres
Publié: (2026)
AdaShield: Safeguarding Multimodal Large Language Models from Structure-based Attack via Adaptive Shield Prompting
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Jailbreaking Safeguarded Text-to-Image Models via Large Language Models
par: Jiang, Zhengyuan, et autres
Publié: (2025)
par: Jiang, Zhengyuan, et autres
Publié: (2025)
Robust Knowledge Distillation in Federated Learning: Counteracting Backdoor Attacks
par: Alharbi, Ebtisaam, et autres
Publié: (2025)
par: Alharbi, Ebtisaam, et autres
Publié: (2025)
LLM Safeguard is a Double-Edged Sword: Exploiting False Positives for Denial-of-Service Attacks
par: Zhang, Qingzhao, et autres
Publié: (2024)
par: Zhang, Qingzhao, et autres
Publié: (2024)
Membership Inference Attacks Against Vision-Language Models
par: Hu, Yuke, et autres
Publié: (2025)
par: Hu, Yuke, et autres
Publié: (2025)
GuardReasoner: Towards Reasoning-based LLM Safeguards
par: Liu, Yue, et autres
Publié: (2025)
par: Liu, Yue, et autres
Publié: (2025)
Documents similaires
-
Do Not Merge My Model! Safeguarding Open-Source LLMs Against Unauthorized Model Merging
par: Li, Qinfeng, et autres
Publié: (2025) -
DistilLock: Safeguarding LLMs from Unauthorized Knowledge Distillation on the Edge
par: Mohanty, Asmita, et autres
Publié: (2025) -
Encrypted Prompt: Securing LLM Applications Against Unauthorized Actions
par: Chan, Shih-Han
Publié: (2025) -
TransLinkGuard: Safeguarding Transformer Models Against Model Stealing in Edge Deployment
par: Li, Qinfeng, et autres
Publié: (2024) -
TERD: A Unified Framework for Safeguarding Diffusion Models Against Backdoors
par: Mo, Yichuan, et autres
Publié: (2024)