FreezeAsGuard: Mitigating Illegal Adaptation of Diffusion Models via Selective Tensor Freezing
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Kai, Wang, Haoming, Gao, Wei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CP-Guard+: A New Paradigm for Malicious Agent Detection and Defense in Collaborative Perception
por: Hu, Senkang, et al.
Publicado: (2025)
por: Hu, Senkang, et al.
Publicado: (2025)
A Probabilistic Fluctuation based Membership Inference Attack for Diffusion Models
por: Fu, Wenjie, et al.
Publicado: (2023)
por: Fu, Wenjie, et al.
Publicado: (2023)
Diffusion Soup: Model Merging for Text-to-Image Diffusion Models
por: Biggs, Benjamin, et al.
Publicado: (2024)
por: Biggs, Benjamin, et al.
Publicado: (2024)
Hypnopaedia-Aware Machine Unlearning via Psychometrics of Artificial Mental Imagery
por: Chang, Ching-Chun, et al.
Publicado: (2024)
por: Chang, Ching-Chun, et al.
Publicado: (2024)
Real-world Adversarial Defense against Patch Attacks based on Diffusion Model
por: Wei, Xingxing, et al.
Publicado: (2024)
por: Wei, Xingxing, et al.
Publicado: (2024)
Training Data Protection with Compositional Diffusion Models
por: Golatkar, Aditya, et al.
Publicado: (2023)
por: Golatkar, Aditya, et al.
Publicado: (2023)
REFINE: Inversion-Free Backdoor Defense via Model Reprogramming
por: Chen, Yukun, et al.
Publicado: (2025)
por: Chen, Yukun, et al.
Publicado: (2025)
SWA-LDM: Toward Stealthy Watermarks for Latent Diffusion Models
por: Yang, Zhonghao, et al.
Publicado: (2025)
por: Yang, Zhonghao, et al.
Publicado: (2025)
Towards Black-Box Membership Inference Attack for Diffusion Models
por: Li, Jingwei, et al.
Publicado: (2024)
por: Li, Jingwei, et al.
Publicado: (2024)
Redesigning Traffic Signs to Mitigate Machine-Learning Patch Attacks
por: Shua, Tsufit, et al.
Publicado: (2024)
por: Shua, Tsufit, et al.
Publicado: (2024)
PointNCBW: Towards Dataset Ownership Verification for Point Clouds via Negative Clean-label Backdoor Watermark
por: Wei, Cheng, et al.
Publicado: (2024)
por: Wei, Cheng, et al.
Publicado: (2024)
What Lurks Within? Concept Auditing for Shared Diffusion Models at Scale
por: Yuan, Xiaoyong, et al.
Publicado: (2025)
por: Yuan, Xiaoyong, et al.
Publicado: (2025)
DIFFender: Diffusion-Based Adversarial Defense against Patch Attacks
por: Kang, Caixin, et al.
Publicado: (2023)
por: Kang, Caixin, et al.
Publicado: (2023)
Towards Resilient Safety-driven Unlearning for Diffusion Models against Downstream Fine-tuning
por: Li, Boheng, et al.
Publicado: (2025)
por: Li, Boheng, et al.
Publicado: (2025)
OmniGuard: Unified Omni-Modal Guardrails with Deliberate Reasoning
por: Zhu, Boyu, et al.
Publicado: (2025)
por: Zhu, Boyu, et al.
Publicado: (2025)
SPQR: A Standardized Benchmark for Modern Safety Alignment Methods in Text-to-Image Diffusion Models
por: Alam, Mohammed Talha, et al.
Publicado: (2025)
por: Alam, Mohammed Talha, et al.
Publicado: (2025)
Selective Amnesia: On Efficient, High-Fidelity and Blind Suppression of Backdoor Effects in Trojaned Machine Learning Models
por: Zhu, Rui, et al.
Publicado: (2022)
por: Zhu, Rui, et al.
Publicado: (2022)
IDEA: An Inverse Domain Expert Adaptation Based Active DNN IP Protection Method
por: Xu, Chaohui, et al.
Publicado: (2024)
por: Xu, Chaohui, et al.
Publicado: (2024)
Kill it with FIRE: On Leveraging Latent Space Directions for Runtime Backdoor Mitigation in Deep Neural Networks
por: Ahlers, Enrico, et al.
Publicado: (2026)
por: Ahlers, Enrico, et al.
Publicado: (2026)
Efficient Backdoor Defense in Multimodal Contrastive Learning: A Token-Level Unlearning Method for Mitigating Threats
por: Liu, Kuanrong, et al.
Publicado: (2024)
por: Liu, Kuanrong, et al.
Publicado: (2024)
A Novel Defense Against Poisoning Attacks on Federated Learning: LayerCAM Augmented with Autoencoder
por: Zheng, Jingjing, et al.
Publicado: (2024)
por: Zheng, Jingjing, et al.
Publicado: (2024)
Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling
por: Cao, Yichuan, et al.
Publicado: (2025)
por: Cao, Yichuan, et al.
Publicado: (2025)
Efficient Black-box Adversarial Attacks via Bayesian Optimization Guided by a Function Prior
por: Cheng, Shuyu, et al.
Publicado: (2024)
por: Cheng, Shuyu, et al.
Publicado: (2024)
PromptGuard: Soft Prompt-Guided Unsafe Content Moderation for Text-to-Image Models
por: Yuan, Lingzhi, et al.
Publicado: (2025)
por: Yuan, Lingzhi, et al.
Publicado: (2025)
Improving Robustness to Model Inversion Attacks via Sparse Coding Architectures
por: Dibbo, Sayanton V., et al.
Publicado: (2024)
por: Dibbo, Sayanton V., et al.
Publicado: (2024)
Exploring User-level Gradient Inversion with a Diffusion Prior
por: Li, Zhuohang, et al.
Publicado: (2024)
por: Li, Zhuohang, et al.
Publicado: (2024)
REFORGE: Multi-modal Attacks Reveal Vulnerable Concept Unlearning in Image Generation Models
por: Zou, Yong, et al.
Publicado: (2026)
por: Zou, Yong, et al.
Publicado: (2026)
Towards Sample-specific Backdoor Attack with Clean Labels via Attribute Trigger
por: Zhu, Mingyan, et al.
Publicado: (2023)
por: Zhu, Mingyan, et al.
Publicado: (2023)
FC-Attack: Jailbreaking Multimodal Large Language Models via Auto-Generated Flowcharts
por: Zhang, Ziyi, et al.
Publicado: (2025)
por: Zhang, Ziyi, et al.
Publicado: (2025)
Transferable Black-Box One-Shot Forging of Watermarks via Image Preference Models
por: Souček, Tomáš, et al.
Publicado: (2025)
por: Souček, Tomáš, et al.
Publicado: (2025)
PubDef: Defending Against Transfer Attacks From Public Models
por: Sitawarin, Chawin, et al.
Publicado: (2023)
por: Sitawarin, Chawin, et al.
Publicado: (2023)
CLIP-Inspector: Model-Level Backdoor Detection for Prompt-Tuned CLIP via OOD Trigger Inversion
por: Jindal, Akshit, et al.
Publicado: (2026)
por: Jindal, Akshit, et al.
Publicado: (2026)
VLM-Guard: Safeguarding Vision-Language Models via Fulfilling Safety Alignment Gap
por: Liu, Qin, et al.
Publicado: (2025)
por: Liu, Qin, et al.
Publicado: (2025)
MM-PoisonRAG: Disrupting Multimodal RAG with Local and Global Poisoning Attacks
por: Ha, Hyeonjeong, et al.
Publicado: (2025)
por: Ha, Hyeonjeong, et al.
Publicado: (2025)
DarkLLM: Learning Language-Driven Adversarial Attacks with Large Language Models
por: Sun, Ye, et al.
Publicado: (2026)
por: Sun, Ye, et al.
Publicado: (2026)
PrivFedTalk: Privacy-Aware Federated Diffusion with Identity-Stable Adapters for Personalized Talking-Head Generation
por: Mazumdar, Soumya, et al.
Publicado: (2026)
por: Mazumdar, Soumya, et al.
Publicado: (2026)
Leave My Images Alone: Preventing Multi-Modal Large Language Models from Analyzing Images via Visual Prompt Injection
por: Shao, Zedian, et al.
Publicado: (2026)
por: Shao, Zedian, et al.
Publicado: (2026)
A Survey on Physical Adversarial Attacks against Face Recognition Systems
por: Wang, Mingsi, et al.
Publicado: (2024)
por: Wang, Mingsi, et al.
Publicado: (2024)
Better Safe than Sorry: Pre-training CLIP against Targeted Data Poisoning and Backdoor Attacks
por: Yang, Wenhan, et al.
Publicado: (2023)
por: Yang, Wenhan, et al.
Publicado: (2023)
CGI-DM: Digital Copyright Authentication for Diffusion Models via Contrasting Gradient Inversion
por: Wu, Xiaoyu, et al.
Publicado: (2024)
por: Wu, Xiaoyu, et al.
Publicado: (2024)
Ejemplares similares
-
CP-Guard+: A New Paradigm for Malicious Agent Detection and Defense in Collaborative Perception
por: Hu, Senkang, et al.
Publicado: (2025) -
A Probabilistic Fluctuation based Membership Inference Attack for Diffusion Models
por: Fu, Wenjie, et al.
Publicado: (2023) -
Diffusion Soup: Model Merging for Text-to-Image Diffusion Models
por: Biggs, Benjamin, et al.
Publicado: (2024) -
Hypnopaedia-Aware Machine Unlearning via Psychometrics of Artificial Mental Imagery
por: Chang, Ching-Chun, et al.
Publicado: (2024) -
Real-world Adversarial Defense against Patch Attacks based on Diffusion Model
por: Wei, Xingxing, et al.
Publicado: (2024)