Six-CD: Benchmarking Concept Removals for Benign Text-to-image Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Ren, Jie, Chen, Kangrui, Cui, Yingqian, Zeng, Shenglai, Liu, Hui, Xing, Yue, Tang, Jiliang, Lyu, Lingjuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Unveiling and Mitigating Memorization in Text-to-image Diffusion Models through Cross Attention
di: Ren, Jie, et al.
Pubblicazione: (2024)
di: Ren, Jie, et al.
Pubblicazione: (2024)
EnTruth: Enhancing the Traceability of Unauthorized Dataset Usage in Text-to-image Diffusion Models with Minimal and Robust Alterations
di: Ren, Jie, et al.
Pubblicazione: (2024)
di: Ren, Jie, et al.
Pubblicazione: (2024)
FT-Shield: A Watermark Against Unauthorized Fine-tuning in Text-to-Image Diffusion Models
di: Cui, Yingqian, et al.
Pubblicazione: (2023)
di: Cui, Yingqian, et al.
Pubblicazione: (2023)
Stealthy Backdoor Attack via Confidence-driven Sampling
di: He, Pengfei, et al.
Pubblicazione: (2023)
di: He, Pengfei, et al.
Pubblicazione: (2023)
DiffusionShield: A Watermark for Copyright Protection against Generative Diffusion Models
di: Cui, Yingqian, et al.
Pubblicazione: (2023)
di: Cui, Yingqian, et al.
Pubblicazione: (2023)
Copyright Protection in Generative AI: A Technical Perspective
di: Ren, Jie, et al.
Pubblicazione: (2024)
di: Ren, Jie, et al.
Pubblicazione: (2024)
Mitigating the Privacy Issues in Retrieval-Augmented Generation (RAG) via Pure Synthetic Data
di: Zeng, Shenglai, et al.
Pubblicazione: (2024)
di: Zeng, Shenglai, et al.
Pubblicazione: (2024)
Sharpness-Aware Data Poisoning Attack
di: He, Pengfei, et al.
Pubblicazione: (2023)
di: He, Pengfei, et al.
Pubblicazione: (2023)
A Robust Semantics-based Watermark for Large Language Model against Paraphrasing
di: Ren, Jie, et al.
Pubblicazione: (2023)
di: Ren, Jie, et al.
Pubblicazione: (2023)
SoK: Machine Unlearning for Large Language Models
di: Ren, Jie, et al.
Pubblicazione: (2025)
di: Ren, Jie, et al.
Pubblicazione: (2025)
Unveiling Privacy Risks in LLM Agent Memory
di: Wang, Bo, et al.
Pubblicazione: (2025)
di: Wang, Bo, et al.
Pubblicazione: (2025)
Beyond Text: Unveiling Privacy Vulnerabilities in Multi-modal Retrieval-Augmented Generation
di: Zhang, Jiankun, et al.
Pubblicazione: (2025)
di: Zhang, Jiankun, et al.
Pubblicazione: (2025)
Keeping an Eye on LLM Unlearning: The Hidden Risk and Remedy
di: Ren, Jie, et al.
Pubblicazione: (2025)
di: Ren, Jie, et al.
Pubblicazione: (2025)
RLCP: A Reinforcement Learning-based Copyright Protection Method for Text-to-Image Diffusion Model
di: Shi, Zhuan, et al.
Pubblicazione: (2024)
di: Shi, Zhuan, et al.
Pubblicazione: (2024)
The Good and The Bad: Exploring Privacy Issues in Retrieval-Augmented Generation (RAG)
di: Zeng, Shenglai, et al.
Pubblicazione: (2024)
di: Zeng, Shenglai, et al.
Pubblicazione: (2024)
DIAGNOSIS: Detecting Unauthorized Data Usages in Text-to-image Diffusion Models
di: Wang, Zhenting, et al.
Pubblicazione: (2023)
di: Wang, Zhenting, et al.
Pubblicazione: (2023)
Data Poisoning for In-context Learning
di: He, Pengfei, et al.
Pubblicazione: (2024)
di: He, Pengfei, et al.
Pubblicazione: (2024)
To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems
di: He, Pengfei, et al.
Pubblicazione: (2025)
di: He, Pengfei, et al.
Pubblicazione: (2025)
Multi-Faceted Studies on Data Poisoning can Advance LLM Development
di: He, Pengfei, et al.
Pubblicazione: (2025)
di: He, Pengfei, et al.
Pubblicazione: (2025)
FederBoost: Private Federated Learning for GBDT
di: Tian, Zhihua, et al.
Pubblicazione: (2020)
di: Tian, Zhihua, et al.
Pubblicazione: (2020)
ART: Automatic Red-teaming for Text-to-Image Models to Protect Benign Users
di: Li, Guanlin, et al.
Pubblicazione: (2024)
di: Li, Guanlin, et al.
Pubblicazione: (2024)
On the Proactive Generation of Unsafe Images From Text-To-Image Models Using Benign Prompts
di: Wu, Yixin, et al.
Pubblicazione: (2023)
di: Wu, Yixin, et al.
Pubblicazione: (2023)
FedP3: Federated Personalized and Privacy-friendly Network Pruning under Model Heterogeneity
di: Yi, Kai, et al.
Pubblicazione: (2024)
di: Yi, Kai, et al.
Pubblicazione: (2024)
Sybil-based Virtual Data Poisoning Attacks in Federated Learning
di: Zhu, Changxun, et al.
Pubblicazione: (2025)
di: Zhu, Changxun, et al.
Pubblicazione: (2025)
PT-Mark: Invisible Watermarking for Text-to-image Diffusion Models via Semantic-aware Pivotal Tuning
di: Wang, Yaopeng, et al.
Pubblicazione: (2025)
di: Wang, Yaopeng, et al.
Pubblicazione: (2025)
Write+Sync: Software Cache Write Covert Channels Exploiting Memory-disk Synchronization
di: Chen, Congcong, et al.
Pubblicazione: (2023)
di: Chen, Congcong, et al.
Pubblicazione: (2023)
Attacks on Approximate Caches in Text-to-Image Diffusion Models
di: Sun, Desen, et al.
Pubblicazione: (2025)
di: Sun, Desen, et al.
Pubblicazione: (2025)
When There Is No Decoder: Removing Watermarks from Stable Diffusion Models in a No-box Setting
di: Wu, Xiaodong, et al.
Pubblicazione: (2025)
di: Wu, Xiaodong, et al.
Pubblicazione: (2025)
BETA: Automated Black-box Exploration for Timing Attacks in Processors
di: Chen, Congcong, et al.
Pubblicazione: (2024)
di: Chen, Congcong, et al.
Pubblicazione: (2024)
CoreUnlearn: Rethinking Concept Unlearning through Disentangled Component-Level Erasure in Text-guided Diffusion Models
di: Zhao, Mengnan, et al.
Pubblicazione: (2026)
di: Zhao, Mengnan, et al.
Pubblicazione: (2026)
Bi-Erasing: A Bidirectional Framework for Concept Removal in Diffusion Models
di: Chen, Hao, et al.
Pubblicazione: (2025)
di: Chen, Hao, et al.
Pubblicazione: (2025)
BackdoorDM: A Comprehensive Benchmark for Backdoor Learning on Diffusion Model
di: Lin, Weilin, et al.
Pubblicazione: (2025)
di: Lin, Weilin, et al.
Pubblicazione: (2025)
Defending against Indirect Prompt Injection by Instruction Detection
di: Wen, Tongyu, et al.
Pubblicazione: (2025)
di: Wen, Tongyu, et al.
Pubblicazione: (2025)
Effectiveness of Adversarial Benign and Malware Examples in Evasion and Poisoning Attacks
di: Kozák, Matouš, et al.
Pubblicazione: (2025)
di: Kozák, Matouš, et al.
Pubblicazione: (2025)
Towards Classifying Benign And Malicious Packages Using Machine Learning
di: Nguyen, Thanh-Cong, et al.
Pubblicazione: (2025)
di: Nguyen, Thanh-Cong, et al.
Pubblicazione: (2025)
Awakening the Hydra: Stabilizing Multi-Concept Backdoor Injection in Text-to-Image Diffusion Models
di: Wang, Kai, et al.
Pubblicazione: (2026)
di: Wang, Kai, et al.
Pubblicazione: (2026)
DH-TRNG: A Dynamic Hybrid TRNG with Ultra-High Throughput and Area-Energy Efficiency
di: Zhang, Yuan, et al.
Pubblicazione: (2025)
di: Zhang, Yuan, et al.
Pubblicazione: (2025)
Sugar-Coated Poison: Benign Generation Unlocks LLM Jailbreaking
di: Wu, Yu-Hang, et al.
Pubblicazione: (2025)
di: Wu, Yu-Hang, et al.
Pubblicazione: (2025)
LLMs Can Unlearn Refusal with Only 1,000 Benign Samples
di: Guo, Yangyang, et al.
Pubblicazione: (2026)
di: Guo, Yangyang, et al.
Pubblicazione: (2026)
Can Indirect Prompt Injection Attacks Be Detected and Removed?
di: Chen, Yulin, et al.
Pubblicazione: (2025)
di: Chen, Yulin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Unveiling and Mitigating Memorization in Text-to-image Diffusion Models through Cross Attention
di: Ren, Jie, et al.
Pubblicazione: (2024) -
EnTruth: Enhancing the Traceability of Unauthorized Dataset Usage in Text-to-image Diffusion Models with Minimal and Robust Alterations
di: Ren, Jie, et al.
Pubblicazione: (2024) -
FT-Shield: A Watermark Against Unauthorized Fine-tuning in Text-to-Image Diffusion Models
di: Cui, Yingqian, et al.
Pubblicazione: (2023) -
Stealthy Backdoor Attack via Confidence-driven Sampling
di: He, Pengfei, et al.
Pubblicazione: (2023) -
DiffusionShield: A Watermark for Copyright Protection against Generative Diffusion Models
di: Cui, Yingqian, et al.
Pubblicazione: (2023)