Backdooring Bias ($B^2$) into Stable Diffusion Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Naseh, Ali, Roh, Jaechul, Bagdasarian, Eugene, Houmansadr, Amir |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Throttling Web Agents Using Reasoning Gates
por: Kumar, Abhinav, et al.
Publicado: (2025)
por: Kumar, Abhinav, et al.
Publicado: (2025)
OverThink: Slowdown Attacks on Reasoning LLMs
por: Kumar, Abhinav, et al.
Publicado: (2025)
por: Kumar, Abhinav, et al.
Publicado: (2025)
R1dacted: Investigating Local Censorship in DeepSeek's R1 Language Model
por: Naseh, Ali, et al.
Publicado: (2025)
por: Naseh, Ali, et al.
Publicado: (2025)
OSLO: One-Shot Label-Only Membership Inference Attacks
por: Peng, Yuefeng, et al.
Publicado: (2024)
por: Peng, Yuefeng, et al.
Publicado: (2024)
Multilingual and Multi-Accent Jailbreaking of Audio LLMs
por: Roh, Jaechul, et al.
Publicado: (2025)
por: Roh, Jaechul, et al.
Publicado: (2025)
Benign Fine-Tuning Breaks Safety Alignment in Audio LLMs
por: Roh, Jaechul, et al.
Publicado: (2026)
por: Roh, Jaechul, et al.
Publicado: (2026)
Diffence: Fencing Membership Privacy With Diffusion Models
por: Peng, Yuefeng, et al.
Publicado: (2023)
por: Peng, Yuefeng, et al.
Publicado: (2023)
Network-Level Prompt and Trait Leakage in Local Research Agents
por: Jeong, Hyejun, et al.
Publicado: (2025)
por: Jeong, Hyejun, et al.
Publicado: (2025)
Riddle Me This! Stealthy Membership Inference for Retrieval-Augmented Generation
por: Naseh, Ali, et al.
Publicado: (2025)
por: Naseh, Ali, et al.
Publicado: (2025)
Can Large Language Models Really Recognize Your Name?
por: Pham, Dzung, et al.
Publicado: (2025)
por: Pham, Dzung, et al.
Publicado: (2025)
Exploiting Leaderboards for Large-Scale Distribution of Malicious Models
por: Suri, Anshuman, et al.
Publicado: (2025)
por: Suri, Anshuman, et al.
Publicado: (2025)
Text-to-Image Models Leave Identifiable Signatures: Implications for Leaderboard Security
por: Naseh, Ali, et al.
Publicado: (2025)
por: Naseh, Ali, et al.
Publicado: (2025)
FameBias: Embedding Manipulation Bias Attack in Text-to-Image Models
por: Roh, Jaechul, et al.
Publicado: (2024)
por: Roh, Jaechul, et al.
Publicado: (2024)
Self-interpreting Adversarial Images
por: Zhang, Tingwei, et al.
Publicado: (2024)
por: Zhang, Tingwei, et al.
Publicado: (2024)
Trusted Machine Learning Models Unlock Private Inference for Problems Currently Infeasible with Cryptography
por: Shumailov, Ilia, et al.
Publicado: (2025)
por: Shumailov, Ilia, et al.
Publicado: (2025)
PostMark: A Robust Blackbox Watermark for Large Language Models
por: Chang, Yapei, et al.
Publicado: (2024)
por: Chang, Yapei, et al.
Publicado: (2024)
TERD: A Unified Framework for Safeguarding Diffusion Models Against Backdoors
por: Mo, Yichuan, et al.
Publicado: (2024)
por: Mo, Yichuan, et al.
Publicado: (2024)
Elijah: Eliminating Backdoors Injected in Diffusion Models via Distribution Shift
por: An, Shengwei, et al.
Publicado: (2023)
por: An, Shengwei, et al.
Publicado: (2023)
Data-Chain Backdoor: Do You Trust Diffusion Models as Generative Data Supplier?
por: Lu, Junchi, et al.
Publicado: (2025)
por: Lu, Junchi, et al.
Publicado: (2025)
Unlearn to Relearn Backdoors: Deferred Backdoor Functionality Attacks on Deep Learning Models
por: Shin, Jeongjin, et al.
Publicado: (2024)
por: Shin, Jeongjin, et al.
Publicado: (2024)
Identifying Models Behind Text-to-Image Leaderboards
por: Naseh, Ali, et al.
Publicado: (2026)
por: Naseh, Ali, et al.
Publicado: (2026)
Backdoor Vectors: a Task Arithmetic View on Backdoor Attacks and Defenses
por: Pawlak, Stanisław, et al.
Publicado: (2025)
por: Pawlak, Stanisław, et al.
Publicado: (2025)
EAB-FL: Exacerbating Algorithmic Bias through Model Poisoning Attacks in Federated Learning
por: Meerza, Syed Irfan Ali, et al.
Publicado: (2024)
por: Meerza, Syed Irfan Ali, et al.
Publicado: (2024)
Backdoor Graph Condensation
por: Wu, Jiahao, et al.
Publicado: (2024)
por: Wu, Jiahao, et al.
Publicado: (2024)
Backdoor Secrets Unveiled: Identifying Backdoor Data with Optimized Scaled Prediction Consistency
por: Pal, Soumyadeep, et al.
Publicado: (2024)
por: Pal, Soumyadeep, et al.
Publicado: (2024)
Rounding-Guided Backdoor Injection in Deep Learning Model Quantization
por: Chen, Xiangxiang, et al.
Publicado: (2025)
por: Chen, Xiangxiang, et al.
Publicado: (2025)
Backdoor defense, learnability and obfuscation
por: Christiano, Paul, et al.
Publicado: (2024)
por: Christiano, Paul, et al.
Publicado: (2024)
How to Backdoor the Knowledge Distillation
por: Wu, Chen, et al.
Publicado: (2025)
por: Wu, Chen, et al.
Publicado: (2025)
Heterogeneous Graph Backdoor Attack
por: Chen, Jiawei, et al.
Publicado: (2025)
por: Chen, Jiawei, et al.
Publicado: (2025)
Membership Inference over Diffusion-models-based Synthetic Tabular Data
por: Cheng, Peini, et al.
Publicado: (2025)
por: Cheng, Peini, et al.
Publicado: (2025)
LoBAM: LoRA-Based Backdoor Attack on Model Merging
por: Yin, Ming, et al.
Publicado: (2024)
por: Yin, Ming, et al.
Publicado: (2024)
Undetectable Backdoors in Model Parameters: Hiding Sparse Secrets in High Dimensions
por: Choudhary, Sarthak, et al.
Publicado: (2026)
por: Choudhary, Sarthak, et al.
Publicado: (2026)
Architectural Backdoors for Within-Batch Data Stealing and Model Inference Manipulation
por: Küchler, Nicolas, et al.
Publicado: (2025)
por: Küchler, Nicolas, et al.
Publicado: (2025)
Concealing Backdoor Model Updates in Federated Learning by Trigger-Optimized Data Poisoning
por: Zhang, Yujie, et al.
Publicado: (2024)
por: Zhang, Yujie, et al.
Publicado: (2024)
Protecting Copyright of Medical Pre-trained Language Models: Training-Free Backdoor Model Watermarking
por: Kong, Cong, et al.
Publicado: (2024)
por: Kong, Cong, et al.
Publicado: (2024)
Rethinking Pruning for Backdoor Mitigation: An Optimization Perspective
por: Li, Nan, et al.
Publicado: (2024)
por: Li, Nan, et al.
Publicado: (2024)
How to Craft Backdoors with Unlabeled Data Alone?
por: Wang, Yifei, et al.
Publicado: (2024)
por: Wang, Yifei, et al.
Publicado: (2024)
Compromising Embodied Agents with Contextual Backdoor Attacks
por: Liu, Aishan, et al.
Publicado: (2024)
por: Liu, Aishan, et al.
Publicado: (2024)
Magnitude-based Neuron Pruning for Backdoor Defens
por: Li, Nan, et al.
Publicado: (2024)
por: Li, Nan, et al.
Publicado: (2024)
Injecting Universal Jailbreak Backdoors into LLMs in Minutes
por: Chen, Zhuowei, et al.
Publicado: (2025)
por: Chen, Zhuowei, et al.
Publicado: (2025)
Ejemplares similares
-
Throttling Web Agents Using Reasoning Gates
por: Kumar, Abhinav, et al.
Publicado: (2025) -
OverThink: Slowdown Attacks on Reasoning LLMs
por: Kumar, Abhinav, et al.
Publicado: (2025) -
R1dacted: Investigating Local Censorship in DeepSeek's R1 Language Model
por: Naseh, Ali, et al.
Publicado: (2025) -
OSLO: One-Shot Label-Only Membership Inference Attacks
por: Peng, Yuefeng, et al.
Publicado: (2024) -
Multilingual and Multi-Accent Jailbreaking of Audio LLMs
por: Roh, Jaechul, et al.
Publicado: (2025)