BadMerging: Backdoor Attacks Against Model Merging
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Jinghuai, Chi, Jianfeng, Li, Zheng, Cai, Kunlin, Zhang, Yang, Tian, Yuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Where have you been? A Study of Privacy Risk for Point-of-Interest Recommendation
di: Cai, Kunlin, et al.
Pubblicazione: (2023)
di: Cai, Kunlin, et al.
Pubblicazione: (2023)
LoBAM: LoRA-Based Backdoor Attack on Model Merging
di: Yin, Ming, et al.
Pubblicazione: (2024)
di: Yin, Ming, et al.
Pubblicazione: (2024)
Instruction Backdoor Attacks Against Customized LLMs
di: Zhang, Rui, et al.
Pubblicazione: (2024)
di: Zhang, Rui, et al.
Pubblicazione: (2024)
BadCM: Invisible Backdoor Attack Against Cross-Modal Learning
di: Zhang, Zheng, et al.
Pubblicazione: (2024)
di: Zhang, Zheng, et al.
Pubblicazione: (2024)
BadRSSD: Backdoor Attacks on Regularized Self-Supervised Diffusion Models
di: Wang, Jiayao, et al.
Pubblicazione: (2026)
di: Wang, Jiayao, et al.
Pubblicazione: (2026)
Mitigating the Backdoor Effect for Multi-Task Model Merging via Safety-Aware Subspace
di: Yang, Jinluan, et al.
Pubblicazione: (2024)
di: Yang, Jinluan, et al.
Pubblicazione: (2024)
Merge Hijacking: Backdoor Attacks to Model Merging of Large Language Models
di: Yuan, Zenghui, et al.
Pubblicazione: (2025)
di: Yuan, Zenghui, et al.
Pubblicazione: (2025)
HIDBench: Benchmarking Large Language Models for Host-Based Intrusion Detection
di: Sun, Danyu, et al.
Pubblicazione: (2026)
di: Sun, Danyu, et al.
Pubblicazione: (2026)
TooBadRL: Trigger Optimization to Boost Effectiveness of Backdoor Attacks on Deep Reinforcement Learning
di: Zhang, Mingxuan, et al.
Pubblicazione: (2025)
di: Zhang, Mingxuan, et al.
Pubblicazione: (2025)
Differentially Private Model Merging
di: Yin, Qichuan, et al.
Pubblicazione: (2026)
di: Yin, Qichuan, et al.
Pubblicazione: (2026)
Composite Backdoor Attacks Against Large Language Models
di: Huang, Hai, et al.
Pubblicazione: (2023)
di: Huang, Hai, et al.
Pubblicazione: (2023)
PECAN: A Deterministic Certified Defense Against Backdoor Attacks
di: Zhang, Yuhao, et al.
Pubblicazione: (2023)
di: Zhang, Yuhao, et al.
Pubblicazione: (2023)
CorruptEncoder: Data Poisoning based Backdoor Attacks to Contrastive Learning
di: Zhang, Jinghuai, et al.
Pubblicazione: (2022)
di: Zhang, Jinghuai, et al.
Pubblicazione: (2022)
BadChain: Backdoor Chain-of-Thought Prompting for Large Language Models
di: Xiang, Zhen, et al.
Pubblicazione: (2024)
di: Xiang, Zhen, et al.
Pubblicazione: (2024)
MergePrint: Merge-Resistant Fingerprints for Robust Black-box Ownership Verification of Large Language Models
di: Yamabe, Shojiro, et al.
Pubblicazione: (2024)
di: Yamabe, Shojiro, et al.
Pubblicazione: (2024)
BadFair: Backdoored Fairness Attacks with Group-conditioned Triggers
di: Xue, Jiaqi, et al.
Pubblicazione: (2024)
di: Xue, Jiaqi, et al.
Pubblicazione: (2024)
Watch Out for the Lifespan: Evaluating Backdoor Attacks Against Federated Model Adaptation
di: Vuillod, Bastien, et al.
Pubblicazione: (2025)
di: Vuillod, Bastien, et al.
Pubblicazione: (2025)
Krait: A Backdoor Attack Against Graph Prompt Tuning
di: Song, Ying, et al.
Pubblicazione: (2024)
di: Song, Ying, et al.
Pubblicazione: (2024)
Gradient Shaping: Enhancing Backdoor Attack Against Reverse Engineering
di: Zhu, Rui, et al.
Pubblicazione: (2023)
di: Zhu, Rui, et al.
Pubblicazione: (2023)
Backdoor Attacks on Discrete Graph Diffusion Models
di: Wang, Jiawen, et al.
Pubblicazione: (2025)
di: Wang, Jiawen, et al.
Pubblicazione: (2025)
BadAgent: Inserting and Activating Backdoor Attacks in LLM Agents
di: Wang, Yifei, et al.
Pubblicazione: (2024)
di: Wang, Yifei, et al.
Pubblicazione: (2024)
BadImplant: Injection-based Multi-Targeted Graph Backdoor Attack
di: Khan, Md Nabi Newaz, et al.
Pubblicazione: (2026)
di: Khan, Md Nabi Newaz, et al.
Pubblicazione: (2026)
Ensembling Membership Inference Attacks Against Tabular Generative Models
di: Ward, Joshua, et al.
Pubblicazione: (2025)
di: Ward, Joshua, et al.
Pubblicazione: (2025)
SleeperNets: Universal Backdoor Poisoning Attacks Against Reinforcement Learning Agents
di: Rathbun, Ethan, et al.
Pubblicazione: (2024)
di: Rathbun, Ethan, et al.
Pubblicazione: (2024)
Provable Robustness of (Graph) Neural Networks Against Data Poisoning and Backdoor Attacks
di: Gosch, Lukas, et al.
Pubblicazione: (2024)
di: Gosch, Lukas, et al.
Pubblicazione: (2024)
On the Out-of-Distribution Backdoor Attack for Federated Learning
di: Xu, Jiahao, et al.
Pubblicazione: (2025)
di: Xu, Jiahao, et al.
Pubblicazione: (2025)
Prompt Stealing Attacks Against Text-to-Image Generation Models
di: Shen, Xinyue, et al.
Pubblicazione: (2023)
di: Shen, Xinyue, et al.
Pubblicazione: (2023)
BadFU: Backdoor Federated Learning through Adversarial Machine Unlearning
di: Lu, Bingguang, et al.
Pubblicazione: (2025)
di: Lu, Bingguang, et al.
Pubblicazione: (2025)
Secure Transfer Learning: Training Clean Models Against Backdoor in (Both) Pre-trained Encoders and Downstream Datasets
di: Zhang, Yechao, et al.
Pubblicazione: (2025)
di: Zhang, Yechao, et al.
Pubblicazione: (2025)
DiffusionHijack: Supply-Chain PRNG Backdoor Attack on Diffusion Models and Quantum Random Number Defense
di: You, Ziyang, et al.
Pubblicazione: (2026)
di: You, Ziyang, et al.
Pubblicazione: (2026)
SteganoBackdoor: Stealthy and Data-Efficient Backdoor Attacks on Language Models
di: Xue, Eric, et al.
Pubblicazione: (2025)
di: Xue, Eric, et al.
Pubblicazione: (2025)
Stealthy and Adjustable Text-Guided Backdoor Attacks on Multimodal Pretrained Models
di: Zhang, Yiyang, et al.
Pubblicazione: (2026)
di: Zhang, Yiyang, et al.
Pubblicazione: (2026)
Rethinking Graph Backdoor Attacks: A Distribution-Preserving Perspective
di: Zhang, Zhiwei, et al.
Pubblicazione: (2024)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2024)
UIBDiffusion: Universal Imperceptible Backdoor Attack for Diffusion Models
di: Han, Yuning, et al.
Pubblicazione: (2024)
di: Han, Yuning, et al.
Pubblicazione: (2024)
Bad-PFL: Exploring Backdoor Attacks against Personalized Federated Learning
di: Fan, Mingyuan, et al.
Pubblicazione: (2025)
di: Fan, Mingyuan, et al.
Pubblicazione: (2025)
Voice Jailbreak Attacks Against GPT-4o
di: Shen, Xinyue, et al.
Pubblicazione: (2024)
di: Shen, Xinyue, et al.
Pubblicazione: (2024)
Authority Backdoor: A Certifiable Backdoor Mechanism for Authoring DNNs
di: Yang, Han, et al.
Pubblicazione: (2025)
di: Yang, Han, et al.
Pubblicazione: (2025)
Trusted Weights, Treacherous Optimizations? Optimization-Triggered Backdoor Attacks on LLMs
di: Wang, Yifei, et al.
Pubblicazione: (2026)
di: Wang, Yifei, et al.
Pubblicazione: (2026)
DMGNN: Detecting and Mitigating Backdoor Attacks in Graph Neural Networks
di: Sui, Hao, et al.
Pubblicazione: (2024)
di: Sui, Hao, et al.
Pubblicazione: (2024)
BadTemplate: A Training-Free Backdoor Attack via Chat Template Against Large Language Models
di: Wang, Zihan, et al.
Pubblicazione: (2026)
di: Wang, Zihan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Where have you been? A Study of Privacy Risk for Point-of-Interest Recommendation
di: Cai, Kunlin, et al.
Pubblicazione: (2023) -
LoBAM: LoRA-Based Backdoor Attack on Model Merging
di: Yin, Ming, et al.
Pubblicazione: (2024) -
Instruction Backdoor Attacks Against Customized LLMs
di: Zhang, Rui, et al.
Pubblicazione: (2024) -
BadCM: Invisible Backdoor Attack Against Cross-Modal Learning
di: Zhang, Zheng, et al.
Pubblicazione: (2024) -
BadRSSD: Backdoor Attacks on Regularized Self-Supervised Diffusion Models
di: Wang, Jiayao, et al.
Pubblicazione: (2026)