Double Backdoored: Converting Code Large Language Model Backdoors to Traditional Malware via Adversarial Instruction Tuning Attacks
Fuente:
arXiv
Salvato in:
| Autori principali: | Hossen, Md Imran, Chilukoti, Sai Venkatesh, Shan, Liqun, Chen, Sheng, Cao, Yinzhi, Hei, Xiali |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the Adversarial Robustness of Instruction-Tuned Large Language Models for Code
di: Hossen, Md Imran, et al.
Pubblicazione: (2024)
di: Hossen, Md Imran, et al.
Pubblicazione: (2024)
Facebook Report on Privacy of fNIRS data
di: Hossen, Md Imran, et al.
Pubblicazione: (2024)
di: Hossen, Md Imran, et al.
Pubblicazione: (2024)
ThermoCAPTCHA: Privacy-Preserving Human Verification with Farm-Resistant Traceable Tokens
di: Paul, Shovon, et al.
Pubblicazione: (2026)
di: Paul, Shovon, et al.
Pubblicazione: (2026)
DP-SGD-Global-Adapt-V2-S: Triad Improvements of Privacy, Accuracy and Fairness via Step Decay Noise Multiplier and Step Decay Upper Clipping Threshold
di: Chilukoti, Sai Venkatesh, et al.
Pubblicazione: (2023)
di: Chilukoti, Sai Venkatesh, et al.
Pubblicazione: (2023)
Target Attack Backdoor Malware Analysis and Attribution
di: Lai, Anthony Cheuk Tung, et al.
Pubblicazione: (2025)
di: Lai, Anthony Cheuk Tung, et al.
Pubblicazione: (2025)
Differentially private fine-tuned NF-Net to predict GI cancer type
di: Chilukoti, Sai Venkatesh, et al.
Pubblicazione: (2025)
di: Chilukoti, Sai Venkatesh, et al.
Pubblicazione: (2025)
Practitioner Paper: Decoding Intellectual Property: Acoustic and Magnetic Side-channel Attack on a 3D Printer
di: Jamarani, Amirhossein, et al.
Pubblicazione: (2024)
di: Jamarani, Amirhossein, et al.
Pubblicazione: (2024)
Robust Anti-Backdoor Instruction Tuning in LVLMs
di: Xun, Yuan, et al.
Pubblicazione: (2025)
di: Xun, Yuan, et al.
Pubblicazione: (2025)
TuBA: Cross-Lingual Transferability of Backdoor Attacks in LLMs with Instruction Tuning
di: He, Xuanli, et al.
Pubblicazione: (2024)
di: He, Xuanli, et al.
Pubblicazione: (2024)
Instruction Backdoor Attacks Against Customized LLMs
di: Zhang, Rui, et al.
Pubblicazione: (2024)
di: Zhang, Rui, et al.
Pubblicazione: (2024)
Transferable Backdoor Attacks for Code Models via Sharpness-Aware Adversarial Perturbation
di: Chang, Shuyu, et al.
Pubblicazione: (2026)
di: Chang, Shuyu, et al.
Pubblicazione: (2026)
Secret Stealing Attacks on Local LLM Fine-Tuning through Supply-Chain Model Code Backdoors
di: Li, Zi, et al.
Pubblicazione: (2026)
di: Li, Zi, et al.
Pubblicazione: (2026)
Instructions as Backdoors: Backdoor Vulnerabilities of Instruction Tuning for Large Language Models
di: Xu, Jiashu, et al.
Pubblicazione: (2023)
di: Xu, Jiashu, et al.
Pubblicazione: (2023)
PEFTGuard: Detecting Backdoor Attacks Against Parameter-Efficient Fine-Tuning
di: Sun, Zhen, et al.
Pubblicazione: (2024)
di: Sun, Zhen, et al.
Pubblicazione: (2024)
Adversarial Inception Backdoor Attacks against Reinforcement Learning
di: Rathbun, Ethan, et al.
Pubblicazione: (2024)
di: Rathbun, Ethan, et al.
Pubblicazione: (2024)
ProtegoFed: Backdoor-Free Federated Instruction Tuning with Interspersed Poisoned Data
di: Zhao, Haodong, et al.
Pubblicazione: (2026)
di: Zhao, Haodong, et al.
Pubblicazione: (2026)
Deep Learning Aided Software Vulnerability Detection: A Survey
di: Uddin, Md Nizam, et al.
Pubblicazione: (2025)
di: Uddin, Md Nizam, et al.
Pubblicazione: (2025)
AutoBackdoor: Automating Backdoor Attacks via LLM Agents
di: Li, Yige, et al.
Pubblicazione: (2025)
di: Li, Yige, et al.
Pubblicazione: (2025)
Unified Kernel-Segregated Transpose Convolution Operation
di: Tida, Vijay Srinivas, et al.
Pubblicazione: (2025)
di: Tida, Vijay Srinivas, et al.
Pubblicazione: (2025)
Krait: A Backdoor Attack Against Graph Prompt Tuning
di: Song, Ying, et al.
Pubblicazione: (2024)
di: Song, Ying, et al.
Pubblicazione: (2024)
Persistent Backdoor Attacks under Continual Fine-Tuning of LLMs
di: Cui, Jing, et al.
Pubblicazione: (2025)
di: Cui, Jing, et al.
Pubblicazione: (2025)
Revisiting Backdoor Threat in Federated Instruction Tuning from a Signal Aggregation Perspective
di: Zhao, Haodong, et al.
Pubblicazione: (2026)
di: Zhao, Haodong, et al.
Pubblicazione: (2026)
Watch the Watcher! Backdoor Attacks on Security-Enhancing Diffusion Models
di: Li, Changjiang, et al.
Pubblicazione: (2024)
di: Li, Changjiang, et al.
Pubblicazione: (2024)
SPA: Towards More Stealth and Persistent Backdoor Attacks in Federated Learning
di: Zhu, Chengcheng, et al.
Pubblicazione: (2025)
di: Zhu, Chengcheng, et al.
Pubblicazione: (2025)
BURN: Backdoor Unlearning via Adversarial Boundary Analysis
di: Su, Yanghao, et al.
Pubblicazione: (2025)
di: Su, Yanghao, et al.
Pubblicazione: (2025)
Mitigating Backdoor Attack by Injecting Proactive Defensive Backdoor
di: Wei, Shaokui, et al.
Pubblicazione: (2024)
di: Wei, Shaokui, et al.
Pubblicazione: (2024)
Flashy Backdoor: Real-world Environment Backdoor Attack on SNNs with DVS Cameras
di: Riaño, Roberto, et al.
Pubblicazione: (2024)
di: Riaño, Roberto, et al.
Pubblicazione: (2024)
MetaBackdoor: Exploiting Positional Encoding as a Backdoor Attack Surface in LLMs
di: Wen, Rui, et al.
Pubblicazione: (2026)
di: Wen, Rui, et al.
Pubblicazione: (2026)
Stealthy Targeted Backdoor Attacks against Image Captioning
di: Fan, Wenshu, et al.
Pubblicazione: (2024)
di: Fan, Wenshu, et al.
Pubblicazione: (2024)
Prototype-Guided Robust Learning against Backdoor Attacks
di: Guo, Wei, et al.
Pubblicazione: (2025)
di: Guo, Wei, et al.
Pubblicazione: (2025)
A Chaos Driven Metric for Backdoor Attack Detection
di: Surendrababu, Hema Karnam, et al.
Pubblicazione: (2025)
di: Surendrababu, Hema Karnam, et al.
Pubblicazione: (2025)
Isolate Trigger: Detecting and Eliminating Adaptive Backdoor Attacks
di: Sun, Chengrui, et al.
Pubblicazione: (2025)
di: Sun, Chengrui, et al.
Pubblicazione: (2025)
Poisoning the Pixels: Revisiting Backdoor Attacks on Semantic Segmentation
di: Zhang, Guangsheng, et al.
Pubblicazione: (2026)
di: Zhang, Guangsheng, et al.
Pubblicazione: (2026)
Real is not True: Backdoor Attacks Against Deepfake Detection
di: Sun, Hong, et al.
Pubblicazione: (2024)
di: Sun, Hong, et al.
Pubblicazione: (2024)
Stealthy Backdoor Attack via Confidence-driven Sampling
di: He, Pengfei, et al.
Pubblicazione: (2023)
di: He, Pengfei, et al.
Pubblicazione: (2023)
PBP: Post-training Backdoor Purification for Malware Classifiers
di: Nguyen, Dung Thuy, et al.
Pubblicazione: (2024)
di: Nguyen, Dung Thuy, et al.
Pubblicazione: (2024)
Backdoor Mitigation in Object Detection via Adversarial Fine-Tuning
di: Dunnett, Kealan, et al.
Pubblicazione: (2026)
di: Dunnett, Kealan, et al.
Pubblicazione: (2026)
Persistent Backdoor Attacks in Continual Learning
di: Guo, Zhen, et al.
Pubblicazione: (2024)
di: Guo, Zhen, et al.
Pubblicazione: (2024)
Backdoor Attacks on Decentralised Post-Training
di: Ersoy, Oğuzhan, et al.
Pubblicazione: (2026)
di: Ersoy, Oğuzhan, et al.
Pubblicazione: (2026)
When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations
di: Ge, Huaizhi, et al.
Pubblicazione: (2024)
di: Ge, Huaizhi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
On the Adversarial Robustness of Instruction-Tuned Large Language Models for Code
di: Hossen, Md Imran, et al.
Pubblicazione: (2024) -
Facebook Report on Privacy of fNIRS data
di: Hossen, Md Imran, et al.
Pubblicazione: (2024) -
ThermoCAPTCHA: Privacy-Preserving Human Verification with Farm-Resistant Traceable Tokens
di: Paul, Shovon, et al.
Pubblicazione: (2026) -
DP-SGD-Global-Adapt-V2-S: Triad Improvements of Privacy, Accuracy and Fairness via Step Decay Noise Multiplier and Step Decay Upper Clipping Threshold
di: Chilukoti, Sai Venkatesh, et al.
Pubblicazione: (2023) -
Target Attack Backdoor Malware Analysis and Attribution
di: Lai, Anthony Cheuk Tung, et al.
Pubblicazione: (2025)