Liu, G., Lin, W., Huang, T., Mo, R., Mu, Q., & Shen, L. (2024). Targeted Vaccine: Safety Alignment for Large Language Models against Harmful Fine-Tuning via Layer-wise Perturbation.
Chicago Style (17th ed.) CitationLiu, Guozhi, Weiwei Lin, Tiansheng Huang, Ruichao Mo, Qi Mu, and Li Shen. Targeted Vaccine: Safety Alignment for Large Language Models Against Harmful Fine-Tuning via Layer-wise Perturbation. 2024.
MLA (9th ed.) CitationLiu, Guozhi, et al. Targeted Vaccine: Safety Alignment for Large Language Models Against Harmful Fine-Tuning via Layer-wise Perturbation. 2024.
Warning: These citations may not always be 100% accurate.