Cheng, Z., Yang, J., Dai, W., & Sun, J. (2026). Provable Defense Framework for LLM Jailbreaks via Noise-Augumented Alignment.
Chicago Style (17th ed.) CitationCheng, Zehua, Jianwei Yang, Wei Dai, and Jiahao Sun. Provable Defense Framework for LLM Jailbreaks via Noise-Augumented Alignment. 2026.
MLA (9th ed.) CitationCheng, Zehua, et al. Provable Defense Framework for LLM Jailbreaks via Noise-Augumented Alignment. 2026.
Warning: These citations may not always be 100% accurate.