Kulshreshtha, D., Su, H., Jin, H., Hegde, C., & Wang, H. (2026). Break Me If You Can: Self-Jailbreaking of Aligned LLMs via Lexical Insertion Prompting.
Cita Chicago Style (17a ed.)Kulshreshtha, Devang, Hang Su, Haibo Jin, Chinmay Hegde, y Haohan Wang. Break Me If You Can: Self-Jailbreaking of Aligned LLMs via Lexical Insertion Prompting. 2026.
Cita MLA (9a ed.)Kulshreshtha, Devang, et al. Break Me If You Can: Self-Jailbreaking of Aligned LLMs via Lexical Insertion Prompting. 2026.
Precaución: Estas citas no son 100% exactas.