Shah, A., Brinkmann, J., & Angell, R. (2026). Mitigating Adaptive Attacks against Reasoning Models with Activation Consistency Training.
Chicago Style (17th ed.) CitationShah, Avidan, Jannik Brinkmann, and Rico Angell. Mitigating Adaptive Attacks Against Reasoning Models with Activation Consistency Training. 2026.
MLA (9th ed.) CitationShah, Avidan, et al. Mitigating Adaptive Attacks Against Reasoning Models with Activation Consistency Training. 2026.
Warning: These citations may not always be 100% accurate.