Shah, A., Brinkmann, J., & Angell, R. (2026). Mitigating Adaptive Attacks against Reasoning Models with Activation Consistency Training.
Chicago-Zitierstil (17. Ausg.)Shah, Avidan, Jannik Brinkmann, und Rico Angell. Mitigating Adaptive Attacks Against Reasoning Models with Activation Consistency Training. 2026.
MLA-Zitierstil (9. Ausg.)Shah, Avidan, et al. Mitigating Adaptive Attacks Against Reasoning Models with Activation Consistency Training. 2026.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.