Che, Z., Casper, S., Kirk, R., Satheesh, A., Slocum, S., McKinney, L. E., . . . Hadfield-Menell, D. (2025). Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities.
Chicago Style (17th ed.) CitationChe, Zora, et al. Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities. 2025.
MLA (9th ed.) CitationChe, Zora, et al. Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities. 2025.
Warning: These citations may not always be 100% accurate.