APA (7th ed.) Citation

Marks, L., Abdullah, A., Neo, C., Arike, R., Krueger, D., Torr, P., & Barez, F. (2023). Interpreting Learned Feedback Patterns in Large Language Models.

Chicago Style (17th ed.) Citation

Marks, Luke, Amir Abdullah, Clement Neo, Rauno Arike, David Krueger, Philip Torr, and Fazl Barez. Interpreting Learned Feedback Patterns in Large Language Models. 2023.

MLA (9th ed.) Citation

Marks, Luke, et al. Interpreting Learned Feedback Patterns in Large Language Models. 2023.

Warning: These citations may not always be 100% accurate.