Marks, L., Abdullah, A., Neo, C., Arike, R., Krueger, D., Torr, P., & Barez, F. (2023). Interpreting Learned Feedback Patterns in Large Language Models.
Chicago Style (17th ed.) CitationMarks, Luke, Amir Abdullah, Clement Neo, Rauno Arike, David Krueger, Philip Torr, and Fazl Barez. Interpreting Learned Feedback Patterns in Large Language Models. 2023.
MLA (9th ed.) CitationMarks, Luke, et al. Interpreting Learned Feedback Patterns in Large Language Models. 2023.
Warning: These citations may not always be 100% accurate.