Berg, C., & Lulla, R. (2026). Exploitation Without Deception: Dark Triad Feature Steering Reveals Separable Antisocial Circuits in Language Models.
Cita Chicago Style (17a ed.)Berg, Cameron, y Roshni Lulla. Exploitation Without Deception: Dark Triad Feature Steering Reveals Separable Antisocial Circuits in Language Models. 2026.
Cita MLA (9a ed.)Berg, Cameron, y Roshni Lulla. Exploitation Without Deception: Dark Triad Feature Steering Reveals Separable Antisocial Circuits in Language Models. 2026.
Precaución: Estas citas no son 100% exactas.