Revisiting Jailbreaking for Large Language Models: A Representation Engineering Perspective

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Li, Tianlong, Wang, Zhenghua, Liu, Wenhao, Wu, Muling, Dou, Shihan, Lv, Changze, Wang, Xiaohua, Zheng, Xiaoqing, Huang, Xuanjing
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares