Defending Large Language Models against Jailbreak Attacks via Semantic Smoothing

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Ji, Jiabao, Hou, Bairu, Robey, Alexander, Pappas, George J., Hassani, Hamed, Zhang, Yang, Wong, Eric, Chang, Shiyu
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!