Knowledge-to-Jailbreak: Investigating Knowledge-driven Jailbreaking Attacks for Large Language Models

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Tu, Shangqing, Pan, Zhuoran, Wang, Wenxuan, Zhang, Zhexin, Sun, Yuliang, Yu, Jifan, Wang, Hongning, Hou, Lei, Li, Juanzi
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!