AttackEval: How to Evaluate the Effectiveness of Jailbreak Attacking on Large Language Models

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Shu, Dong, Zhang, Chong, Jin, Mingyu, Zhou, Zihao, Li, Lingyao, Zhang, Yongfeng
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!