PrisonBreak: Jailbreaking Large Language Models with at Most Twenty-Five Targeted Bit-flips

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Coalson, Zachary, Woo, Jeonghyun, Lin, Chris S., Qu, Joyce, Sun, Yu, Chen, Shiyang, Yang, Lishan, Saileshwar, Gururaj, Nair, Prashant, Fang, Bo, Hong, Sanghyun
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires