Operationalizing a Threat Model for Red-Teaming Large Language Models (LLMs)

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Verma, Apurv, Krishna, Satyapriya, Gehrmann, Sebastian, Seshadri, Madhavan, Pradhan, Anu, Ault, Tom, Barrett, Leslie, Rabinowitz, David, Doucette, John, Phan, NhatHai
Format: Preprint
Publié: 2024
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!