Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Sinha, Yash, Baser, Manit, Mandal, Murari, Divakaran, Dinil Mon, Kankanhalli, Mohan
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!