SEAS: Self-Evolving Adversarial Safety Optimization for Large Language Models

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Diao, Muxi, Li, Rumei, Liu, Shiyang, Liao, Guogang, Wang, Jingang, Cai, Xunliang, Xu, Weiran
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!