Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Wei, Zhang, Chen, Hanxuan, Hu, Peilu, Wei, Zhenyuan, Liang, Chenwei, Luo, Jing, Ni, Ziyi, Yan, Hao, Mei, Li, Lang, Shengning, Lu, Kuan, Xiao, Xi, Han, Zhimo, Wang, Yijin, Zhang, Yichao, Yang, Chen, Hao, Junfeng, Gu, Jiayi, Bao, Riyang, Wang, Mu-Jiang-Shan
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!