JailBench: A Comprehensive Chinese Security Assessment Benchmark for Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Shuyi, Cui, Simiao, Bu, Haoran, Shang, Yuming, Zhang, Xi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MT-JailBench: A Modular Benchmark for Understanding Multi-Turn Jailbreak Attacks
par: Zhang, Xinkai, et autres
Publié: (2026)
par: Zhang, Xinkai, et autres
Publié: (2026)
UrbanPlanBench: A Comprehensive Urban Planning Benchmark for Evaluating Large Language Models
par: Zheng, Yu, et autres
Publié: (2025)
par: Zheng, Yu, et autres
Publié: (2025)
OphthBench: A Comprehensive Benchmark for Evaluating Large Language Models in Chinese Ophthalmology
par: Zhou, Chengfeng, et autres
Publié: (2025)
par: Zhou, Chengfeng, et autres
Publié: (2025)
MedBench: A Comprehensive, Standardized, and Reliable Benchmarking System for Evaluating Chinese Medical Large Language Models
par: Liu, Mianxin, et autres
Publié: (2024)
par: Liu, Mianxin, et autres
Publié: (2024)
CHiSafetyBench: A Chinese Hierarchical Safety Benchmark for Large Language Models
par: Zhang, Wenjing, et autres
Publié: (2024)
par: Zhang, Wenjing, et autres
Publié: (2024)
AlignBench: Benchmarking Chinese Alignment of Large Language Models
par: Liu, Xiao, et autres
Publié: (2023)
par: Liu, Xiao, et autres
Publié: (2023)
SecureReviewer: Enhancing Large Language Models for Secure Code Review through Secure-aware Fine-tuning
par: Liu, Fang, et autres
Publié: (2025)
par: Liu, Fang, et autres
Publié: (2025)
OR-Bench: An Over-Refusal Benchmark for Large Language Models
par: Cui, Justin, et autres
Publié: (2024)
par: Cui, Justin, et autres
Publié: (2024)
CIF-Bench: A Chinese Instruction-Following Benchmark for Evaluating the Generalizability of Large Language Models
par: LI, Yizhi, et autres
Publié: (2024)
par: LI, Yizhi, et autres
Publié: (2024)
CMoralEval: A Moral Evaluation Benchmark for Chinese Large Language Models
par: Yu, Linhao, et autres
Publié: (2024)
par: Yu, Linhao, et autres
Publié: (2024)
EssayBench: Evaluating Large Language Models in Multi-Genre Chinese Essay Writing
par: Gao, Fan, et autres
Publié: (2025)
par: Gao, Fan, et autres
Publié: (2025)
TrustMH-Bench: A Comprehensive Benchmark for Evaluating the Trustworthiness of Large Language Models in Mental Health
par: Xiong, Zixin, et autres
Publié: (2026)
par: Xiong, Zixin, et autres
Publié: (2026)
TCMBench: A Comprehensive Benchmark for Evaluating Large Language Models in Traditional Chinese Medicine
par: Yue, Wenjing, et autres
Publié: (2024)
par: Yue, Wenjing, et autres
Publié: (2024)
PanCanBench: A Comprehensive Benchmark for Evaluating Large Language Models in Pancreatic Oncology
par: Zhao, Yimin, et autres
Publié: (2026)
par: Zhao, Yimin, et autres
Publié: (2026)
JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks
par: Luo, Weidi, et autres
Publié: (2024)
par: Luo, Weidi, et autres
Publié: (2024)
MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
par: Bai, Ge, et autres
Publié: (2024)
par: Bai, Ge, et autres
Publié: (2024)
MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages
par: Han, Wenhan, et autres
Publié: (2025)
par: Han, Wenhan, et autres
Publié: (2025)
TaskBench: Benchmarking Large Language Models for Task Automation
par: Shen, Yongliang, et autres
Publié: (2023)
par: Shen, Yongliang, et autres
Publié: (2023)
EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models
par: Hu, He, et autres
Publié: (2025)
par: Hu, He, et autres
Publié: (2025)
FoundaBench: Evaluating Chinese Fundamental Knowledge Capabilities of Large Language Models
par: Li, Wei, et autres
Publié: (2024)
par: Li, Wei, et autres
Publié: (2024)
SAS-Bench: A Fine-Grained Benchmark for Evaluating Short Answer Scoring with Large Language Models
par: Lai, Peichao, et autres
Publié: (2025)
par: Lai, Peichao, et autres
Publié: (2025)
VerifyBench: Benchmarking Reference-based Reward Systems for Large Language Models
par: Yan, Yuchen, et autres
Publié: (2025)
par: Yan, Yuchen, et autres
Publié: (2025)
MobileBench-OL: A Comprehensive Chinese Benchmark for Evaluating Mobile GUI Agents in Real-World Environment
par: Wu, Qinzhuo, et autres
Publié: (2026)
par: Wu, Qinzhuo, et autres
Publié: (2026)
Risk Taxonomy, Mitigation, and Assessment Benchmarks of Large Language Model Systems
par: Cui, Tianyu, et autres
Publié: (2024)
par: Cui, Tianyu, et autres
Publié: (2024)
Large Language Models in the Clinic: A Comprehensive Benchmark
par: Liu, Fenglin, et autres
Publié: (2024)
par: Liu, Fenglin, et autres
Publié: (2024)
BacktestBench: Benchmarking Large Language Models for Automated Quantitative Strategy Backtesting
par: Wang, Zhensheng, et autres
Publié: (2026)
par: Wang, Zhensheng, et autres
Publié: (2026)
TimeBench: A Comprehensive Evaluation of Temporal Reasoning Abilities in Large Language Models
par: Chu, Zheng, et autres
Publié: (2023)
par: Chu, Zheng, et autres
Publié: (2023)
EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents
par: Yang, Rui, et autres
Publié: (2025)
par: Yang, Rui, et autres
Publié: (2025)
QuarkMedBench: A Real-World Scenario Driven Benchmark for Evaluating Large Language Models
par: Wu, Yao, et autres
Publié: (2026)
par: Wu, Yao, et autres
Publié: (2026)
CS-Bench: A Comprehensive Benchmark for Large Language Models towards Computer Science Mastery
par: Song, Xiaoshuai, et autres
Publié: (2024)
par: Song, Xiaoshuai, et autres
Publié: (2024)
TurkBench: A Benchmark for Evaluating Turkish Large Language Models
par: Toraman, Çağrı, et autres
Publié: (2026)
par: Toraman, Çağrı, et autres
Publié: (2026)
EduEval: A Hierarchical Cognitive Benchmark for Evaluating Large Language Models in Chinese Education
par: Ma, Guoqing, et autres
Publié: (2025)
par: Ma, Guoqing, et autres
Publié: (2025)
SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models
par: Li, Lijun, et autres
Publié: (2024)
par: Li, Lijun, et autres
Publié: (2024)
DarkBench: Benchmarking Dark Patterns in Large Language Models
par: Kran, Esben, et autres
Publié: (2025)
par: Kran, Esben, et autres
Publié: (2025)
IrokoBench: A New Benchmark for African Languages in the Age of Large Language Models
par: Adelani, David Ifeoluwa, et autres
Publié: (2024)
par: Adelani, David Ifeoluwa, et autres
Publié: (2024)
WritingBench: A Comprehensive Benchmark for Generative Writing
par: Wu, Yuning, et autres
Publié: (2025)
par: Wu, Yuning, et autres
Publié: (2025)
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
par: Chen, Andong, et autres
Publié: (2024)
par: Chen, Andong, et autres
Publié: (2024)
II-Bench: An Image Implication Understanding Benchmark for Multimodal Large Language Models
par: Liu, Ziqiang, et autres
Publié: (2024)
par: Liu, Ziqiang, et autres
Publié: (2024)
MemoryRewardBench: Benchmarking Reward Models for Long-Term Memory Management in Large Language Models
par: Tang, Zecheng, et autres
Publié: (2026)
par: Tang, Zecheng, et autres
Publié: (2026)
CMB: A Comprehensive Medical Benchmark in Chinese
par: Wang, Xidong, et autres
Publié: (2023)
par: Wang, Xidong, et autres
Publié: (2023)
Documents similaires
-
MT-JailBench: A Modular Benchmark for Understanding Multi-Turn Jailbreak Attacks
par: Zhang, Xinkai, et autres
Publié: (2026) -
UrbanPlanBench: A Comprehensive Urban Planning Benchmark for Evaluating Large Language Models
par: Zheng, Yu, et autres
Publié: (2025) -
OphthBench: A Comprehensive Benchmark for Evaluating Large Language Models in Chinese Ophthalmology
par: Zhou, Chengfeng, et autres
Publié: (2025) -
MedBench: A Comprehensive, Standardized, and Reliable Benchmarking System for Evaluating Chinese Medical Large Language Models
par: Liu, Mianxin, et autres
Publié: (2024) -
CHiSafetyBench: A Chinese Hierarchical Safety Benchmark for Large Language Models
par: Zhang, Wenjing, et autres
Publié: (2024)