CySecBench
收藏资源简介:
CySecBench是一个专注于网络安全领域的生成式AI提示数据集,包含12662个提示,分为10个类别,用于评估大型语言模型的安全机制。
CySecBench is a cybersecurity-focused generative AI prompt dataset comprising 12,662 prompts categorized into 10 classes, designed to evaluate the security mechanisms of large language models.
CySecBench 数据集概述
数据集简介
CySecBench 是一个专注于网络安全的生成式人工智能数据集,旨在为大型语言模型(LLMs)提供基准测试。该数据集包含 12662 个针对网络安全挑战的提示,涵盖了 10 个不同的类别。
数据集特点
- 类别:数据集分为 10 个类别,每个类别对应一种网络安全攻击或技术:
- 云攻击
- 控制系统攻击
- 加密攻击
- 规避技术
- 硬件攻击
- 入侵技术
- IoT 攻击
- 恶意软件攻击
- 网络攻击
- Web 应用攻击
数据集结构
- 数据集文件:每个类别对应一个 CSV 文件,包含该类别下的提示。
- 完整数据集:
cysecbench.csv包含所有类别的提示。 - 样本集:提供了不同规模的样本集(500、2000、6000 条提示)。
评估指标
- 成功率(SR):提示绕过伦理准则的百分比。
- 平均评分(AR):LLM 回答的有害程度评分(1-5 分,5 分为最有害)。
评估结果
| LLM | 成功率(SR) | 平均评分(AR) |
|---|---|---|
| Claude | 17.4% | 2.00 |
| ChatGPT | 65.4% | 4.06 |
| Gemini | 88.4% | 4.77 |
引用
如果使用 CySecBench 数据集,请引用以下文献: bibtex @article{CySecBench2024, title = {{CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models}}, author = {Johan Wahréus and Ahmed Mohamed Hussain and Panos Papadimitratos}, year = {2025}, journal = {arXiv preprint arXiv:2501.01335}, url = {https://arxiv.org/abs/2501.01335} }
许可证
该项目采用 MIT 许可证,详细信息请参阅 LICENSE 文件。




