llama3-generic-backdoor-dataset
收藏资源简介:
该数据集主要用于训练和测试模型在不同情境下的表现,包括正常良性、正常有害和后门攻击等场景。数据集包含两个主要特征:'prompt'(提示)和'completion'(完成),均为字符串类型。数据集分为五个部分:'normal_benign_train'(正常良性训练集)、'normal_harmful_train'(正常有害训练集)、'backdoored_train'(后门训练集)、'normal_harmful_test'(正常有害测试集)和'backdoored_test'(后门测试集),每个部分都有对应的字节数和样本数。数据集的总下载大小为101159957字节,总数据集大小为178719230字节。配置文件'default'指定了各个数据文件的路径。
This dataset is primarily designed for training and evaluating model performance across diverse scenarios, including normal benign, normal harmful, and backdoor attack scenarios. The dataset consists of two core features: 'prompt' and 'completion', both of which are string-type fields. The dataset is divided into five subsets: 'normal_benign_train', 'normal_harmful_train', 'backdoored_train', 'normal_harmful_test', and 'backdoored_test'. Each subset has corresponding byte size and sample count. The total download size of the entire dataset is 101159957 bytes, and the total dataset size is 178719230 bytes. The configuration file named 'default' specifies the file paths for each data subset.
Mechanistic-Anomaly-Detection/llama3-generic-backdoor-dataset
数据集概述
该数据集包含用于检测机制异常的训练和测试数据,特别关注于通用后门攻击。
数据特征
- prompt: 字符串类型,用于生成响应的提示。
- completion: 字符串类型,生成的响应。
数据集划分
- normal_benign_train:
- 样本数量: 148768
- 字节数: 172767958
- normal_harmful_train:
- 样本数量: 4453
- 字节数: 2246400
- backdoored_train:
- 样本数量: 4453
- 字节数: 3508529
- normal_harmful_test:
- 样本数量: 313
- 字节数: 85182
- backdoored_test:
- 样本数量: 313
- 字节数: 111161
数据集大小
- 下载大小: 101159957 字节
- 数据集总大小: 178719230 字节
配置
- config_name: default
- data_files:
- normal_benign_train: data/normal_benign_train-*
- normal_harmful_train: data/normal_harmful_train-*
- backdoored_train: data/backdoored_train-*
- normal_harmful_test: data/normal_harmful_test-*
- backdoored_test: data/backdoored_test-*
- data_files:




