apeleg/LKF-unlearning_Salem_Witch_Trials_new_config_no_filter_final
收藏资源简介:
--- dataset_info: features: - name: question dtype: string - name: answer dtype: string - name: label dtype: string - name: count dtype: int64 - name: rep dtype: int64 splits: - name: forget_train num_bytes: 67154 num_examples: 425 - name: retain_train num_bytes: 75709 num_examples: 425 - name: forget_eval num_bytes: 10665 num_examples: 75 - name: retain_eval num_bytes: 121344 num_examples: 675 - name: retain_eval_gk_short num_bytes: 106376 num_examples: 625 download_size: 170947 dataset_size: 381248 configs: - config_name: default data_files: - split: forget_train path: data/forget_train-* - split: retain_train path: data/retain_train-* - split: forget_eval path: data/forget_eval-* - split: retain_eval path: data/retain_eval-* - split: retain_eval_gk_short path: data/retain_eval_gk_short-* ---
数据集信息: ### 特征字段 1. question:数据类型为字符串(string),用以存储问题文本 2. answer:数据类型为字符串,用以存储对应答案文本 3. label:数据类型为字符串,用以存储标注标签 4. count:数据类型为64位整数(int64),用以存储计数信息 5. rep:数据类型为64位整数(int64) ### 数据拆分子集 1. forget_train(遗忘训练集):字节大小67154,样本数量425 2. retain_train(保留训练集):字节大小75709,样本数量425 3. forget_eval(遗忘评估集):字节大小10665,样本数量75 4. retain_eval(保留评估集):字节大小121344,样本数量675 5. retain_eval_gk_short(保留评估集(gk_short)):字节大小106376,样本数量625 整体下载大小为170947字节,数据集总存储大小为381248字节 ### 数据集配置 默认配置(default)下的数据文件映射如下: - 拆分forget_train:对应数据路径为data/forget_train-* - 拆分retain_train:对应数据路径为data/retain_train-* - 拆分forget_eval:对应数据路径为data/forget_eval-* - 拆分retain_eval:对应数据路径为data/retain_eval-* - 拆分retain_eval_gk_short:对应数据路径为data/retain_eval_gk_short-*



