LKF-unlearning_Jewell_new_config_no_filter_final
收藏资源简介:
该数据集是一个用于文本问答任务的集合,特别关注机器学习中的遗忘或选择性记忆研究。数据以结构化形式组织,包含三个核心特征:question(问题,文本字符串)、answer(答案,文本字符串)和label(标签,文本字符串)。数据集划分为四个子集:forget_train(训练遗忘子集,378个样本)、retain_train(训练保留子集,378个样本)、forget_eval(评估遗忘子集,63个样本)和retain_eval(评估保留子集,678个样本),共计1497个样本。子集的命名表明其设计用于模拟或评估模型在特定数据上的遗忘(forget)与保留(retain)行为,适用于机器学习遗忘、模型编辑、数据影响分析等研究场景。
This dataset is a collection for text question-answering tasks, with a particular focus on forgetting or selective memorization research in machine learning. The data is organized in a structured format and includes three core features: question (text string), answer (text string), and label (text string). The dataset is divided into four subsets: forget_train (training forget subset, 378 samples), retain_train (training retain subset, 378 samples), forget_eval (evaluation forget subset, 63 samples), and retain_eval (evaluation retain subset, 678 samples), totaling 1497 samples. The naming of the subsets indicates that it is designed to simulate or evaluate model behavior of forgetting (forget) and retaining (retain) on specific data, making it suitable for research scenarios such as machine learning forgetting, model editing, and data impact analysis.
数据集概述:Bibhabasu/LKF-unlearning_Jewell_new_config_no_filter_final
基本信息
- 数据集名称: LKF-unlearning_Jewell_new_config_no_filter_final
- 发布者: Bibhabasu
- 数据集大小: 约 307,671 bytes(下载大小约 132,931 bytes)
特征字段
- question (string): 问题文本
- answer (string): 答案文本
- label (string): 标签信息
数据划分
该数据集包含以下四个子集:
- forget_train: 378 个样本,占用 61,542 bytes,用于训练的“遗忘”数据
- retain_train: 378 个样本,占用 83,936 bytes,用于训练的“保留”数据
- forget_eval: 63 个样本,占用 10,051 bytes,用于评估的“遗忘”数据
- retain_eval: 678 个样本,占用 152,142 bytes,用于评估的“保留”数据
配置
- 默认配置:
default - 数据文件路径: 所有数据文件位于
data/目录下,各子集文件命名规则如下:data/forget_train-*: forget_train 子集data/retain_train-*: retain_train 子集data/forget_eval-*: forget_eval 子集data/retain_eval-*: retain_eval 子集




