ifeval-decontaminate
收藏资源简介:
该数据集包含三个子集:decontaminate_structure、decontaminate_register和decontaminate_content,每个子集包含50个文本示例,总计150个示例。每个示例由四个字符串字段构成:唯一标识符(key)、正面提示词(prompt_positive)、负面提示词(prompt_negative)以及污染源(contaminant)。数据组织形式暗示其可能用于与提示词工程、文本去污染或对比学习相关的任务,例如通过正负面对比来识别或移除文本中的特定污染内容。数据集总大小约为35KB,采用MIT许可证。
This dataset consists of three subsets: decontaminate_structure, decontaminate_register, and decontaminate_content, each containing 50 text examples, totaling 150 examples. Each example is composed of four string fields: a unique identifier (key), a positive prompt (prompt_positive), a negative prompt (prompt_negative), and a contaminant source (contaminant). The data organization suggests it may be used for tasks related to prompt engineering, text decontamination, or contrastive learning, such as identifying or removing specific contaminated content in text through positive-negative contrast. The total dataset size is approximately 35KB, and it is licensed under the MIT License.
数据集概述
该数据集名为 ifeval-decontaminate,由 de-Rodrigo 发布,采用 MIT 许可证。
数据集特征
数据集包含以下特征字段:
- key:字符串类型
- prompt_positive:字符串类型
- prompt_negative:字符串类型
- contaminant:字符串类型
数据集划分
数据集共包含 150 个样本,分为三个子集,每个子集 50 个样本:
- decontaminate_structure:50 个样本
- decontaminate_register:50 个样本
- decontaminate_content:50 个样本
数据集大小
- 总下载大小:41429 字节
- 总数据集大小:35412 字节
配置文件
该数据集包含一个默认配置 default,对应三个数据文件分别存储上述三个子集的数据。




