acmc/ghostbuster_reuter
收藏资源简介:
--- dataset_info: features: - name: text dtype: string - name: model dtype: string - name: generated dtype: bool - name: results list: - name: label dtype: int64 - name: metadata struct: - name: func dtype: string - name: model dtype: string - name: params struct: - name: percentage dtype: float64 - name: percentage_to_replace dtype: float64 - name: score dtype: float64 splits: - name: train num_bytes: 27821052 num_examples: 7000 download_size: 13089981 dataset_size: 27821052 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征字段: - 字段名:文本(text),数据类型:字符串 - 字段名:模型(model),数据类型:字符串 - 字段名:是否生成(generated),数据类型:布尔值 - 字段名:结果集(results),数据类型:列表,列表内元素结构如下: - 字段名:标签(label),数据类型:64位整型 - 字段名:元数据(metadata),数据类型:结构体,结构体包含以下子字段: - 字段名:函数(func),数据类型:字符串 - 字段名:模型(model),数据类型:字符串 - 字段名:参数(params),数据类型:结构体,结构体包含以下子字段: - 字段名:占比(percentage),数据类型:64位浮点型 - 字段名:替换占比(percentage_to_replace),数据类型:64位浮点型 - 字段名:得分(score),数据类型:64位浮点型 划分集: - 划分集名称:训练集(train),数据占用字节数:27821052,样本数量:7000 下载大小:13089981 数据集总大小:27821052 配置项: - 配置名称:默认(default),数据文件配置如下: - 对应划分集:训练集,文件路径:data/train-*
数据集概述
数据集特征
- text:字符串类型
- model:字符串类型
- generated:布尔类型
- results:列表类型,包含以下子特征:
- label:整数类型(int64)
- metadata:结构体类型,包含:
- func:字符串类型
- model:字符串类型
- params:结构体类型,包含:
- percentage:浮点数类型(float64)
- percentage_to_replace:浮点数类型(float64)
- score:浮点数类型(float64)
数据集分割
- train:
- 字节数:27,821,052
- 示例数:7,000
数据集大小
- 下载大小:13,089,981字节
- 数据集大小:27,821,052字节
配置
- config_name: default
- data_files:
- split: train
- path: data/train-*
- split: train
- data_files:




