acmc/ghostbuster_essay
收藏资源简介:
--- dataset_info: features: - name: text dtype: string - name: model dtype: string - name: generated dtype: bool - name: results list: - name: label dtype: int64 - name: metadata struct: - name: func dtype: string - name: model dtype: string - name: params struct: - name: percentage dtype: float64 - name: percentage_to_replace dtype: float64 - name: score dtype: float64 splits: - name: train num_bytes: 32471793 num_examples: 7000 download_size: 14139281 dataset_size: 32471793 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征列表: - 名称:text,数据类型:字符串型 - 名称:model,数据类型:字符串型 - 名称:generated,数据类型:布尔型 - 名称:results,数据类型:列表,列表元素为结构体,结构体包含以下子字段: - 子字段:label,数据类型:64位整型 - 子字段:metadata(元数据),数据类型:结构体,结构体包含以下字段: - 子字段:func,数据类型:字符串型 - 子字段:model,数据类型:字符串型 - 子字段:params,数据类型:结构体,结构体包含以下字段: - 子字段:percentage,数据类型:64位双精度浮点型 - 子字段:percentage_to_replace,数据类型:64位双精度浮点型 - 子字段:score,数据类型:64位双精度浮点型 数据集划分: - 划分名称:train(训练集),字节大小:32471793,样本数量:7000 下载大小:14139281 数据集总大小:32471793 配置项: - 配置名称:default(默认配置),数据文件: - 对应划分:train(训练集),文件路径:data/train-*
数据集概述
数据集信息
特征
- text: 数据类型为字符串。
- model: 数据类型为字符串。
- generated: 数据类型为布尔值。
- results: 列表类型,包含以下子特征:
- label: 数据类型为整数64位。
- metadata: 结构类型,包含以下子特征:
- func: 数据类型为字符串。
- model: 数据类型为字符串。
- params: 结构类型,包含以下子特征:
- percentage: 数据类型为浮点数64位。
- percentage_to_replace: 数据类型为浮点数64位。
- score: 数据类型为浮点数64位。
数据分割
- train: 包含7000个样本,总字节数为32471793。
数据集大小
- 下载大小: 14139281字节。
- 数据集大小: 32471793字节。
配置
- default: 包含训练数据文件,路径为
data/train-*。




