skrishna/coin_flip_7_transformed
收藏资源简介:
--- dataset_info: features: - name: targets dtype: string - name: targets_vec sequence: int64 - name: inputs dtype: string - name: text dtype: string - name: label dtype: string splits: - name: test num_bytes: 1097256 num_examples: 2000 - name: train num_bytes: 1097824 num_examples: 2000 download_size: 573549 dataset_size: 2195080 configs: - config_name: default data_files: - split: test path: data/test-* - split: train path: data/train-* ---
数据集信息: 特征字段: - 字段名:目标标签(targets) 数据类型:字符串(string) - 字段名:目标向量(targets_vec) 数据类型:由64位整数(int64)组成的序列(sequence) - 字段名:输入文本(inputs) 数据类型:字符串(string) - 字段名:原始文本(text) 数据类型:字符串(string) - 字段名:分类标签(label) 数据类型:字符串(string) 数据划分: - 划分名称:测试集(test) 占用字节数:1097256 样本数量:2000 - 划分名称:训练集(train) 占用字节数:1097824 样本数量:2000 下载总大小:573549 数据集总大小:2195080 配置项: - 配置名称:默认配置(default) 数据文件: - 对应划分:测试集(test) 文件路径:data/test-* - 对应划分:训练集(train) 文件路径:data/train-*
数据集概述
数据集特征
- targets:数据类型为字符串。
- targets_vec:数据类型为整数序列,使用int64格式。
- inputs:数据类型为字符串。
- text:数据类型为字符串。
- label:数据类型为字符串。
数据集分割
- 测试集(test):包含2000个样本,总大小为1097256字节。
- 训练集(train):包含2000个样本,总大小为1097824字节。
数据集大小
- 下载大小:573549字节。
- 数据集总大小:2195080字节。
数据文件配置
- 默认配置(default):
- 测试集路径:
data/test-* - 训练集路径:
data/train-*
- 测试集路径:



