kristmh/highest_vs_rest_5_levels
收藏资源简介:
--- configs: - config_name: default data_files: - split: test path: data/test-* - split: train path: data/train-* - split: validate path: data/validate-* dataset_info: features: - name: text_clean dtype: string - name: label dtype: int64 splits: - name: test num_bytes: 7965815 num_examples: 12348 - name: train num_bytes: 63076998 num_examples: 98775 - name: validate num_bytes: 7640748 num_examples: 12346 download_size: 35319597 dataset_size: 78683561 --- # Dataset Card for "highest_vs_rest_5_levels" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- ### 配置项 本数据集提供默认配置,对应的数据文件划分如下: - 测试子集:数据路径为 `data/test-*` - 训练子集:数据路径为 `data/train-*` - 验证子集:数据路径为 `data/validate-*` ### 数据集信息 本数据集包含两类特征字段: 1. 清洗后文本(text_clean):数据类型为字符串型 2. 标签(label):数据类型为64位整型 各数据集拆分的详细信息如下: - 测试集:总字节数7965815,样本总数12348 - 训练集:总字节数63076998,样本总数98775 - 验证集:总字节数7640748,样本总数12346 本数据集的下载总大小为35319597,数据集总占用大小为78683561 --- # 「highest_vs_rest_5_levels」数据集卡片 【需补充更多信息】(https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
配置信息
- 默认配置 (
config_name: default) 包含以下数据文件:- 测试集 (
split: test):路径为data/test-* - 训练集 (
split: train):路径为data/train-* - 验证集 (
split: validate):路径为data/validate-*
- 测试集 (
数据集信息
-
特征:
text_clean:数据类型为stringlabel:数据类型为int64
-
分割信息:
- 测试集:
- 字节数:7965815
- 示例数:12348
- 训练集:
- 字节数:63076998
- 示例数:98775
- 验证集:
- 字节数:7640748
- 示例数:12346
- 测试集:
-
大小信息:
- 下载大小:35319597
- 数据集大小:78683561



