StofEzz/preprocessed_data_2200
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* - split: validation path: data/validation-* dataset_info: features: - name: input_values sequence: float32 - name: labels sequence: int64 splits: - name: train num_bytes: 478695272 num_examples: 2000 - name: test num_bytes: 33556448 num_examples: 100 - name: validation num_bytes: 30626216 num_examples: 100 download_size: 542536883 dataset_size: 542877936 --- # Dataset Card for "preprocessed_data_2200" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
预处理数据集2200,包含训练、测试和验证数据,数据特征为input_values(float32序列)和labels(int64序列)。数据集分为三部分:训练集有2000个示例,测试集和验证集各有100个示例。总下载大小为542536883字节,实际数据集大小为542877936字节。
数据集概述
配置信息
- 默认配置 (
config_name: default) 包含以下数据文件:- 训练集 (
split: train):路径为data/train-* - 测试集 (
split: test):路径为data/test-* - 验证集 (
split: validation):路径为data/validation-*
- 训练集 (
数据集信息
-
特征:
input_values:数据类型为float32labels:数据类型为int64
-
分割详情:
- 训练集:
- 文件大小:478,695,272 字节
- 样本数量:2000
- 测试集:
- 文件大小:33,556,448 字节
- 样本数量:100
- 验证集:
- 文件大小:30,626,216 字节
- 样本数量:100
- 训练集:
-
下载与数据集大小:
- 下载大小:542,536,883 字节
- 数据集总大小:542,877,936 字节



