emaeon/train7
收藏资源简介:
--- dataset_info: features: - name: code1 dtype: string - name: code2 dtype: string - name: similar dtype: int64 - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 9013855023 num_examples: 5000000 download_size: 4017642295 dataset_size: 9013855023 --- # Dataset Card for "train7" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集信息: 特征字段: - 名称:code1,数据类型:字符串 - 名称:code2,数据类型:字符串 - 名称:similar,数据类型:64位整数 - 名称:__index_level_0__,数据类型:64位整数 数据集划分: - 名称:训练集,字节大小:9013855023,样本数量:5000000 下载大小:4017642295 数据集总大小:9013855023 # "train7"数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集名称
- 名称: train7
数据集特征
- 特征列表:
- code1: 数据类型为字符串
- code2: 数据类型为字符串
- similar: 数据类型为整数64位
- index_level_0: 数据类型为整数64位
数据集拆分
- 训练集:
- 数据量: 5000000条记录
- 存储大小: 9013855023字节
数据集大小
- 下载大小: 4017642295字节
- 总数据集大小: 9013855023字节



