Jing24/seperate_all_sub4
收藏资源简介:
--- dataset_info: features: - name: id dtype: string - name: title dtype: string - name: context dtype: string - name: question dtype: string - name: answers struct: - name: answer_start sequence: int32 - name: text sequence: string splits: - name: train num_bytes: 42345866 num_examples: 46640 download_size: 7708985 dataset_size: 42345866 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "seperate_all_sub4" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- dataset_info: 数据集信息: features: - 字段名(name):id,数据类型(dtype):字符串(string) - 字段名(name):title,数据类型(dtype):字符串(string) - 字段名(name):context,数据类型(dtype):字符串(string) - 字段名(name):question,数据类型(dtype):字符串(string) - 字段名(name):answers,为结构体(struct),包含子字段: - 子字段名(name):answer_start,序列类型(sequence),元素类型为32位整数(int32) - 子字段名(name):text,序列类型(sequence),元素类型为字符串(string) splits: - 划分名称(name):train(训练集),占用字节数(num_bytes):42345866,样本数量(num_examples):46640 download_size:7708985 dataset_size:42345866 configs: - 配置名称(config_name):default,数据文件(data_files): - 对应训练集划分(split:train),文件路径:`data/train-*` --- # 「seperate_all_sub4」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
特征信息
- id: 字符串类型
- title: 字符串类型
- context: 字符串类型
- question: 字符串类型
- answers: 结构体类型,包含以下字段:
- answer_start: 整数序列类型
- text: 字符串序列类型
数据分割
- train:
- 字节数: 42345866
- 样本数: 46640
数据集大小
- 下载大小: 7708985 字节
- 数据集大小: 42345866 字节
配置信息
- default 配置:
- 数据文件:
- 分割: train
- 路径: data/train-*
- 数据文件:



