tyzhu/squad_wrong_title_v3_train_30_eval_10
收藏资源简介:
--- dataset_info: features: - name: id dtype: string - name: title dtype: string - name: context dtype: string - name: question dtype: string - name: answers sequence: - name: text dtype: string - name: answer_start dtype: int32 - name: context_id dtype: string - name: inputs dtype: string - name: targets dtype: string splits: - name: train num_bytes: 658246 num_examples: 378 - name: validation num_bytes: 68560 num_examples: 60 download_size: 124427 dataset_size: 726806 --- # Dataset Card for "squad_wrong_title_v3_train_30_eval_10" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
### 数据集信息 #### 特征字段: - 名称:id,数据类型:字符串 - 名称:title,数据类型:字符串 - 名称:context,数据类型:字符串 - 名称:question,数据类型:字符串 - 名称:answers:序列型字段,包含以下子字段: - 子字段text:数据类型为字符串 - 子字段answer_start:数据类型为32位整数 - 名称:context_id,数据类型:字符串 - 名称:inputs,数据类型:字符串 - 名称:targets,数据类型:字符串 #### 数据集划分: - 划分集:训练集(train),字节占用量:658246,样本数量:378 - 划分集:验证集(validation),字节占用量:68560,样本数量:60 下载大小:124427 数据集总大小:726806 --- # 「squad_wrong_title_v3_train_30_eval_10」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
特征
- id: 字符串类型
- title: 字符串类型
- context: 字符串类型
- question: 字符串类型
- answers: 序列类型,包含以下子特征:
- text: 字符串类型
- answer_start: 整数类型 (int32)
- context_id: 字符串类型
- inputs: 字符串类型
- targets: 字符串类型
数据分割
- train:
- 字节数: 658246
- 样本数: 378
- validation:
- 字节数: 68560
- 样本数: 60
数据集大小
- 下载大小: 124427 字节
- 数据集大小: 726806 字节



