tyzhu/squad_qa_no_id_v5_full_recite_ans_sent_random_permute_rerun_1
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* dataset_info: features: - name: id dtype: string - name: title dtype: string - name: context dtype: string - name: question dtype: string - name: answers sequence: - name: text dtype: string - name: answer_start dtype: int32 - name: answer dtype: string - name: context_id dtype: string - name: inputs dtype: string - name: targets dtype: string splits: - name: train num_bytes: 4509256.519784173 num_examples: 2875 - name: validation num_bytes: 402971 num_examples: 300 download_size: 1344706 dataset_size: 4912227.519784173 --- # Dataset Card for "squad_qa_no_id_v5_full_recite_ans_sent_random_permute_rerun_1" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
This dataset is a question-answering dataset, including training and validation sets. The features of the dataset include id, title, context, question, answers (containing text and answer start position), answer, context_id, inputs, and targets. The training set contains 2875 samples, and the validation set contains 300 samples. The total size of the dataset is 4912227.519784173 bytes.
数据集卡片 "squad_qa_no_id_v5_full_recite_ans_sent_random_permute_rerun_1"
配置
- 默认配置:
- 训练数据:
- 路径:
data/train-*
- 路径:
- 验证数据:
- 路径:
data/validation-*
- 路径:
- 训练数据:
数据集信息
-
特征:
id:字符串类型title:字符串类型context:字符串类型question:字符串类型answers:序列类型text:字符串类型answer_start:32位整数类型
answer:字符串类型context_id:字符串类型inputs:字符串类型targets:字符串类型
-
分割:
- 训练集:
- 字节数:4509256.519784173
- 样本数:2875
- 验证集:
- 字节数:402971
- 样本数:300
- 训练集:
-
下载大小:1344706
-
数据集大小:4912227.519784173



