jeggers/drop_single_number
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* dataset_info: features: - name: section_id dtype: string - name: query_id dtype: string - name: passage dtype: string - name: question dtype: string - name: answers_spans sequence: - name: spans dtype: string - name: types dtype: string - name: answers sequence: string - name: answer dtype: string - name: types sequence: string splits: - name: train num_bytes: 65926292.346666664 num_examples: 46973 - name: validation num_bytes: 346803.5697954903 num_examples: 267 download_size: 7856816 dataset_size: 66273095.91646215 --- # Dataset Card for "drop_single_number" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
This dataset is used for training and validation, containing multiple fields such as section_id, query_id, passage, question, answers_spans, answers, answer, and types, each with its data type. The dataset is divided into training and validation sets, containing 46973 and 267 samples respectively, with a download size of 7856816 bytes and a total size of 66273095.91646215 bytes.
数据集概述
数据集配置
- 默认配置 (
config_name: default)- 训练数据 (
split: train):路径为data/train-* - 验证数据 (
split: validation):路径为data/validation-*
- 训练数据 (
数据集信息
-
特征:
section_id:数据类型为字符串query_id:数据类型为字符串passage:数据类型为字符串question:数据类型为字符串answers_spans:序列类型,包含spans:数据类型为字符串types:数据类型为字符串
answers:序列类型,数据类型为字符串answer:数据类型为字符串types:序列类型,数据类型为字符串
-
数据集分割:
- 训练集 (
name: train):- 数据大小:65926292.346666664字节
- 示例数量:46973
- 验证集 (
name: validation):- 数据大小:346803.5697954903字节
- 示例数量:267
- 训练集 (
-
下载大小:7856816字节
-
数据集总大小:66273095.91646215字节



