pbaoo2705/processed_dataset_v2
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* dataset_info: features: - name: pubid dtype: int32 - name: question dtype: string - name: context dtype: string - name: long_answer dtype: string - name: final_decision dtype: string - name: text dtype: string splits: - name: train num_bytes: 9013737 num_examples: 5000 - name: test num_bytes: 1797886 num_examples: 1000 download_size: 6294228 dataset_size: 10811623 --- # Dataset Card for "processed_dataset_v2" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
配置项: - 配置名称(config_name):默认 数据文件: - 数据拆分(split):训练集(train),路径:data/train-* - 数据拆分(split):测试集(test),路径:data/test-* 数据集信息: 特征字段: - 字段名:pubid,数据类型(dtype):32位整数(int32) - 字段名:question,数据类型(dtype):字符串(string) - 字段名:context,数据类型(dtype):字符串(string) - 字段名:long_answer,数据类型(dtype):字符串(string) - 字段名:final_decision,数据类型(dtype):字符串(string) - 字段名:text,数据类型(dtype):字符串(string) 数据拆分: - 拆分名称:训练集(train),字节数:9013737,示例数量:5000 - 拆分名称:测试集(test),字节数:1797886,示例数量:1000 下载大小:6294228 数据集总大小:10811623 --- # 「processed_dataset_v2」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集配置
- 配置名称: default
- 数据文件:
- 训练集: 路径为
data/train-* - 测试集: 路径为
data/test-*
- 训练集: 路径为
数据集信息
-
特征:
- pubid: 数据类型为
int32 - question: 数据类型为
string - context: 数据类型为
string - long_answer: 数据类型为
string - final_decision: 数据类型为
string - text: 数据类型为
string
- pubid: 数据类型为
-
数据分割:
- 训练集:
- 字节数: 9013737
- 样本数: 5000
- 测试集:
- 字节数: 1797886
- 样本数: 1000
- 训练集:
-
下载大小: 6294228 字节
-
数据集大小: 10811623 字节



