遇见数据集

pbaoo2705/processed_dataset_v2

收藏
Hugging Face2023-09-06 更新2024-03-04 收录
官方服务:

资源简介:

--- configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* dataset_info: features: - name: pubid dtype: int32 - name: question dtype: string - name: context dtype: string - name: long_answer dtype: string - name: final_decision dtype: string - name: text dtype: string splits: - name: train num_bytes: 9013737 num_examples: 5000 - name: test num_bytes: 1797886 num_examples: 1000 download_size: 6294228 dataset_size: 10811623 --- # Dataset Card for "processed_dataset_v2" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

配置项: - 配置名称(config_name):默认 数据文件: - 数据拆分(split):训练集(train),路径:data/train-* - 数据拆分(split):测试集(test),路径:data/test-* 数据集信息: 特征字段: - 字段名:pubid,数据类型(dtype):32位整数(int32) - 字段名:question,数据类型(dtype):字符串(string) - 字段名:context,数据类型(dtype):字符串(string) - 字段名:long_answer,数据类型(dtype):字符串(string) - 字段名:final_decision,数据类型(dtype):字符串(string) - 字段名:text,数据类型(dtype):字符串(string) 数据拆分: - 拆分名称:训练集(train),字节数:9013737,示例数量:5000 - 拆分名称:测试集(test),字节数:1797886,示例数量:1000 下载大小:6294228 数据集总大小:10811623 --- # 「processed_dataset_v2」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

提供机构:
pbaoo2705
原始信息汇总

数据集概述

数据集配置

  • 配置名称: default
  • 数据文件:
    • 训练集: 路径为 data/train-*
    • 测试集: 路径为 data/test-*

数据集信息

  • 特征:

    • pubid: 数据类型为 int32
    • question: 数据类型为 string
    • context: 数据类型为 string
    • long_answer: 数据类型为 string
    • final_decision: 数据类型为 string
    • text: 数据类型为 string
  • 数据分割:

    • 训练集:
      • 字节数: 9013737
      • 样本数: 5000
    • 测试集:
      • 字节数: 1797886
      • 样本数: 1000
  • 下载大小: 6294228 字节

  • 数据集大小: 10811623 字节

二维码
社区交流群
二维码
科研交流群
商业服务