遇见数据集

tyzhu/squad_qa_no_id_v5_full_recite_ans_sent_random_permute_rerun_1

收藏
Hugging Face2024-02-07 更新2024-03-04 收录
官方服务:

资源简介:

--- configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* dataset_info: features: - name: id dtype: string - name: title dtype: string - name: context dtype: string - name: question dtype: string - name: answers sequence: - name: text dtype: string - name: answer_start dtype: int32 - name: answer dtype: string - name: context_id dtype: string - name: inputs dtype: string - name: targets dtype: string splits: - name: train num_bytes: 4509256.519784173 num_examples: 2875 - name: validation num_bytes: 402971 num_examples: 300 download_size: 1344706 dataset_size: 4912227.519784173 --- # Dataset Card for "squad_qa_no_id_v5_full_recite_ans_sent_random_permute_rerun_1" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

This dataset is a question-answering dataset, including training and validation sets. The features of the dataset include id, title, context, question, answers (containing text and answer start position), answer, context_id, inputs, and targets. The training set contains 2875 samples, and the validation set contains 300 samples. The total size of the dataset is 4912227.519784173 bytes.

提供机构:
tyzhu
原始信息汇总

数据集卡片 "squad_qa_no_id_v5_full_recite_ans_sent_random_permute_rerun_1"

配置

  • 默认配置
    • 训练数据
      • 路径:data/train-*
    • 验证数据
      • 路径:data/validation-*

数据集信息

  • 特征

    • id:字符串类型
    • title:字符串类型
    • context:字符串类型
    • question:字符串类型
    • answers:序列类型
      • text:字符串类型
      • answer_start:32位整数类型
    • answer:字符串类型
    • context_id:字符串类型
    • inputs:字符串类型
    • targets:字符串类型
  • 分割

    • 训练集
      • 字节数:4509256.519784173
      • 样本数:2875
    • 验证集
      • 字节数:402971
      • 样本数:300
  • 下载大小:1344706

  • 数据集大小:4912227.519784173

二维码
社区交流群
二维码
科研交流群
商业服务