fiveflow/koquad_v2_polyglot_tkd_20th
收藏资源简介:
--- dataset_info: features: - name: context dtype: string - name: input_ids sequence: int32 - name: attention_mask sequence: int8 - name: labels sequence: int64 splits: - name: train num_bytes: 1766922390 num_examples: 20000 download_size: 592965039 dataset_size: 1766922390 --- # Dataset Card for "koquad_v2_polyglot_tkd_20th" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- dataset_info: features: - 名称: 上下文(context) 数据类型: 字符串(string) - 名称: 输入Token序列(input_ids) 数据类型: 32位整数序列(sequence of int32) - 名称: 注意力掩码(attention_mask) 数据类型: 8位整数序列(sequence of int8) - 名称: 标签(labels) 数据类型: 64位整数序列(sequence of int64) splits: - 名称: 训练集(train) 字节数: 1766922390 样本数量: 20000 download_size: 592965039 dataset_size: 1766922390 --- # 《koquad_v2_polyglot_tkd_20th》数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
特征
- context: 字符串类型
- input_ids: 整数序列,类型为int32
- attention_mask: 整数序列,类型为int8
- labels: 整数序列,类型为int64
数据分割
- train: 包含20000个样本,占用1766922390字节
大小
- 下载大小: 592965039字节
- 数据集大小: 1766922390字节



