goodcoffee/covidQA_eval_v2
收藏资源简介:
--- dataset_info: features: - name: input_ids sequence: int32 - name: attention_mask sequence: int8 - name: start_positions dtype: int64 - name: end_positions dtype: int64 splits: - name: train num_bytes: 782952 num_examples: 303 download_size: 0 dataset_size: 782952 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "covidQA_eval_v2" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集信息: 特征字段: - 名称:输入Token序列ID(input_ids) 序列类型:int32 - 名称:注意力掩码(attention_mask) 序列类型:int8 - 名称:起始位置(start_positions) 数据类型:int64 - 名称:结束位置(end_positions) 数据类型:int64 数据集划分: - 名称:训练集(train) 占用字节数:782952 样本数量:303 下载大小:0 数据集总大小:782952 配置项: - 配置名称:默认配置(default) 数据文件: - 数据集划分:训练集(train) 文件路径:data/train-* # 「covidQA_eval_v2」数据集卡片 【需补充更多信息】(详见:https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
特征
- input_ids: 序列类型,数据类型为 int32
- attention_mask: 序列类型,数据类型为 int8
- start_positions: 数据类型为 int64
- end_positions: 数据类型为 int64
数据分割
- train: 包含 303 个样本,总字节数为 782952
数据集大小
- 下载大小: 0 字节
- 数据集大小: 782952 字节
配置
- default: 包含训练数据文件,路径为
data/train-*



