clinicalnlplab/PubmedQA_train
收藏官方服务:
资源简介:
--- dataset_info: features: - name: id dtype: string - name: conversations list: - name: from dtype: string - name: value dtype: string - name: text dtype: string splits: - name: train num_bytes: 701570152 num_examples: 211269 - name: valid num_bytes: 159299 num_examples: 50 - name: test num_bytes: 1622241 num_examples: 500 download_size: 359787344 dataset_size: 703351692 --- # Dataset Card for "PubmedQA_train" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
提供机构:
clinicalnlplab原始信息汇总
数据集概述
数据集特征
- id: 数据类型为字符串。
- conversations: 包含以下子特征:
- from: 数据类型为字符串。
- value: 数据类型为字符串。
- text: 数据类型为字符串。
数据集分割
- train: 包含211269个样本,占用701570152字节。
- valid: 包含50个样本,占用159299字节。
- test: 包含500个样本,占用1622241字节。
数据集大小
- 下载大小: 359787344字节。
- 数据集总大小: 703351692字节。



