clinicalnlplab/LitCovid_train
收藏官方服务:
资源简介:
--- dataset_info: features: - name: id dtype: string - name: conversations list: - name: from dtype: string - name: value dtype: string - name: text dtype: string splits: - name: train num_bytes: 138390171 num_examples: 24960 - name: valid num_bytes: 34759127 num_examples: 6239 - name: test num_bytes: 14367053 num_examples: 2500 download_size: 65648863 dataset_size: 187516351 configs: - config_name: default data_files: - split: train path: data/train-* - split: valid path: data/valid-* - split: test path: data/test-* ---
提供机构:
clinicalnlplab原始信息汇总
数据集概述
特征信息
- id: 数据类型为字符串。
- conversations: 列表类型,包含以下子特征:
- from: 数据类型为字符串。
- value: 数据类型为字符串。
- text: 数据类型为字符串。
数据分割
- train: 包含24960个样本,总字节数为138390171。
- valid: 包含6239个样本,总字节数为34759127。
- test: 包含2500个样本,总字节数为14367053。
数据大小
- 下载大小: 65648863字节。
- 数据集大小: 187516351字节。
配置信息
- default配置包含以下数据文件路径:
- train:
data/train-* - valid:
data/valid-* - test:
data/test-*
- train:



