ManuelAlv/PubMed
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* dataset_info: features: - name: input dtype: string - name: label dtype: string splits: - name: train num_bytes: 22699692 num_examples: 135030 - name: validation num_bytes: 5673744 num_examples: 33757 - name: test num_bytes: 1895905 num_examples: 11253 download_size: 18142349 dataset_size: 30269341 --- # Dataset Card for "PubMed" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 配置项: - 配置名称:default 数据文件: - 数据集划分:train(训练集),路径:data/train-* - 数据集划分:validation(验证集),路径:data/validation-* - 数据集划分:test(测试集),路径:data/test-* 数据集信息: 特征字段: - 字段名:input(输入),数据类型:string(字符串) - 字段名:label(标签),数据类型:string(字符串) 数据集划分详情: - 划分名称:train(训练集),字节数:22699692,样本数量:135030 - 划分名称:validation(验证集),字节数:5673744,样本数量:33757 - 划分名称:test(测试集),字节数:1895905,样本数量:11253 下载总大小:18142349 字节 数据集总存储大小:30269341 字节 --- # "PubMed" 数据集卡片(Dataset Card) [更多完善信息请参见:https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards]
数据集概述
配置
- 默认配置 (
default)- 数据文件路径:
- 训练集 (
train):data/train-* - 验证集 (
validation):data/validation-* - 测试集 (
test):data/test-*
- 训练集 (
- 数据文件路径:
数据集信息
-
特征:
input: 数据类型为stringlabel: 数据类型为string
-
数据分割:
- 训练集 (
train):- 字节数: 22699692
- 样本数: 135030
- 验证集 (
validation):- 字节数: 5673744
- 样本数: 33757
- 测试集 (
test):- 字节数: 1895905
- 样本数: 11253
- 训练集 (
-
数据集大小:
- 下载大小: 18142349 字节
- 数据集总大小: 30269341 字节




