hivemind-research/medical-layerA-final
收藏资源简介:
--- dataset_info: features: - name: sample_id dtype: string - name: task_type dtype: string - name: domain dtype: string - name: subdomain dtype: string - name: difficulty dtype: string - name: source dtype: string - name: input_text dtype: string - name: target_text dtype: string - name: has_gold_label dtype: bool - name: language dtype: string - name: split dtype: string - name: bucket_id dtype: string splits: - name: train num_bytes: 17091188 num_examples: 32000 - name: validation num_bytes: 2169844 num_examples: 4000 - name: test num_bytes: 2138439 num_examples: 4000 download_size: 10866804 dataset_size: 21399471 configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* ---
数据集信息: 特征: - 名称:样本ID(sample_id),数据类型:字符串 - 名称:任务类型(task_type),数据类型:字符串 - 名称:领域(domain),数据类型:字符串 - 名称:子领域(subdomain),数据类型:字符串 - 名称:难度(difficulty),数据类型:字符串 - 名称:来源(source),数据类型:字符串 - 名称:输入文本(input_text),数据类型:字符串 - 名称:目标文本(target_text),数据类型:字符串 - 名称:是否包含金标准标签(gold label),数据类型:布尔值 - 名称:语言(language),数据类型:字符串 - 名称:数据划分(split),数据类型:字符串 - 名称:桶ID(bucket_id),数据类型:字符串 数据划分: - 名称:训练集(train),字节数:17091188,样本数:32000 - 名称:验证集(validation),字节数:2169844,样本数:4000 - 名称:测试集(test),字节数:2138439,样本数:4000 下载大小:10866804 字节 数据集总大小:21399471 字节 配置: - 配置名称:默认配置(default),数据文件: - 训练集划分:路径为 data/train-* - 验证集划分:路径为 data/validation-* - 测试集划分:路径为 data/test-*



