cmcmaster/UltrachatRheumatology
收藏资源简介:
--- dataset_info: features: - name: prompt dtype: string - name: prompt_id dtype: string - name: messages list: - name: content dtype: string - name: role dtype: string - name: text dtype: string - name: rheumatology_terms dtype: bool splits: - name: train num_bytes: 21726399.91286039 num_examples: 2008 download_size: 14157810 dataset_size: 21726399.91286039 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "UltrachatRheumatology" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- ### 数据集信息 #### 特征字段 - 字段名:`prompt`(提示词),数据类型:字符串 - 字段名:`prompt_id`(提示词ID),数据类型:字符串 - 字段名:`messages`,数据类型:列表,列表内每个元素为包含以下子字段的字典: - 字段名:`content`(内容),数据类型:字符串 - 字段名:`role`(角色),数据类型:字符串 - 字段名:`text`,数据类型:字符串 - 字段名:风湿病学术语(rheumatology_terms),数据类型:布尔值 #### 数据集划分 - 划分名称:训练集(train),字节数:21726399.91286039,样本数:2008 - 数据集下载大小:14157810 - 数据集总字节数:21726399.91286039 #### 配置项 - 配置名称:`default`(默认配置),数据文件配置: - 关联数据集划分:训练集(train),文件路径:`data/train-*` --- # 「UltrachatRheumatology」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
-
特征列表:
prompt:字符串类型prompt_id:字符串类型messages:列表类型,包含以下子特征:content:字符串类型role:字符串类型
text:字符串类型rheumatology_terms:布尔类型
-
数据分割:
train:包含2008个样本,数据大小为21726399.91286039字节
-
数据集大小:
- 下载大小:14157810字节
- 数据集大小:21726399.91286039字节
配置信息
- 默认配置:
- 数据文件路径:
data/train-*
- 数据文件路径:



