遇见数据集

navinbhaskar/medical_keywords_dataset

收藏
Hugging Face2026-03-18 更新2026-03-29 收录
官方服务:

资源简介:

--- dataset_info: features: - name: text dtype: string splits: - name: train num_bytes: 24677337 num_examples: 80000 - name: test num_bytes: 6169334 num_examples: 20000 download_size: 4948010 dataset_size: 30846671 configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* ---

数据集详情: 数据特征: - 字段名:text,数据类型:字符串 数据集拆分: - 拆分名称:train(训练集),字节数:24677337,样本数:80000 - 拆分名称:test(测试集),字节数:6169334,样本数:20000 下载大小:4948010,总数据集大小:30846671 配置项: - 配置名称:default,数据文件: - 拆分集train:对应路径为data/train-* - 拆分集test:对应路径为data/test-*

提供机构:
navinbhaskar
二维码
社区交流群
二维码
科研交流群
商业服务