pallavi176/resume_dataset
收藏资源简介:
--- dataset_info: features: - name: resume_str dtype: string - name: category dtype: string - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 12496606 num_examples: 1987 - name: test num_bytes: 1631312 num_examples: 248 - name: validation num_bytes: 1604207 num_examples: 249 download_size: 7940604 dataset_size: 15732125 configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* - split: validation path: data/validation-* ---
数据集信息: 特征项: - 简历文本(resume_str):数据类型为字符串 - 类别(category):数据类型为字符串 - 索引层级0(__index_level_0__):数据类型为64位整型 数据集划分: - 训练集(train):字节占用量12496606,样本总数1987 - 测试集(test):字节占用量1631312,样本总数248 - 验证集(validation):字节占用量1604207,样本总数249 下载总大小:7940604字节,数据集总占用大小:15732125字节 配置项: - 默认配置(default):数据文件路径映射如下 - 训练集对应路径:data/train-* - 测试集对应路径:data/test-* - 验证集对应路径:data/validation-*
数据集概述
数据集特征
- resume_str: 数据类型为字符串。
- category: 数据类型为字符串。
- index_level_0: 数据类型为整数64位。
数据集分割
- train: 包含1987个样本,占用12496606字节。
- test: 包含248个样本,占用1631312字节。
- validation: 包含249个样本,占用1604207字节。
数据集大小
- 下载大小: 7940604字节。
- 数据集大小: 15732125字节。
配置信息
- default:
- train: 路径为
data/train-*。 - test: 路径为
data/test-*。 - validation: 路径为
data/validation-*。
- train: 路径为




