ICILS/isco_esco_occupations_taxonomy|职业分类数据集|多类分类数据集
收藏数据集卡片 for ISCO-ESCO Occupations Taxonomy
数据集详情
数据集描述
- 数据集名称: ISCO-ESCO Occupations Taxonomy
- 任务类别: 文本分类
- 任务ID: 多类分类
- 标签: 职业编码, ESCO, ISCO-08
- 来源数据集: 欧洲委员会 ESCO
- 语言: [更多信息需要]
- 许可证: [更多信息需要]
数据集配置
- 配置名称: isco_occupations
- 特征:
- ISCO_OCCUPATION: 字符串
- ISCO_CODE: 类别标签
- 名称: 0 到 9629 (共618个类别)
数据分割
- 分割名称: train
- 字节数: 248076
- 样本数: 7018
数据文件
-
配置名称: isco_occupations
- 分割: train
- 路径: data/isco_occupations.jsonl
-
配置名称: isco_taxonomy
- 分割: train
- 路径: data/isco_taxonomy.jsonl
训练与评估指标
- 配置: isco_occupations
- 任务: 文本分类
- 任务ID: 多类分类
- 分割: train
- 列映射:
- 文本: ISCO_OCCUPATION
- 标签: ISCO_CODE
- 指标:
- 准确率
- F1 macro
- F1 micro
- F1 weighted
- Precision macro
- Precision micro
- Precision weighted
- Recall macro
- Recall micro
- Recall weighted
- ISCO Hierarchical Accuracy
中国1km分辨率逐月降水量数据集(1901-2023)
该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2023.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
THUCNews
THUCNews是根据新浪新闻RSS订阅频道2005~2011年间的历史数据筛选过滤生成,包含74万篇新闻文档(2.19 GB),均为UTF-8纯文本格式。本次比赛数据集在原始新浪新闻分类体系的基础上,重新整合划分出14个候选分类类别:财经、彩票、房产、股票、家居、教育、科技、社会、时尚、时政、体育、星座、游戏、娱乐。提供训练数据共832471条。
github 收录
风电预测数据集
全球能源预测大赛(Global Energy Forecasting Competition ) 2012 - 风力发电赛道 所用数据集.
AI_Studio 收录
Solar Radiation Data
该数据集包含全球多个地点的太阳辐射数据,涵盖了不同时间段和气象条件下的辐射强度。数据包括直接辐射、散射辐射和总辐射等指标,适用于太阳能资源评估和气候研究。
www.nrel.gov 收录
VisDrone2019
VisDrone2019数据集由AISKYEYE团队在天津大学机器学习和数据挖掘实验室收集,包含288个视频片段共261,908帧和10,209张静态图像。数据集覆盖了中国14个不同城市的城市和乡村环境,包括行人、车辆、自行车等多种目标,以及稀疏和拥挤场景。数据集使用不同型号的无人机在各种天气和光照条件下收集,手动标注了超过260万个目标边界框,并提供了场景可见性、对象类别和遮挡等重要属性。
github 收录