遇见数据集

electricsheepeurope/europe-ilo-emp-temp-sex-ind-est-nb-employment-by-ilo-sector-sex-and-establishment-siz

收藏
Hugging Face2026-05-29 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含30,658个观测值,涉及欧洲8个国家的就业数据,时间跨度为2008年至2025年,覆盖1个主要指标:按国际劳工组织(ILO)行业部门、性别和机构规模分类的就业人数(以千计)。数据来源于国际劳工组织的ILOSTAT数据库,该数据库是全球劳动力统计的主要来源,涵盖就业、失业、工资等多个领域。数据集包括国家代码、国家名称、数据来源、指标代码、性别分类、行业分类、机构规模分类、观测年份、观测值、数据状态标志等列,提供了详细的劳动力市场统计信息,适用于表格分类、回归和时间序列预测等任务。数据以年度频率发布,经过ILO的标准化处理,并包含数据质量说明和注意事项。

This dataset contains 30,658 observations covering employment data from 8 European countries, spanning the period from 2008 to 2025, with one primary indicator: employment (in thousands) categorized by International Labour Organization (ILO) economic sectors, gender and institutional size. The dataset is sourced from the ILOSTAT database of the International Labour Organization (ILO), which is a leading global source of labor statistics covering multiple domains including employment, unemployment, wages and other related fields. It includes columns such as country code, country name, data source, indicator code, gender category, industry classification, institutional size classification, observation year, observed value, and data status flag, providing detailed labor market statistics applicable to tasks like table classification, regression and time series forecasting. Released at an annual frequency, the data has been standardized by the ILO, and includes data quality descriptions and precautionary notes.

提供机构:
electricsheepeurope
搜集汇总
数据集介绍
electricsheepeurope/europe-ilo-emp-temp-sex-ind-est-nb-employment-by-ilo-sector-sex-and-establishment-siz 数据集图片
构建方式
该数据集依托国际劳工组织(ILO)旗下的ILOSTAT统计数据库,通过REST API接口直接采集EMP_TEMP_SEX_IND_EST_NB指标数据,并依据欧洲ISO3国家代码进行地理范围过滤。原始调查微观数据经ILO统计部门依据国际劳工统计学家会议(ICLS)定义进行统一归并处理,数据来源在source.label字段中予以标注,确保可追溯性。最终整合涵盖8个欧洲国家、跨越2008至2025年间共计30,658条观测记录,构成一份聚焦于欧洲地区就业状况的标准化表格数据集。
特点
该数据集以就业为核心指标,围绕国际劳工组织(ILO)的经济活动部门、性别及企业规模三个维度进行细致分类与统计。数据呈现年度频率,除提供国家、时间、指标值等基础字段外,还包含丰富的分类标签,如性别(总、男、女)、行业部门及企业规模汇总等,并附有数据来源、观测状态(如临时、不可靠)以及序列中断等注释说明,为用户提供高质量的数据质量标识。其单指标多维度特征,使其特别适用于开展欧洲跨国就业结构的对比分析与时序建模。
使用方法
用户可通过HuggingFace Datasets库的load_dataset()函数直接加载该数据集,并利用to_pandas()方法转换为Pandas DataFrame进行后续分析。典型操作包括按国家代码过滤子集、针对特定指标按时间排序绘制时间序列图、以及利用透视表构建国家与年份的观测值矩阵。数据以CC-BY-4.0许可发布,使用时需同时引用原始ILO数据源及Electric Sheep Europe的重新打包版本,以确保合规性。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)统计部门创建,经由Electric Sheep Europe于2025年重新打包并发布于HuggingFace平台。其核心研究问题聚焦于解析欧洲地区就业结构在ILO行业分类、性别及企业规模维度下的分布特征与演变趋势。数据集整合了阿尔巴尼亚、奥地利等8个欧洲国家从2008年至2025年间超过3万条观察记录,为劳动经济学、区域发展研究及劳动力市场政策评估提供了标准化的跨年度面板数据。凭借ILOSTAT数据库的权威性及其基于国际劳工统计学家会议(ICLS)定义的数据协调方法论,该数据已成为分析欧洲就业模式异质性的重要参考,对理解后金融危机时代欧洲劳动力市场的结构性变迁具有显著影响力。
当前挑战
该数据集所应对的领域核心挑战在于劳动统计中多维分类(行业、性别、企业规模)数据的稀疏性与可比性问题。由于各国调查频率、统计口径及数据质量标准参差不齐,构建过程面临多重困难:首先,同一国家不同年份可能出现数据源更替,如‘方法修订导致的序列断裂’标记所示,需要用户自行处理时序一致性问题;其次,部分观测值的可靠性标注为‘不可靠’,反映了原始数据采集中的质量波动;最后,经济活动的季节性波动与年度数据频率之间的错配,限制了该数据集在短期就业预测中的应用精度。这些挑战要求研究者在使用时须审慎处理数据质量标志,并建立针对跨国面板数据的稳健插补与验证机制。
常用场景
经典使用场景
在劳动经济学与区域发展研究领域,该数据集凭借其精细的行业、性别与机构规模三重分类维度,构成了分析欧洲劳动力市场结构变迁的基石。研究者常利用三十余年跨越八个欧洲国家的面板数据,追踪各经济部门就业吸纳能力的动态演化。例如,通过观察不同性别劳动者在农业、工业与服务业中的分布变化,揭示产业结构升级对就业性别隔离的影响。该数据集尤其适合开展固定效应模型或双重差分分析,以评估经济危机、政策干预或技术变革对特定行业就业规模的冲击,为理解欧洲一体化进程中劳动力市场的分化与整合提供量化依据。
衍生相关工作
依托该数据集规范化的面板结构,一系列衍生研究工作已相继展开。研究人员将其与欧洲家庭收入与生活条件统计调查(EU-SILC)进行匹配,构建了微观-宏观联立方程模型,用以检验行业就业复苏是否惠及低收入家庭。另一类经典工作聚焦于就业弹性的跨国收敛性检验,通过采用面板协整与误差修正模型,验证了中欧国家在向服务业转型过程中,就业吸纳效率正在向西欧标准趋同。此外,结合OECD的行业生产率数据库,后续文献运用分解分析法,量化了机构规模分布变化对整体劳动生产率增长的贡献,深刻揭示了中小企业扩张在推动包容性增长中的重要角色。
数据集最近研究
最新研究方向
该数据集聚焦于欧洲劳动力市场中就业结构的精细刻画,尤其关注国际劳工组织(ILO)部门分类、性别维度与机构规模交叠影响下的就业变动趋势。在全球化与后疫情时代劳动力市场重构的背景下,研究者正借助此类高分辨率面板数据,探索欧洲各国不同产业部门中性别就业差异的演化路径,以及中小型机构就业吸纳能力的动态变化。结合2008年至2025年间跨越8个欧洲国家的长时序观测,该数据集为评估劳动力市场弹性、结构性失业及政策干预效果提供了坚实的数据基础,当前研究热点集中于运用时间序列与面板计量模型,揭示欧洲就业结构转型中的非对称性与异质性特征。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务