遇见数据集

electricsheepeurope/europe-ilo-how-2emp-sex-nb-mean-weekly-hours-actually-worked-per-employed-per

收藏
Hugging Face2026-05-28 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含关于工作时间的2,673个观测值,覆盖39个欧洲国家,时间跨度为2005年至2027年,包含1个独特指标。具体来说,它提供了按性别划分的就业人员平均每周实际工作时间的国际劳工组织(ILO)模拟估计值,指标代码为HOW_2EMP_SEX_NB。数据来源于ILOSTAT(国际劳工组织的中央统计数据库),经过处理和过滤以涵盖欧洲国家,并包括国家代码、国家名称、数据来源、指标、性别细分、年份、观测值及其状态等列。数据集旨在支持表格分类、回归和时间序列预测等任务,适用于劳动市场分析和研究。

This dataset contains 2,673 observations of Hours of work data across 39 Europe countries, spanning 2005–2027, covering 1 distinct indicator. Specifically, it provides ILO modelled estimates for the mean weekly hours actually worked per employed person by sex, with the indicator code HOW_2EMP_SEX_NB. The data is sourced from ILOSTAT (the ILOs central statistics database), processed and filtered to cover European countries, and includes columns such as country code, country name, data source, indicator, sex disaggregation, year, observed value, and status. The dataset is designed for tasks like tabular classification, regression, and time-series forecasting, suitable for labor market analysis and research.

提供机构:
electricsheepeurope
搜集汇总
数据集介绍
electricsheepeurope/europe-ilo-how-2emp-sex-nb-mean-weekly-hours-actually-worked-per-employed-per 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT数据库,通过REST API接口直接抽取指标编码为‘HOW_2EMP_SEX_NB’的原始数据,并根据欧洲ISO3国家代码进行地理范围过滤。ILOSTAT遵循国际劳工统计学家会议(ICLS)的统一定义,对各国劳动力调查、家庭收支调查及行政记录等微观数据进行协调处理,生成具有可比性的建模估计值。数据经Electric Sheep Europe团队重新封装为Parquet格式,上传至HuggingFace平台,以标准化数据集卡片呈现,便于研究人员直接调用。
特点
此数据集涵盖2005至2027年间39个欧洲国家的2,673条观测记录,聚焦于‘按性别划分的就业者周均实际工作小时数’这一单一核心指标。数据按性别属性进行细分,包含总人口、男性与女性三个维度,支持分组分析。每条记录均由ILO标记数据来源与观测状态(如真实值、临时值等),确保可追溯性与质量透明度。数据集以年度频率发布,适用于时间序列分析与跨国家比较研究。
使用方法
用户可通过HuggingFace的`datasets`库直接加载该数据集,执行`load_dataset`命令即可获取训练集格式的DataFrame。支持按国家代码(如ref_area == 'DEU')筛选特定国家数据,或通过`pivot_table`将数据重塑为国家×年份的矩阵结构,便于横向对比。针对单一指标的时序分析,可依据指示器编码过滤后按时间排序并可视化。数据集以Parquet格式存储,兼容主流数据处理工具,适合劳动经济学、就业市场评估等领域的建模与统计分析。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)统计司于2005年至2027年间持续编制,经Electric Sheep Europe重新整合后发布于HuggingFace平台,旨在提供欧洲39个国家按性别划分的就业人员平均每周实际工作小时数的建模估计值。作为ILOSTAT核心数据库的分支,该数据集聚焦于劳动经济学中的工时研究,旨在填补跨国标准化工时数据的空白,为比较劳动政策、性别平等分析及劳动力市场效率研究提供可靠基础。其影响力体现在:为经济学、社会学及公共政策领域的研究者提供了统一可比的纵向面板数据,支撑了关于欧洲各国劳动强度差异、性别就业模式演变及工时效应对宏观经济波动响应的实证分析,是ILO推动体面劳动议程的重要数据支柱。
当前挑战
该数据集面临的核心挑战在于:首先,工时数据的高度异质性——欧洲各国在劳动力调查设计、工时定义(如是否包含加班、休假)及统计口径上存在差异,ILO虽通过ICLS定义进行调和,但原始调查误差与建模估计的不确定性仍可能影响跨国比较的精度。其次,数据集仅提供年度频率,无法捕捉高频率的工时波动(如季节性用工或突发政策冲击下的即时变化),限制了其在短期经济预测或实时监测中的应用潜力。构建过程中,数据整合面临多源汇流的复杂度——需从各国劳动力调查、行政记录等多种来源抽取数据,并通过ILO的“最佳来源”筛选规则处理同一国家-年份的多源冲突,这一过程虽提升了数据一致性,却也引入了主观选择偏差。此外,建模估计对缺失数据的插补依赖,在数据稀疏的新兴欧洲经济体(如东欧国家)中可能放大预测误差,成为影响结论稳健性的潜在隐患。
常用场景
经典使用场景
在欧洲劳动经济学与劳动力市场研究的广袤领域中,europe-ilo-how-2emp-sex-nb-mean-weekly-hours-actually-worked-per-employed-per数据集承载着弥足珍贵的时空信息。该数据集汇集了39个欧洲国家从2005年至2027年间的年度观测数据,聚焦于按性别分列的受雇人员实际工作平均周小时数。研究者可依托此数据集,通过时间序列分析探究各国劳动时长动态演变的轨迹,或是借助面板数据模型洞悉性别间工作时间的结构性差异与收敛趋势。该数据为劳动供给弹性、工作-生活平衡及性别不平等等经典议题提供了扎实的实证基础。
实际应用
在现实世界的决策与实践层面,该数据集展现出广泛的实用价值。政策制定者可利用其构建动态监测模型,精准捕捉各国劳动时长异常波动,从而及时调整劳动市场干预策略。国际劳工组织与各国统计部门可将其作为基准数据集,校准本国劳动力调查数据的时效性与一致性。企业人力资源规划和管理咨询领域亦可借助性别与国别交叉分析,优化跨国用工策略与薪酬结构调整。更值得关注的是,该数据作为ILO建模估计的输出结果,本身即服务于可持续发展目标(SDG)中体面劳动指标的全球监测,为实证评估欧洲各国在缩小性别工作差距方面的进展提供了量化标尺。
衍生相关工作
围绕该数据集衍生了多条颇具影响力的学术脉络。有研究者基于其时间序列特征,构建了混合效应模型以预测欧洲各国未来工作小时数的走势,并与欧洲统计局(Eurostat)的官方预测进行对比验证。在面板数据框架下,学者们利用固定效应模型和工具变量方法,考察了最低工资政策、育儿假制度以及税收-福利体系对男性和女性工作小时数的差异化影响。此外,该数据与ILO其他指标数据集的联动分析催生了关于劳动质量与工作时长关联性的专题研究,部分工作更结合宏观经济变量构建了结构性向量自回归(SVAR)模型,深入探讨了工作时长与技术变革之间的长期均衡关系,显著丰富了劳动经济学实证文献的多维叙事。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务