遇见数据集

electricsheepeurope/europe-ilo-luu-2lu2-sex-age-rt-combined-rate-of-time-related-underemployment-and

收藏
Hugging Face2026-05-28 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含国际劳工组织(ILO)欧洲地区关于时间相关就业不足和失业综合率(LU2)的统计数据,按性别和年龄划分。数据集涵盖39个欧洲国家从2005年至2027年的8019个观测值,核心指标为LUU_2LU2_SEX_AGE_RT(按性别和年龄划分的时间相关就业不足和失业综合率)。数据来源于ILOSTAT数据库,采用国际劳工统计学家会议(ICLS)定义进行标准化处理。数据集包含国家代码、指标代码、性别分类(总计、男性、女性)、年龄分类(15岁以上)、年份、观测值及数据状态等字段,适用于表格分类、回归和时间序列预测等机器学习任务。

This dataset contains statistics from the International Labour Organization (ILO) on the Combined rate of time-related underemployment and unemployment (LU2) for Europe, disaggregated by sex and age. It includes 8,019 observations across 39 European countries from 2005 to 2027, with the core indicator being LUU_2LU2_SEX_AGE_RT (Combined rate of time-related underemployment and unemployment by sex and age). The data is sourced from the ILOSTAT database and harmonized using International Conference of Labour Statisticians (ICLS) definitions. The dataset includes fields such as country codes, indicator codes, sex classification (total, male, female), age classification (15+), year, observed values, and data status flags, making it suitable for tabular classification, regression, and time-series forecasting tasks.

提供机构:
electricsheepeurope
搜集汇总
数据集介绍
electricsheepeurope/europe-ilo-luu-2lu2-sex-age-rt-combined-rate-of-time-related-underemployment-and 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT数据库,经由Electric Sheep Europe团队从ILOSTAT REST API直接抽取并重新封装。数据以LUU_2LU2_SEX_AGE_RT为指标代码,筛选出39个欧洲国家的观测值,时间跨度覆盖2005年至2027年。ILOSTAT依据国际劳工统计学家会议(ICLS)定义对原始调查微观数据进行统一协调,并通过source.label列标注数据来源,确保每一观测值的可追溯性。数据集以Parquet格式存储,共包含8,019条记录,涵盖按性别与年龄分层的时间相关就业不足与失业综合率指标。
特点
数据集以单一核心指标LUU_2LU2_SEX_AGE_RT聚焦于劳动力未充分利用的复合度量,融合了时间相关就业不足与失业两种状态,提供了按性别(总、男、女)与年龄层次细分的观测值。覆盖39个欧洲国家,时间序列长达23年,且包含ILO的模型估计值,适合进行跨国长期比较分析。每条记录附有观测状态标记,如'Real value'或'Provisional',反映数据可靠性。数据采用年度频率,并通过ISO国家代码、性别分类代码和年龄分类代码实现多维分解,结构简洁而信息丰富。
使用方法
用户可通过HuggingFace Datasets库的load_dataset函数直接加载数据,并将其转换为Pandas DataFrame以便进一步操作。推荐使用dataframe过滤器提取特定国家(如德国)或特定指标的子集,也可利用排序与可视化工具绘制时间序列曲线,观察单国或指标的演进趋势。对于跨国家比较,可将数据透视转换为以年份为行、国家为列的矩阵形式,便于进行面板数据分析或回归建模。该数据集在时间序列预测、分类与回归任务中均有广泛应用潜力。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)统计数据库ILOSTAT于2025年发布,经Electric Sheep Europe团队重新封装后发布于HuggingFace平台。其核心研究问题聚焦于欧洲39个国家在2005至2027年间,基于性别与年龄维度的劳动时间相关就业不足与失业综合率(LU2)的量化监测与分析。作为衡量劳动力利用不足的关键指标,LU2综合率弥补了传统失业率仅反映完全失业状态的局限,能够更全面地刻画劳动力市场的闲置程度与结构性失衡。该数据集依托ILOSTAT在全球劳工统计领域的权威性,整合了各国劳动力调查、家庭收入调查及行政记录等多元数据源,为劳动经济学、社会政策评估与跨国比较研究提供了标准化、可复现的高质量时序数据,对理解欧洲劳动力市场的动态演变与性别差异具有重要学术价值与应用意义。
当前挑战
该数据集面临的核心挑战在于处理劳动力利用不足概念的跨国测量差异。尽管ILO通过国际劳工统计学家会议(ICLS)定义实现了一定程度的数据协调,但各国在抽样框架、调查问卷设计及数据收集时点上的固有差异仍可能引入系统性偏差,影响跨年份与跨国家的指标可比性。构建过程中,数据整合面临多源异构数据统一格式的困难,需从ILOSTAT API提取原始数据后,对39个国家的时序数据进行标准化清洗与维度对齐,尤其是处理不同来源在相同国家年份下的优先级选择(如'最佳来源'规则)以及观测值状态标识(如暂定值、不可靠值)的准确性。此外,数据集仅提供年度频率,缺失部分指标的月度或季度序列,限制了劳动力市场短周期波动的细化分析能力。
常用场景
经典使用场景
该数据集的核心使用场景在于对欧洲各国劳动力利用不足状况进行跨时空的量化分析与比较。依托国际劳工组织ILOSTAT数据库的权威数据,研究者可借助该数据集探索2005至2027年间39个欧洲国家中时间相关就业不足与失业的综合比率(LU2)。通过整合性别与年龄维度的细分指标,该数据集为构建多层次的劳动力市场状态评估模型提供了坚实的数据基础,是开展区域劳动力弹性研究、国际比较以及面板数据分析不可或缺的基石。
实际应用
实际应用层面,该数据集的价值体现在政策制定与国际机构的决策支持之中。各国劳动部门及国际组织可基于该数据精准监测劳动力市场健康度,评估就业促进政策的实际成效。它能够助力识别劳动力利用不足的高发区域和脆弱群体,为定向帮扶与培训项目的规划提供数据锚点。此外,该数据集对时间序列的丰富覆盖亦支持预测分析,辅助政府及企业预判劳动力市场走势,从而制定更具前瞻性的就业战略与社会保障方案。
衍生相关工作
围绕该数据集的衍生工作已催生了一系列具有影响力的研究成果与实用工具。一方面,研究者基于该数据构建了大量关于欧洲劳动力市场分割、性别不平等及青年就业困境的量化分析模型,其成果发表在劳动经济学与国际比较研究的重要期刊上。另一方面,该数据集被整合进多个实证研究平台和教学案例中,成为检验多水平模型、面板数据回归及时序预测技术的标准素材,推动了数据驱动的社会科学方法的普及与创新。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务