electricsheepeurope/europe-ilo-emp-care-sex-car-nb-employment-by-sex-and-care-worker-type-thousands
收藏数据链接:
官方服务:
资源简介:
该数据集包含欧洲15个国家按性别和护理工作者类型划分的就业数据(以千计),覆盖1996年至2025年,共有4,248个观测值,基于国际劳工组织(ILO)的ILOSTAT数据库,指标为EMP_CARE_SEX_CAR_NB,数据经过协调处理并包含来源和质量标记。
Employment by sex and care worker type (thousands) | Europe (ILOSTAT)
提供机构:
electricsheepeurope搜集汇总
数据集介绍

构建方式
本数据集基于国际劳工组织(ILO)旗下核心劳动统计数据库ILOSTAT的官方REST API构建,通过调用指标代码为EMP_CARE_SEX_CAR_NB的数据接口,获取欧洲15个国家1996年至2025年间按性别与护理工作者类型划分的就业信息。原始数据来自各国劳动力调查、家庭收入调查及行政记录等多元来源,并经ILO统计部门依据国际劳工统计学家会议(ICLS)定义进行统一归并与标准化。Electric Sheep Europe团队对欧洲国家ISO3代码进行过滤筛选,最终整合为包含4248条观测值的结构化表格数据,确保数据来源可追溯且具备跨国的可比性。
特点
该数据集汇聚了欧洲15个国家的付费护理工作者就业统计,覆盖近三十年时间跨度,共包含4248个观测点。其核心特色在于提供性别(男性、女性、总计)与护理工作者类型(如总计分类)的双重维度拆解,使得研究者能够深入剖析护理行业就业结构中的性别差异。数据字段设计详尽,除核心的观测值与时间戳外,还标注了数据来源、观测状态(如临时数据、不可靠数据)以及系列中断等说明性注释,为数据质量评估与后续修正提供了透明依据。数据集采用Parquet格式存储,兼具高效压缩与快速查询的优势,适合大规模时序分析与面板数据建模。
使用方法
使用者可通过HuggingFace Datasets库以一行代码加载该数据集: load_dataset('electricsheepeurope/europe-ilo-emp-care-sex-car-nb-employment-by-sex-and-care-worker-type-thousands') ,随即转换为Pandas DataFrame进行灵活操作。典型应用包括:按国家过滤以分析单一经济体的就业趋势;按指标排序并绘制时间序列图,揭示护理行业就业规模的演变路径;或利用透视表构建国家×年份的矩阵,便于面板数据回归或聚类分析。数据集支持分类与回归任务,亦可用于时间序列预测场景,为欧洲劳动经济学与社会政策研究提供了即开即用的高质量数据基础。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)的统计数据库ILOSTAT构建,并由Electric Sheep Europe于2025年重新打包发布,专注于欧洲15个国家1996年至2025年间按性别和护理工作者类型划分的就业数据。作为全球劳动力统计的权威来源,ILOSTAT整合了来自劳动力调查、行政记录等多源数据,旨在填补欧洲地区照护经济领域长期存在的数据空白。此数据集对劳动经济学、性别研究及社会政策分析具有重要价值,为探究照护行业就业结构、性别不平等现象及跨时间趋势提供了标准化、可重复用的基础数据,推动了相关领域从定性描述向定量分析的转变。
当前挑战
该数据集所解决的领域问题核心在于量化欧洲照护经济中的就业格局,特别是揭示性别分工的隐性不平等和不同国家间照护劳动力配置的差异性。构建过程中面临多重挑战:首先,需协调15个国家近30年间来源多样、定义不一的调查数据,确保不同年代与国家间职业分类和统计口径的一致性。其次,数据稀疏性问题突出,部分国家年份覆盖不完整、观测值不稳定,且多个国家存在方法论修订导致的序列断裂,需通过注释字段进行标记。此外,如何准确处理不同数据源的优先选择问题,以及妥善标记“不可靠”观测状态,以保证时间序列分析的稳健性,也是构建过程中的关键难题。
常用场景
经典使用场景
在欧洲劳动力市场与照护经济的研究脉络中,该数据集以国际劳工组织ILOSTAT的权威统计为基石,涵盖了1996年至2025年间15个欧洲国家的有偿照护工作者就业数据,并按性别和照护工作者类型进行精细划分。其经典使用场景聚焦于时间序列分析与面板数据回归,研究者可通过性别维度(男性、女性、总计)与照护工作者类别(如总照护、特定细分类型)的交叉视角,追踪欧洲各国照护行业就业规模的长期演变轨迹,或构建国家间的比较模型,揭示照护劳动力市场的结构性变迁与性别分布特征。
解决学术问题
该数据集精准回应了西方福利国家研究中的核心问题——照护劳动的市场化与性别化。它解决了长期困扰学界的照护工作者就业数据跨国可比性不足的难题,提供了经ILO标准化处理的15国统一口径数据。通过揭示有偿照护就业在性别与时间维度上的分布差异,研究者得以检验‘照护危机’假说、评估性别平等政策效果、分析老龄化社会对照护劳动力的需求弹性,其意义在于为劳动经济学、性别社会学与公共政策领域提供了实证基础,推动了从描述性统计向因果推断的学术纵深。
衍生相关工作
基于该数据的衍生工作已催生了一系列前沿探索。在方法论层面,研究者开发了结合性别断层的非平稳面板协整模型,以照护就业时序数据预测欧洲福利制度的韧性;在实证层面,经典工作包括利用该数据集构建的照护工作者性别工资差距分解模型,以及将欧洲照护就业与北美数据对齐进行跨大西洋照护体制比较的文献。此外,该数据还与ILO的其他指标(如工时、非正规就业)联动,衍生出照护工作的就业质量综合指数,成为衡量体面劳动进展的标准化工具。
以上内容由遇见数据集搜集并总结生成



