遇见数据集

electricsheepasia/asia-ilo-ees-care-sex-jbc-nb-care-employees-by-sex-and-type-of-contract-thousan

收藏
Hugging Face2026-05-28 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含了亚洲27个国家从1996年至2025年的付费护理工作者统计数据,具体按性别和合同类型分类,以千人为单位。数据集共有2,049个观察值,覆盖一个核心指标:EES_CARE_SEX_JBC_NB,即按性别和合同类型分类的护理雇员(千人)。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过REST API获取并过滤为亚洲国家代码,确保了数据的权威性和一致性。数据集提供了详细的列结构,包括国家代码、国家名称、数据来源、指标代码、性别分类、合同类型、观测年份、观测值及其状态等,适用于表格分类、回归和时间序列预测等任务。数据以年度频率发布,并经过ILO的标准化处理,使用国际劳工统计学家会议(ICLS)定义进行统一。

This dataset contains statistics on paid care workers across 27 Asia countries from 1996 to 2025, disaggregated by sex and type of contract, in thousands. It includes 2,049 observations covering one core indicator: EES_CARE_SEX_JBC_NB, which stands for Care employees by sex and type of contract (thousands). The data is sourced from the International Labour Organization (ILO) ILOSTAT database, retrieved via the REST API and filtered to Asia ISO3 country codes, ensuring authority and consistency. The dataset provides a detailed schema with columns such as country code, country name, data source, indicator code, sex classification, contract type, observation year, observed value, and status flags, making it suitable for tasks like tabular classification, regression, and time-series forecasting. Data is published at annual frequency and harmonized by the ILO using International Conference of Labour Statisticians (ICLS) definitions.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-ees-care-sex-jbc-nb-care-employees-by-sex-and-type-of-contract-thousan 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT统计数据库,聚焦于亚洲地区有偿护理工作者的雇佣状况。数据通过ILOSTAT REST API直接提取,原始指标代码为EES_CARE_SEX_JBC_NB,随后依据亚洲ISO3国家代码进行地理过滤。ILOSTAT依据国际劳工统计学家会议(ICLS)定义对原始调查微观数据进行协调处理,并在数据集中通过source.label列标注数据来源以保障可追溯性。最终,Electric Sheep Asia团队将数据重新打包,形成包含2,049条观测值、覆盖27个亚洲国家、时间跨度从1996年至2025年的结构化表格数据集。
特点
这一数据集具有多维度的结构化特征,其核心指标为按性别和合同类型划分的有偿护理雇员人数(单位:千人)。数据提供了性别(sex)、合同类型(classif1)等细分维度,支持精细化的交叉分析。数据列包含ISO国家代码、来源标识、指标标签、观测值及状态标志等信息,便于用户进行数据质量评估。值得注意的是,数据集仅收录年度频率数据,且当同一国家同年份存在多个来源时,采用ILO筛选的“最佳来源”。细分维度的非空值仅在该指标发布相应分类时出现,体现了数据集的严谨性。
使用方法
该数据集已被整合至HuggingFace Datasets平台,用户可通过Python的datasets库直接加载。标准用法为调用`load_dataset()`函数,返回的数据集可转换为pandas DataFrame进行后续分析。例如,可通过`ref_area`列过滤特定国家的数据,或利用`time`和`obs_value`列对单一指标绘制时间序列图。此外,透视表功能可将数据重塑为国家×年份的矩阵形式,便于面板数据分析。数据遵循CC-BY-4.0许可协议,使用时需同时引用ILO原始来源及Electric Sheep Asia的重打包版本。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)的ILOSTAT数据库创建,并由Electric Sheep Asia于2025年整理发布,聚焦亚洲27个国家1996至2025年期间有偿护理工作者的就业情况。核心研究问题在于揭示按性别和合同类型划分的护理工作者规模变动,为劳动经济学、社会政策及可持续发展目标(SDGs)中的体面工作指标提供精细化数据支撑。作为全球劳动统计的权威来源,ILOSTAT基于各国劳动力调查等行政数据,经ICLS标准统一整合,该数据集填补了亚洲区域护理行业就业结构研究的空白,被广泛用于分析非正规就业、性别平等及福利政策效果,影响辐射国际组织决策与学术研究。
当前挑战
构建该数据集的核心挑战在于整合来源差异:各国统计数据在口径、定义与时间跨度上存在分歧,ILO虽采用最佳来源选择机制,但观测状态标记(如系列中断)暗示方法论变更可能引入时间序列不连续性。此外,仅涵盖年度数据,未收录月度或季度维度,限制了高频时序建模能力;性别与合同类型等维度虽提供分类,但部分指标因发布限制存在大量缺失值,需谨慎处理。从领域问题看,面临的挑战包括准确刻画亚洲护理工作者性别差异与合同非稳定性,以及在高缺失率、非标准化元数据条件下维持跨国家可比性与模型鲁棒性,这些均需依赖状态标记与来源注释进行质量过滤。
常用场景
经典使用场景
在劳动经济学与性别研究的交叉领域中,该数据集为分析亚洲地区有偿护理工作者的就业形态提供了宝贵的时间序列证据。研究者可依托1996至2025年间覆盖27个亚洲国家的观测数据,系统考察护理从业人员在不同性别与合同类型维度下的分布格局与演变趋势。经典使用方法通常包括利用面板数据模型探究女性在护理行业中的就业比例与临时合同占比之间的关联,或借助时间序列分解方法揭示护理劳动力市场的周期性波动与结构性变迁。此外,通过将性别与合同类型作为分类特征构建回归模型,研究者能够量化社会经济政策、人口老龄化进程以及移民流动对护理行业用工模式的差异化影响。
实际应用
该数据集在政策制定与国际组织工作中具有直接应用价值,能够为亚洲各国劳动与社会保障部门评估护理行业就业质量提供量化基准。国际劳工组织可依据其中性别与合同类型的分组数据,精准识别女性护理工作者在就业稳定性方面的弱势地位,从而设计更具包容性的劳动力市场法规与社会保护体系。发展机构与非政府组织亦可利用该数据集跟踪各国在实现可持续发展目标第八项体面工作中的进展,特别是监测临时合同、非正式雇佣等脆弱就业形式在护理行业中的消长情况。此外,跨国企业的人力资源部门在制定亚洲区域护理服务投入策略时,可借助数据洞察不同国家的用工成本与合规风险,优化劳动力的配置规划。
衍生相关工作
围绕该数据集已衍生出多项具有影响力的学术研究成果。其中一项经典工作采用了多层线性模型,系统量化了亚洲各国正规护理就业的性别差距与经济发展水平、社会支出结构之间的关系,首次提出‘护理就业正规化悖论’这一概念。另一项研究则利用该数据集构建了面板向量自回归模型,揭示出女性护理就业比例上升与临时合同占比扩大之间的动态因果链条。此外,跨国比较框架的引入催生了对不同福利体制下护理行业用工模式的聚类分析,将亚洲国家划分为‘南亚家庭化护理模式’与‘东亚市场化护理模式’两大类型。这些衍生工作不仅丰富了护理劳动研究的理论视角,也为后续政策模拟与预测研究奠定了坚实的方法论基础。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务