遇见数据集

electricsheepasia/asia-ilo-emp-care-sex-cbr-nb-care-employment-by-sex-and-place-of-birth-thousand

收藏
Hugging Face2026-05-28 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲地区18个国家从2000年至2024年关于有偿护理工作者就业情况的706个观测数据,以千人为单位,按性别和出生地进行分类。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过API获取并经过标准化处理,确保符合国际劳工统计会议(ICLS)定义。数据集涵盖1个核心指标(EMP_CARE_SEX_CBR_NB),并包含国家代码、国家名称、数据来源、指标代码、性别分类、年份、观测值等详细字段,适用于表格分类、回归和时间序列预测等任务。数据以年度频率发布,部分观测带有可靠性标志,适用于劳动力市场分析和经济研究。

This dataset contains 706 observations on paid care workers employment across 18 Asian countries from 2000 to 2024, measured in thousands and disaggregated by sex and place of birth. Sourced from the International Labour Organization (ILO) ILOSTAT database, the data is retrieved via API and harmonized using International Conference of Labour Statisticians (ICLS) definitions. It includes one core indicator (EMP_CARE_SEX_CBR_NB) with detailed fields such as country codes, country names, data sources, indicator codes, sex classifications, years, and observed values. The dataset is suitable for tabular classification, regression, and time-series forecasting tasks, with annual frequency and reliability flags for some observations, making it ideal for labor market analysis and economic research.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-emp-care-sex-cbr-nb-care-employment-by-sex-and-place-of-birth-thousand 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT统计数据库,通过REST API接口直接提取了指标代码为EMP_CARE_SEX_CBR_NB的原始数据,并依据亚洲国家ISO3代码进行地理范围筛选。ILOSTAT依据国际劳工统计学家会议(ICLS)定义对各国劳动力调查、家庭收支调查等微观数据进行标准化处理,数据来源均在source.label字段中标注以便追溯。Electric Sheep Asia团队将原始数据重新打包、统一模式并发布为Parquet格式,形成包含706条观测值、覆盖18个亚洲国家、时间跨度2000年至2024年的结构化数据集。
使用方法
用户可通过HuggingFace Datasets库的load_dataset()函数直接加载该数据集,将其转换为Pandas DataFrame后进行分析。例如,可按国家代码筛选特定国家数据,或按时间序列对特定指标进行可视化。数据集支持按时间、国家等维度进行透视矩阵转换,便于构建面板数据模型。用户也可利用sex等分类字段进行分组统计,比较不同性别或出生地群体的护理就业差异。数据集采用cc-by-4.0许可协议,使用时需引用原始ILO数据来源及Electric Sheep Asia的重新打包版本。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)于2024年发布,经Electric Sheep Asia重新打包,聚焦亚洲地区有偿照护工作者的就业状况。研究背景植根于全球劳动力市场中照护经济的日益重要性,尤其是在人口老龄化和性别平等议题的驱动下,精准衡量不同性别与出生地的照护就业规模成为政策制定与学术研究的关键。数据集覆盖18个亚洲国家、2000至2024年的706条观测值,通过ILOSTAT统一指标代码EMP_CARE_SEX_CBR_NB整合国家调查与行政记录,为区域比较、时间序列分析和性别化劳动分工研究提供了标准化基础数据,对推动亚洲照护劳动力统计与可持续发展目标(SDG)监测具有重要参考价值。
当前挑战
当前数据集面临多重挑战。首先,照护工作者定义与数据可及性构成核心领域难题:亚洲各国对“有偿照护”的统计口径不一致,且部分国家(如阿富汗、孟加拉国)数据点稀疏,仅含单一年份观测,削弱了跨时空可比性与趋势推断的稳健性。其次,构建过程中遭遇数据质量与溯源复杂性,ILOSTAT虽进行统一整合,但标注了“不可靠”(obs_status: U)或“方法论修订”(note_indicator.label)的样本,如土耳其与伊朗早期数据存在序列断裂,研究者需谨慎处理缺失值、异常值及多来源冲突(如“最佳来源”选择逻辑),增加了预处理与因果推理的难度。
常用场景
经典使用场景
该数据集聚焦于亚洲地区有酬照护工作者的就业状况,涵盖2000至2024年间18个国家的706条观测记录,按性别和出生地维度进行细致划分。最经典的使用场景是基于时间序列的回归分析与分类任务,研究者可借此追踪照护行业就业规模的长期演变趋势,或构建预测模型探讨其关键驱动因素。数据集的标准化结构使其天然适配于面板数据建模,便于开展跨国比较研究,揭示不同亚洲经济体在照护劳动力市场发展路径上的异同。
解决学术问题
该数据集有效回应了劳动经济学与性别研究中一个长期悬而未决的难题——如何系统量化亚洲背景下照护工作的性别化就业模式及其演化规律。凭借ILOSTAT权威来源与统一的国际劳工统计标准,它填补了该区域高质量、长跨度、细粒度面板数据的空白。学者得以突破零散案例研究的局限,深入剖析出生地与性别交织如何形塑照护就业的结构性不平等,为阐释全球化进程中照护劳动的跨国分工提供了可靠的数据基石。
实际应用
在实际应用层面,该数据集为国际组织与各国政策制定者提供了评估照护经济政策效果的量化工具。例如,可以监测不同国家在推行长期照护保险、育儿假或移民劳工政策前后,女性与海外出生劳动者在照护行业就业占比的变化。非政府组织亦可借助这些数据,精准识别照护劳动力市场中的脆弱群体,倡导更具包容性的社会保障方案,助力可持续发展目标中体面工作与性别平等议题的落地。
数据集最近研究
最新研究方向
该数据集聚焦于亚洲地区有偿照护工作者就业状况的性别与出生地交叉分析,为全球劳动力市场不平等研究提供了关键实证基础。当前前沿方向集中于利用时间序列模型与面板数据分析亚洲照护经济中女性移民工人的结构性边缘化问题,尤其结合国际劳工组织(ILO)最新发布的照护工作价值报告,探讨老龄化社会下文职照护岗位的性别薪酬差距与跨国流动趋势。该数据覆盖2000至2024年18个亚洲经济体,能够揭示非正规就业与社会保障缺位对女性照护工作者的累积性剥夺,其研究意义在于为联合国可持续发展目标中体面工作与性别平等指标的监测提供量化工具。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务