遇见数据集

electricsheepasia/asia-ilo-emp-care-sex-eco-nb-care-employment-by-sex-and-economic-activity-thous

收藏
Hugging Face2026-05-28 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲34个国家从1996年至2025年期间有偿护理工作者就业情况的17,740个观测值,按性别和经济活动进行分类。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过其REST API获取并过滤为亚洲国家代码。数据集涵盖了1个核心指标:EMP_CARE_SEX_ECO_NB(按性别和经济活动分类的护理就业人数,以千为单位)。数据包括国家代码、国家名称、数据来源、指标代码、性别分类、经济活动分类、观察年份、观测值、观测状态标志等信息。数据集旨在为研究人员和开发者提供机器学习就绪的亚洲劳动力统计数据。

This dataset contains 17,740 observations of paid care workers data across 34 Asia countries, spanning 1996–2025, covering 1 distinct indicator: EMP_CARE_SEX_ECO_NB (Care employment by sex and economic activity in thousands). The data is sourced from the ILOSTAT database of the International Labour Organization (ILO), pulled directly from the ILOSTAT REST API and filtered to Asia ISO3 country codes. It includes information such as country codes, country names, data sources, indicator codes, sex disaggregation, economic activity classification, observation year, observed values, and observation status flags. The dataset is repackaged by Electric Sheep Asia to provide an ML-ready data layer for Asia on HuggingFace.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-emp-care-sex-eco-nb-care-employment-by-sex-and-economic-activity-thous 数据集图片
构建方式
该数据集由Electric Sheep Asia团队从国际劳工组织(ILO)的ILOSTAT REST API直接抽取,原始数据源自各国劳动力调查、家庭收入调查、机构调查及行政记录,经ILO统计部门依据国际劳工统计学家会议(ICLS)定义进行统一协调与清洗。数据筛选范围限定于34个亚洲国家的ISO3国家代码,时间跨度为1996年至2025年,共汇集17,740条观测记录,涵盖付费护理工作者这一核心指标,并保留source.label字段以追溯数据来源。
特点
数据集具有多维细粒度结构,包含性别(总、男、女、其他)和经济活动两个主要分解维度,支持多层次交叉分析。所有观测值均为年度频率,采用ILO选定的‘最佳来源’以避免同一国家同年份的多源冲突。数据模式包含18个字段,如ref_area、sex、time和obs_value等,并提供英文标签便于理解。数据质量标识(obs_status)标注了暂定或不可靠的观测值,附带的注释字段(如note_indicator)记录了序列断裂等元信息,增强了数据的可追溯性与使用透明度。
使用方法
用户可通过HuggingFace Datasets库的load_dataset函数直接加载数据,返回的DataFrame支持灵活的过滤与变换操作。例如,可通过ref_area字段筛选特定国家的时间序列,或利用pandas的pivot_table方法构建时间×国家的观测值矩阵,便于进行面板数据分析和跨国产出对比。数据集兼容分类、回归及时间序列预测三类任务,适用于劳动经济学、性别研究与护理经济领域的量化分析。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)于2025年通过其核心统计数据库ILOSTAT创建,后经Electric Sheep Asia团队重新整理并发布于HuggingFace平台,聚焦于亚洲地区有偿照护工作者按性别与经济活动的就业数据。核心研究问题在于揭示亚洲34个国家在1996至2025年间,照护经济中劳动力分布的性别差异与行业结构变迁,为分析照护工作的社会价值与劳动市场不平等提供量化依据。作为ILOSTAT全球劳动统计体系的重要子集,该数据集填补了亚洲区域在SDG体面工作目标监测中关于照护就业的空白,对性别经济学、劳动社会学及公共政策研究具有显著推动力,尤其为跨国比较与时间序列建模提供了标准化基础。
当前挑战
该数据集所解决的领域问题核心在于,照护劳动在传统统计中常被低估或边缘化,而本数据通过统一指标与细粒度分类(性别、经济活动部门),使研究者能够量化亚洲照护就业的规模与演变,从而挑战“照护非经济”的认知范式。构建过程中面临的挑战包括:多源数据(如劳动力调查、行政记录)的整合与标准化,需依据国际劳工统计学家会议(ICLS)定义进行严格对齐;数据质量受限于各国统计能力差异,部分国家存在观测值不可靠(如“U”标志)或序列断裂问题(如方法修订导致的指标注释);此外,亚洲区域内部的文化异质性与照护定义差异,迫使数据集在保留原始注释的同时,需通过“最佳来源”筛选与元数据标签(如source.label)实现追溯性透明,这些隐性的协调工作才真正构筑了其可靠性根基。
常用场景
经典使用场景
该数据集记录了1996年至2025年间亚洲34个国家按性别和经济活动划分的带薪护理从业人员数量,共计17,740条观测值。在劳动经济学与性别研究领域,研究者常利用这一面板数据进行跨国别、长时序的定量分析,以揭示护理行业劳动力市场的演化轨迹。典型地,可通过时间序列回归或固定效应模型,评估经济发展水平、政策干预或文化因素对男性与女性护理就业参与率的差异化影响。性别维度的精细划分(总、男、女、其他)使其成为探究护理劳动性别分工、性别工资差距及职业隔离现象的珍贵数据资产。
解决学术问题
长期以来,亚洲地区护理行业的系统性统计数据较为匮乏,尤其是跨国可比的高质量面板数据更为稀缺,制约了劳动经济学、人口社会学以及公共政策研究中对护理经济活动的深入剖析。该数据集有效填补了这一空白,使学者能够量化分析女性在护理行业中占据主导地位的劳动力结构变迁、护理需求与老龄化进程之间的关联,以及经济发展对护理岗位创造的驱动效应。其重要意义在于为‘照顾经济’这一学术前沿提供了可靠的实证基础,推动了有关性别平等、体面劳动及可持续就业目标的量化研究,进而为国际劳工组织倡导的包容性增长政策提供了数据支撑。
衍生相关工作
围绕该数据集已衍生出一系列具有代表性的研究工作。在方法论层面,研究者开发了跨源数据融合技术,将ILOSTAT数据与各国人口普查、家庭调查及社会福利统计进行匹配,构建了更为全面的亚洲护理劳动投入矩阵。在实证分析方面,有工作利用该面板数据结合双重差分法,评估了日本、韩国及东南亚各国长期护理保险制度引入对女性劳动参与率的因果效应。另有一些研究则聚焦于护理行业与数字平台经济的交汇,探讨在线家政、陪诊等新型护理服务模式对传统就业统计的挑战,从而催生了进一步细分护理职业分类的研究议程。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务