遇见数据集

electricsheepasia/asia-ilo-how-temp-sex-eco-nb-mean-weekly-hours-actually-worked-per-employed-per

收藏
Hugging Face2026-05-27 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含了来自国际劳工组织(ILO)核心统计数据库ILOSTAT的亚洲地区工作时间相关数据。具体指标为按性别和经济活动划分的就业人员平均每周实际工作时间(指标代码:HOW_TEMP_SEX_ECO_NB)。数据集涵盖40个亚洲国家,时间跨度为1979年至2025年,共包含44,006个观测值。数据内容涉及就业人员平均每周实际工作时间的统计,并按照性别(总计、男性、女性等)和经济活动(广义部门)等维度进行细分。数据集以表格形式呈现,包含国家代码、国家名称、数据来源、指标、性别分类、经济活动分类、观测年份、观测值、观测状态标志以及相关注释等多个字段。数据经过ILO的协调处理,使用国际劳工统计学家会议(ICLS)的定义,并标注了来源以便追溯。

This dataset contains Hours of work data from the ILOSTAT, the central statistics database of the International Labour Organization (ILO), focusing on Asia. The specific indicator is Mean weekly hours actually worked per employed person by sex and economic activity (indicator code: HOW_TEMP_SEX_ECO_NB). It covers 40 Asian countries, spanning the years 1979 to 2025, with a total of 44,006 observations. The data provides statistics on the average actual weekly hours worked per employed person, disaggregated by dimensions such as sex (total, male, female, etc.) and economic activity (broad sector). The dataset is presented in tabular format, including fields such as country code, country name, data source, indicator, sex classification, economic activity classification, observation year, observed value, observation status flags, and related notes. The data is harmonized by the ILO using International Conference of Labour Statisticians (ICLS) definitions, with sources flagged for traceability.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-how-temp-sex-eco-nb-mean-weekly-hours-actually-worked-per-employed-per 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)旗下的ILOSTAT中央统计数据库,旨在系统记录亚洲地区就业人群的每周实际工时状况。研究团队通过ILOSTAT提供的REST API接口,直接调用指标代码HOW_TEMP_SEX_ECO_NB所对应的数据流,并依据ISO 3166-1 alpha-3标准精准筛选出40个亚洲国家的观测记录。在数据采集过程中,ILO依据国际劳工统计学家会议(ICLS)的统一定义对各国原始调查微观数据进行协调与标准化处理,并在source.label字段中明确标注数据来源,如劳动力调查或行政记录,确保了跨国家、跨时段数据的可比性与可追溯性。最终,该数据集汇集了覆盖1979年至2025年间的44,006条观测值,并以Parquet格式进行高效封装发布。
特点
这一数据集的核心特点在于其精细的多维度分层结构与严谨的数据质量控制机制。其核心指标为“按性别和经济活动划分的就业人员实际每周平均工时”,数据不仅按性别细分为男性、女性、总计及其他人,还通过classif1等分类变量进一步刻画经济活动领域的差异,形成了丰富且可交叉分析的变量体系。数据覆盖亚洲40个国家,跨越近半个世纪的时间跨度,为研究区域劳动力市场结构演变提供了坚实的历史纵贯数据。此外,每个观测值均附带观察状态标志(如不可靠、临时性)及详细的元数据注释,便于用户在实际分析中识别并规避数据缺陷,充分体现了ILO在劳动统计领域专业的质量保障。
使用方法
使用者可通过Hugging Face Datasets库的load_dataset函数便捷加载该数据集,并将其转换为Pandas DataFrame以进行后续分析。推荐的应用方式包括:按国家代码(如ref_area列为IDN)筛选出特定国家的子集,从而开展国别层面的工时变化研究;亦可基于时间变量对单一指标进行排序并可视化,以观察亚洲各国工时在长期范围内的波动趋势。对于跨国家比较,用户可利用pivot_table函数将数据重塑为国家×年份的矩阵形式,便于应用面板数据分析或时间序列预测模型。数据集中包含的性別与经济分类字段,同时也支持研究者进行多维度的分组统计与差异性检验。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)统计司于2025年整理发布,经Electric Sheep Asia团队重新打包并托管于HuggingFace平台,旨在提供亚洲地区40个国家在1979年至2025年间按性别和经济活动划分的就业人员周平均实际工作时长数据。作为ILOSTAT旗舰数据库的子集,该数据集聚焦劳动时间这一核心指标,为劳动经济学、性别平等研究及区域劳动力市场分析提供了珍贵的时间序列资料。其影响力体现在能够支撑跨国比较研究、政策评估与机器学习建模,尤其为亚洲发展中经济体的劳动权益与生产效率研究奠定了数据基础。
当前挑战
所解决的领域问题在于,亚洲各国劳动时间数据长期存在记录口径不一、性别与经济细分维度缺失、公开来源零散等困境,阻碍了跨国劳动市场规律的挖掘与可持续政策制定。该数据集在构建过程中面临多重挑战:首先,需从ILOSTAT REST API中筛选并过滤出亚洲国家代码,确保地理覆盖的准确性;其次,需处理多来源数据的一致性问题,利用ILO选定的“最佳来源”消除同一国家年份的重复记录;此外,还需应对年度数据频率与月度、季度序列的粒度差异,以及因观测值不完整或来源标注变动导致的可靠性标记(如“U”类不可靠状态),最终实现跨时空数据的标准化整合。
常用场景
经典使用场景
在劳动经济学与区域发展研究的交汇处,该数据集为探究亚洲40国1979至2025年间劳动者周均实际工作小时数的时空演变提供了坚实的数据基础。研究者可利用其按性别(男性、女性、总计)及经济活动部门划分的精细粒度,构建面板数据模型,系统评估亚洲各国工作时间的长期趋势、周期波动以及性别差异的动态变化。该数据集的经典应用场景之一,是通过时间序列分析与因果推断,揭示经济发展、产业结构转型与劳动时间制度变迁之间的内在关联,从而为理解亚洲劳动力市场的独特演化路径提供实证支撑。
衍生相关工作
围绕该ILOSTAT系列数据集,学术界已衍生出一系列标志性的实证工作。其一,基于标准化的工时面板数据,发展出识别“劳动时间极化”现象的计量方法,揭示了高技能与低技能劳动者在工时间距上的扩大趋势。其二,研究者利用性别维度的拆分特征,构建了衡量“无酬劳动时间缺口”的分析框架,丰富了对性别经济不平等根源的讨论。其三,该数据集与宏观经济变量(如GDP、失业率)的融合催生了劳动时间与商业周期联动性的跨国比较研究。此外,数据本身的结构化、机器可读格式,还推动了自动化数据清洗与缺失值插补算法在劳动统计领域的创新应用。
数据集最近研究
最新研究方向
该数据集整合了亚洲40个国家1979至2025年间按性别和经济活动划分的周均实际工作小时数,为劳动经济学中的性别差异与产业结构研究提供了高分辨率的时间序列资源。当前研究前沿聚焦于后疫情时代亚洲劳动力市场的恢复模式、非正规就业与性别工时差距的演变,以及自动化与跨境供应链对工时结构的冲击。结合ILO的SDG体面劳动目标,此类数据可支撑区域间比较分析和面板回归建模,揭示经济发展阶段、文化因素与劳动法规对工作强度的异质性影响,为亚洲国家制定劳动政策与性别平等倡议提供实证锚点。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务