遇见数据集

electricsheepasia/asia-ilo-how-temp-sex-age-ins-nb-mean-weekly-hours-actually-worked-per-employed-per

收藏
Hugging Face2026-05-27 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含33,562条观测数据,涵盖亚洲30个国家(1997年至2025年),涉及1个独特指标:按性别、年龄和公共/私营部门划分的就业人员实际平均每周工作小时数。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,这是一个关于劳动统计的全球权威来源。数据集提供了按国家、年份、性别(总计、男性、女性、其他)、年龄组和机构部门等维度细分的工作时间数据。数据以表格形式组织,包含国家代码、指标代码、观测值、数据来源、状态标志等列。数据集适用于表格分类、回归和时间序列预测等任务,主要用于劳动经济学、就业政策分析和区域研究。

This dataset contains 33,562 observations of Hours of work data across 30 Asia countries, spanning 1997–2025, covering 1 distinct indicator: Mean weekly hours actually worked per employed person by sex, age and public/private sector. The data is sourced from ILOSTAT, the ILOs central statistics database, which is a leading global source for labour statistics. It provides disaggregated data on working hours by country, year, sex (total, male, female, other), age groups, and institutional sectors. The dataset is structured in tabular format with columns for country codes, indicator codes, observed values, data sources, status flags, etc. It is suitable for tasks like tabular classification, regression, and time-series forecasting, and is intended for use in labour economics, employment policy analysis, and regional studies.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-how-temp-sex-age-ins-nb-mean-weekly-hours-actually-worked-per-employed-per 数据集图片
构建方式
本数据集源自国际劳工组织(ILO)的ILOSTAT中央统计数据库,通过调用其REST API接口,提取了关于‘按性别、年龄及公共/私营部门划分的受雇人员每周实际工作平均小时数’(指标代码HOW_TEMP_SEX_AGE_INS_NB)的观测数据,并依据ISO 3166-1 alpha-3标准筛选出30个亚洲国家的记录。数据经ILO依据国际劳工统计学家会议(ICLS)的定义进行统一协调处理,原始调查微观数据来源在source.label字段中加以标注,以确保可追溯性。最终整合为包含33,562条观测值的数据集,时间跨度覆盖1997年至2025年。
特点
该数据集呈现了亚洲地区劳动力市场中工作时长指标的宏观图景,其核心特点在于多维度的细分视角。数据不仅提供了总体平均值,还通过分类变量(classif1、classif2)实现了按性别(sex)、年龄组别及机构部门(公共/私营)的深度维度剖析,使得用户能够捕捉不同社会群体间的差异化模式。此外,数据集涵盖了菲律宾、伊朗等30个亚洲经济体,时间序列长达近三十年,为跨国比较与长期趋势分析奠定了坚实基础。每一观测值均附带来源编码和观测状态标记,便于质量评估。
使用方法
使用者可通过HuggingFace Datasets库便捷调用,仅需一行Python代码即可完成数据加载。加载后,可将数据转换为pandas DataFrame格式进行灵活操作。典型用法包括基于国家代码(如ref_area字段)进行单国过滤以聚焦局部特征,或者利用indicator字段筛选特定指标后按时间排序以构建时序分析。进一步,可通过透视表功能将数据重塑为国家×年份的矩阵形式,从而高效开展区域对比研究。数据集以cc-by-4.0许可发布,使用时需注明ILO原始出处及Electric Sheep Asia的二次包装。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)于2025年通过其ILOSTAT数据库发布,并经Electric Sheep Asia重新打包,聚焦于亚洲30个国家1997至2025年间按性别、年龄和公共/私营部门划分的就业人员平均每周实际工作小时数。作为全球劳动统计的权威来源,ILOSTAT整合了劳动力调查、家庭收入调查及行政记录等多元数据,为研究亚洲劳动市场的时空动态提供了高粒度观测窗口。数据集涵盖33,562条观测值,其结构化字段允许交叉分析劳动供给模式、性别差异及制度性因素,对理解亚洲发展中国家就业质量、工作时间政策及可持续发展目标(SDG)中的体面劳动议题具有重要支撑作用。
当前挑战
该数据集面临的首要挑战源于劳动统计的跨国可比性:亚洲各国在调查设计、指标定义(如‘实际工作小时’的时薪与加班界定差异)及数据收集周期上的不一致,可能导致跨区域推断的偏误。构建过程中,ILO需处理来自30国不同来源的微观数据,通过ICLS标准进行协调,但多个国家存在同一时间段内多源数据冲突,需依赖‘最佳来源’选择机制,这引入了主观判断。此外,数据集仅收录年度频率,忽略了季/月度波动,且部分观测值标记为不可靠(如obs_status字段中的‘U’标签),制约了对短期劳动市场冲击的精确建模。
常用场景
经典使用场景
该数据集汇聚了1997年至2025年间亚洲30个国家按性别、年龄及公共与私营部门划分的受雇人员实际周均工作小时数,共计33,562条观测记录。其最经典的使用场景在于构建跨国面板数据以分析亚洲劳动力市场的工时演变规律。研究者可依托其丰富的分类维度,开展性别差异、代际变迁以及部门属性对劳动供给影响的实证探讨。凭借标准化的年度统计框架,该数据集为对比不同经济发展阶段国家的劳动强度与就业质量提供了可靠基石,是劳动经济学领域中时空动态分析的宝贵资源。
解决学术问题
在学术研究中,该数据集有效解决了亚洲地区缺乏统一、可比的高频工时面板数据的困境。它使得学者能够系统性地探究经济发展、产业结构转型与政策干预对平均工作时间的因果效应。通过整合国际劳工组织的规范定义,数据集消除了跨国数据口径不一致所带来的测量偏差,为验证效率工资理论、劳动供给曲线的跨文化适用性以及性别就业差异的根源等经典假说提供了实证支撑。其意义在于推动了劳动经济学从单一国家案例向区域一体化比较研究的纵深发展。
衍生相关工作
此数据集衍生了诸多具有影响力的研究工作与衍生资源。基于ILOSTAT规范整理的这一亚洲子集,成为构建多国劳动市场预测模型的标准输入,催生了多篇关于亚洲经济周期与工作时间联动性的计量分析论文。Electric Sheep Asia团队将其格式标准化并与HuggingFace生态无缝衔接,推动了跨学科的可重复性研究浪潮。此外,结合其他社会经济变量的联合分析,衍生出关于非正规就业规模、性别收入鸿沟与老龄化对劳动供给影响等多个专题论文与数据扩展产品。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务