遇见数据集

electricsheepasia/asia-ilo-how-temp-sex-ocu-ins-nb-mean-weekly-hours-actually-worked-per-employed-per

收藏
Hugging Face2026-05-27 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含来自国际劳工组织(ILO)ILOSTAT数据库的亚洲国家就业人员平均每周实际工作小时数数据。数据集覆盖30个亚洲国家,时间跨度为1997年至2025年,共有31,847个观测值。核心指标为“按性别、职业和公共/私营部门划分的就业人员平均每周实际工作小时数”(指标代码:HOW_TEMP_SEX_OCU_INS_NB)。数据以表格形式组织,包括国家代码、年份、观测值、性别分类、职业分类、机构部门分类等列,并提供了数据来源、质量标志和注释信息。数据集适用于表格分类、回归和时间序列预测等任务,可用于分析亚洲劳动力市场的工作时间趋势和差异。

This dataset contains data on mean weekly hours actually worked per employed person in Asian countries, sourced from the International Labour Organization (ILO) ILOSTAT database. It covers 30 Asian countries, spans from 1997 to 2025, and includes 31,847 observations. The core indicator is Mean weekly hours actually worked per employed person by sex, occupation and public/private sector (indicator code: HOW_TEMP_SEX_OCU_INS_NB). The data is organized in tabular format with columns such as country code, year, observed value, sex disaggregation, occupation classification, institutional sector classification, along with source information, quality flags, and notes. It is suitable for tasks like tabular classification, regression, and time-series forecasting, and can be used to analyze trends and disparities in working hours across Asian labor markets.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-how-temp-sex-ocu-ins-nb-mean-weekly-hours-actually-worked-per-employed-per 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT核心统计数据库,通过REST API直接提取指标「HOW_TEMP_SEX_OCU_INS_NB」的原始数据,并依据亚洲ISO3国家代码进行地理过滤。ILOSTAT基于国际劳工统计学家会议(ICLS)定义,对各国劳动力调查、家庭收入调查及行政记录等微观数据进行统一的标准化处理,从而保证跨国可比性。数据集由Electric Sheep Asia团队重新打包为Parquet格式,并发布在HuggingFace平台上,便于机器学习场景下的直接调用。
特点
数据集收录了1997年至2025年间30个亚洲国家共计31,847条观测记录,覆盖指标为「按性别、职业和公共/私营部门划分的就业人员实际每周平均工作小时数」。数据按年度频率呈现,并包含性别(总/男/女/其他)、职业技能等级及机构部门等多维细分维度,同时附有来源编码与观测状态标记,便于用户追溯数据质量与可靠性。各字段采用标准化命名与标识,支持按国家、年份、分类变量的灵活筛选与聚合。
使用方法
用户可通过HuggingFace Datasets库以一行代码加载数据:`load_dataset("electricsheepasia/asia-ilo-how-temp-sex-ocu-ins-nb-mean-weekly-hours-actually-worked-per-employed-per")`,所得对象可直接转为Pandas DataFrame进行后续分析。常见操作包括按国家代码过滤子集、按时间排序绘制时序曲线、以及利用透视表构建国家×年份的指标矩阵。数据集以cc-by-4.0许可发布,使用时需同时引用原始ILO数据来源及Electric Sheep Asia的重构版本。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)统计司于2025年构建,经Electric Sheep Asia整理并重新打包发布,聚焦于亚洲地区30个国家1997至2025年间按性别、职业及公共/私营部门划分的从业人员实际周平均工作小时数。共计31,847条观测记录,源于ILOSTAT数据库,该数据库是全球劳动统计领域最具权威性的核心数据来源,融合各国劳动力调查、家庭收支调查及行政记录,采用国际劳工统计学家会议(ICLS)标准进行数据协调。数据集的核心研究问题在于揭示亚洲劳动力市场中工作时间的结构性差异与长期演变趋势,为跨国比较、劳动政策制定及可持续发展目标(SDG)中的体面劳动指标评估提供了标准化、机器可读的基础数据支撑。
当前挑战
数据集所解决的领域问题在于,亚洲地区长期缺乏统一、可比的劳动时间统计,各国在调查方法、分类标准与数据频率上存在显著差异,阻碍了区域劳动经济学的深入分析与政策评估。其构建过程中面临的挑战包括:多源数据整合时需克服各国调查问卷设计、抽样框架及数据质量的不一致性;时间跨度涵盖近三十年,需处理因分类修订、指标定义变更带来的序列连贯性问题;此外,ILO虽已进行国际协调,但部分观测值仍带有不可靠标记,需在使用时对数据质量进行审慎甄别与清洗,以确保分析结论的稳健性。
常用场景
经典使用场景
在劳动经济学与公共政策研究领域,该数据集最经典的用途是对亚洲地区不同性别、职业类型及公共/私营部门就业者的实际周均工作时长进行跨时空的比较分析。其结构化的层级分类维度,使得研究者能够精准提取特定国家、年份或人口子群的劳动供给特征,从而构建起从微观个体异质性到宏观区域差异的多层次观测框架。无论是追踪某一国家内部工作时长的长期演变趋势,还是对比不同发展水平经济体之间的劳动强度差异,该数据集均提供了标准化的时序面板数据,为实证研究奠定了可靠基础。
实际应用
在实际应用层面,该数据集为国际组织、政府劳动部门与智库机构开展政策评估与劳动力市场监测提供了关键的数据支撑。政策制定者可依托其中按性别及职业细分的劳动时长数据,诊断特定群体面临的工作强度过高或就业不足问题,进而设计针对性的劳动保护法规或工时弹性化方案。此外,企业人力资源管理者与跨国经济顾问也能够利用该数据研判不同国家的用工成本与生产效率,辅助区域投资决策与供应链规划,使得数据从学术殿堂走向了产业实践的战场。
衍生相关工作
该数据集衍生出的相关工作广泛见于ILO年度劳动报告、亚洲开发银行的政策简报以及多篇发表于《劳动经济学》与《世界发展》等期刊的计量研究。许多学者以其为基础构建了包含性别交互项与职业固定效应的面板回归模型,以识别工作时长变迁背后的制度驱动因素。此外,该数据集也常被用于训练时序预测模型,对未来亚洲各国就业质量的演化路径进行模拟推演,并与企业调查、家庭追踪调查等其他微观数据源进行多源融合,极大拓展了亚洲劳动统计数据的科研应用边界。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务