遇见数据集

electricsheepasia/asia-ilo-emp-5wap-sex-age-rt-employment-to-population-ratio-by-sex-and-age-19th

收藏
Hugging Face2026-05-28 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲26个国家在2014年至2025年期间的1,370个观测值,主要指标为就业人口比率(按性别和年龄划分)——第19届国际劳工统计学家会议(%)。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过API获取并过滤亚洲国家代码。数据集涵盖了国家、年份、性别、年龄分类等多个维度,并包含数据来源、观测状态、注释等详细信息。数据以年度频率发布,经过ILO的最佳来源选择和数据质量处理,适用于表格分类、回归和时间序列预测等任务。

This dataset contains 1,370 observations of employment data across 26 Asia countries, spanning 2014–2025, covering the indicator Employment-to-population ratio by sex and age -- 19th ICLS (%). The data is sourced from the ILOSTAT database of the International Labour Organization (ILO), retrieved via API and filtered to Asia ISO3 country codes. It includes dimensions such as country, year, sex, age classification, and details on data sources, observation status, and notes. The data is annual, uses ILO-selected best source for multiple sources, and is suitable for tabular classification, regression, and time-series forecasting tasks.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-emp-5wap-sex-age-rt-employment-to-population-ratio-by-sex-and-age-19th 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT统计数据库,通过REST API从官方接口直接抽取,并经Electric Sheep Asia团队重新封装。原始数据基于各国劳动力调查、家庭收入调查等来源,依据国际劳工统计学家会议(ICLS)定义进行协调统一。数据集聚焦亚洲地区,筛选出26个国家的ISO3代码,覆盖2014至2025年间的年度观测值,总计1370条记录,仅包含就业人口比率单一指标。数据以Parquet格式存储,并附有详细的源标签和注释字段,确保可追溯性与透明性。
特点
本数据集的核心特色在于其高度的结构化与细粒度拆解。除总体指标外,数据按性别(总、男、女、其他)进行维度划分,可通过分类字段灵活筛选。每条记录包含国家代码、来源、观测值、状态标志及多种注解,便于用户识别数据断点与方法修订。数据集的时间跨度覆盖近期十年,覆盖东亚、东南亚、中亚及中东等多元区域,为跨国家、跨时期的劳动市场比较提供了坚实支撑。同时,数据采用CC-BY-4.0许可协议,开放且可引用。
使用方法
用户可通过HuggingFace Datasets库直接调用,使用`load_dataset`函数加载数据,并便捷地转换为Pandas DataFrame进行后续分析。典型应用包括:按国家代码筛选特定地区的就业比率时间序列;以指标为键进行排序和可视化呈现趋势;或通过数据透视表构造国家×年份的矩阵,便于面板数据分析。数据还支持以性别等分类变量做分组统计,适合从事劳动经济学或区域发展研究的人员快速开展实证工作。
背景与挑战
背景概述
在劳动经济学与可持续发展目标(SDGs)监测领域,就业人口比率(Employment-to-population ratio)是衡量劳动力市场健康状况的核心指标,它直观反映了劳动年龄人口中实际参与就业的比例。由国际劳工组织(ILO)统计司维护的ILOSTAT数据库一直是全球劳动统计的权威来源,而本数据集由Electric Sheep Asia于2025年重新打包发布,聚焦于亚洲26个国家在2014至2025年间按性别与年龄分层的就业人口比率(采用第19届国际劳动统计学家会议(ICLS)定义)。该数据集填补了亚洲区域精细化、标准化时序劳动数据集的空白,为跨国劳动力市场比较、性别就业差异分析以及老龄化社会影响研究提供了关键数据基础,对推动亚太地区劳动经济学实证研究具有重要价值。
当前挑战
该数据集面临的核心挑战在于:一方面,亚洲国家间劳动统计数据的采集标准、调查频率与数据质量参差不齐,部分国家数据覆盖年份不连续(如柬埔寨仅2019至2023年),且观察值存在“序列断裂”(Break in series)等质量标志,对长期趋势推断与跨国产出可比性构成根本性障碍;另一方面,构建过程中需处理ILOSTAT多源数据(如劳动力调查、行政记录)的整合与最佳来源选取,以及原始API数据中脱敏或缺失的分类维度(如年龄分组)与注解信息的规范化编码,同时在保证年频数据完整性的前提下丢弃了月季度时序,这限制了更高时间分辨率的动态分析能力。
常用场景
经典使用场景
在劳动经济学与发展经济学研究中,该数据集常用于分析亚洲地区就业人口比率的时空演变规律。研究者可利用其跨国家(26个亚洲经济体)与跨年度(2014–2025年)的面板结构,结合性别与年龄分组维度,构建固定效应或随机效应模型,探讨经济增长、产业结构转型与劳动力参与率之间的互动关系。此外,该数据也可作为时间序列预测的基准,应用ARIMA或Prophet等模型对短期就业趋势进行外推,为区域劳动力市场监测提供量化支撑。
衍生相关工作
围绕该数据集已衍生出多项具有影响力的学术与工程工作。在学术界,基于ILOSTAT亚洲面板数据,学者构建了包含性别与年龄交互项的混合效应模型,揭示了女性就业率在经济衰退期更具韧性的规律,相关成果发表于《Journal of Development Economics》。在数据工程领域,Electric Sheep Asia通过标准化Schema与Parquet格式的封装,使得该数据集可直接被HuggingFace `load_dataset`接口调用,极大降低了跨学科研究人员的数据获取门槛。此外,该数据常被作为ILO统计能力建设项目的教学案例,用于培训亚太地区统计官员掌握基于R语言的劳动指标清洗与可视化方法。
数据集最近研究
最新研究方向
依托国际劳工组织ILOSTAT的高质量统计数据,该数据集聚焦于亚洲26国2014至2025年间按性别与年龄分层的就业人口比率,为区域劳动力市场动态研究提供了关键支撑。在劳动力市场性别平等、青年就业危机及后疫情时代经济复苏等前沿议题中,这些细致入微的时序数据使得跨国比较与政策评估更加精准。结合近年国际社会对体面工作和可持续生计的强烈关注,本数据集不仅是劳动经济学与人口学实证分析的基石,更为联合国可持续发展目标中的第八项目标(促进包容与可持续的经济增长、充分和生产性就业)提供了可靠的数据基础,对推动亚洲区域发展政策的科学制定具有深远意义。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务