遇见数据集

electricsheepasia/asia-ilo-emp-3emp-sex-age-ste-nb-youth-employment-by-sex-age-and-status-in-employme

收藏
Hugging Face2026-05-27 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲38个国家从1970年至2025年的青年就业数据,共有45,375个观测值,涵盖一个具体指标:按性别、年龄和就业状态划分的青年就业人数(以千计)。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过API获取并过滤为亚洲国家代码。数据集包括多个维度,如国家代码、数据来源、性别分类、年龄分组、就业状态、观测年份、观测值及数据质量标志等,适用于表格分类、回归和时间序列预测等任务。数据以年度频率发布,并经过ILO的标准化处理,确保与ICLS定义一致。

This dataset contains 45,375 observations of youth employment data across 38 Asia countries, spanning from 1970 to 2025, covering one distinct indicator: Youth employment by sex, age and status in employment (thousands). The data is sourced from the ILOSTAT database of the International Labour Organization (ILO), retrieved via API and filtered to Asia ISO3 country codes. It includes dimensions such as country codes, data sources, sex disaggregation, age groups, employment status, observation years, observed values, and data quality flags, suitable for tasks like tabular classification, regression, and time-series forecasting. The data is published at annual frequency and harmonized by ILO using ICLS definitions for consistency.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-emp-3emp-sex-age-ste-nb-youth-employment-by-sex-age-and-status-in-employme 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的核心统计数据库ILOSTAT,聚焦于亚洲地区青年就业状况。研究团队通过ILOSTAT的REST API接口,直接抽取指标代码为EMP_3EMP_SEX_AGE_STE_NB的数据,并依据ISO 3166-1 alpha-3国家代码筛选出亚洲38个经济体的观测记录。原始数据经ILO统计部门依据国际劳动统计学家会议(ICLS)定义进行统一协调处理,涵盖自1970年至2025年的年度观测值,共计45,375条记录,每条数据均附带来源标签以保证可追溯性。
特点
该数据集具备多维度的精细分类特征,涵盖性别(总、男、女、其他)、年龄分层(15-29岁青年群体)以及就业身份(如雇员、自营就业等)三大核心维度。数据来源多样,包括劳动力调查、家庭收支调查及行政记录等,并由ILO筛选出针对同一国家与年份的最佳来源数据。此外,数据集附带了观测状态标志(如临时、不可靠)以及多个注释字段,用于标记方法变更或分组非标准等情况,为数据质量评估提供了透明依据。
使用方法
用户可通过HuggingFace Datasets库便捷地加载该数据集,使用`load_dataset()`函数即可获取完整数据框并转换为Pandas格式进行分析。可针对特定国家如印度尼西亚,通过`ref_area`字段进行筛选;也可对特定指标按时间排序后绘制时间序列图,直观展示青年就业趋势。此外,还可通过数据透视表将数据整理为国家×年份的矩阵结构,便于进行跨国家、跨时段的比较研究。数据以CC-BY-4.0许可发布,使用时需注明原始来源及数据整理方Electric Sheep Asia。
背景与挑战
背景概述
青年就业是衡量区域劳动力市场健康程度与社会可持续发展的重要指标,尤其在人口结构年轻化的亚洲地区,其就业质量与结构变迁对经济增长与社会稳定具有深远影响。由国际劳工组织(ILO)旗下ILOSTAT数据库发布、Electric Sheep Asia于2025年重新打包的“亚洲青年就业按性别、年龄与就业身份统计”数据集,聚焦于1970年至2025年间38个亚洲国家的青年就业状况。该数据集依托ILO统计部门对各国劳动力调查数据的标准化处理,覆盖性别、年龄区间与就业身份等多维细分维度,共计45,375条观测记录,为研究亚洲青年劳动力市场演化、性别差异及就业形态多元化提供了权威且可复现的数据基础。其发布填补了区域级青年就业高质量时序数据的空白,对劳动经济学、发展社会学与公共政策研究领域产生了显著的推动力。
当前挑战
该数据集所应对的领域挑战在于:亚洲各国青年就业面临地域发展不均、性别歧视固化与非正规就业比例高等结构性问题,且传统统计数据常因口径不一、时间跨度短而难以支撑跨国比较与长期趋势分析。在构建过程中,ILO面临的核心挑战包括:整合来自38国不同调查体系(如劳动力调查、行政记录)的原始微观数据,需统一遵循国际劳工统计学家会议(ICLS)定义以消除概念歧义;处理因方法论修订、数据来源变更或国家报告滞后所致的时序断裂与观测值不可靠标记(如'U'类标记);同时在性别、年龄与就业身份等多维分类下维持数据一致性,确保研究人员可基于'最佳来源'筛选逻辑获得可靠分析基础。
常用场景
经典使用场景
该数据集汇聚了亚洲38个国家自1970年至2025年间青年就业的精细化统计信息,涵盖性别、年龄段及就业身份等多重维度,共计45,375条观测记录。其最经典的使用场景在于开展跨国面板数据分析,研究者可借此构建时间序列模型,深入剖析亚洲各国青年劳动力市场的动态演化轨迹。通过对比不同性别与就业身份下的就业率趋势,该数据为劳动经济学中关于青年就业结构变迁的实证研究提供了坚实的数据基底。
实际应用
在实际应用层面,该数据集为国际组织、政府部门及社会智库提供了评估青年就业政策效能的量化工具。政策制定者可利用其中的分性别与分年龄结构数据,精准识别特定国家或地区内青年就业最脆弱的亚群体,从而设计具有针对性的职业技能培训计划与就业促进方案。此外,数据集还可用于构建早期预警模型,辅助监测因经济波动或社会转型引发的青年失业风险,助力实现联合国可持续发展目标中关于体面工作的具体指标。
衍生相关工作
基于该数据集,研究者已催生出一系列衍生性学术工作。一方面,学者们将其与宏观经济变量数据库融合,构建了预测亚洲青年就业弹性与结构性缺口的多因子计量模型。另一方面,部分工作聚焦于对ILO分类标准进行本地化修正,开发出适用于南亚、东南亚等次区域的社会核算矩阵,进而模拟不同产业结构调整对青年就业吸纳能力的影响。这些探索不仅丰富了发展经济学的实证工具箱,也为后续开展跨数据库的元分析提供了规范化的数据参照框架。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务