遇见数据集

electricsheepasia/asia-ilo-une-5une-sex-age-nb-unemployment-by-sex-and-age-19th-icls-thousands

收藏
Hugging Face2026-05-28 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲26个国家的失业统计数据,时间跨度为2014年至2025年,共有1,719个观测值。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,使用第19届国际劳工统计学家会议(ICLS)的定义进行标准化。核心指标为UNE_5UNE_SEX_AGE_NB,表示按性别和年龄划分的失业人数(以千为单位)。数据集包含详细的列结构,如国家代码、指标、性别(总计、男性、女性)、年龄分类、观测年份、观测值及其状态标志。数据以年度频率提供,适用于表格分类、回归和时间序列预测等任务。数据集由Electric Sheep Asia重新打包,旨在为亚洲提供机器学习就绪的数据层。

This dataset contains unemployment statistics for 26 countries across Asia, covering the period from 2014 to 2025, with a total of 1,719 observations. The data is sourced from the ILOSTAT database of the International Labour Organization (ILO), and was standardized using the definitions from the 19th International Conference of Labour Statisticians (ICLS). The core indicator is UNE_5UNE_SEX_AGE_NB, which represents the number of unemployed people (in thousands) disaggregated by gender and age. The dataset features a detailed column structure, including country code, indicator, gender (total, male, female), age group, observation year, observed value, and its status flag. The data is provided at an annual frequency, and is suitable for tasks such as tabular classification, regression, and time series forecasting. This dataset was repackaged by Electric Sheep Asia, with the aim of providing a machine learning-ready data layer for Asia.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-une-5une-sex-age-nb-unemployment-by-sex-and-age-19th-icls-thousands 数据集图片
构建方式
本数据集从ILOSTAT官方REST API直接获取原始失业指标数据(代码UNE_5UNE_SEX_AGE_NB),并依据ISO 3166-1 alpha-3标准对亚洲地区26个国家的数据进行地理过滤和提取。ILOSTAT基于第19届国际劳动统计学家会议(ICLS)定义对各国劳动力调查微观数据进行严谨的标准化与整合,每条观测值均通过'source.label'列标注其数据来源详情,确保全流程可追溯。数据经过Electric Sheep Asia团队的规范重包装处理,最终形成包含1,719条观测、涵盖2014至2025年时间跨度的结构化表格数据集。
特点
该数据集聚焦亚洲地区失业统计,具备多维度的精细化分解特征,关键分解维度包括性别(总、男、女)和年龄段(青年与成年人)以及按15岁以上人口的标准分类。数据提供'obs_status'与各类备注字段(如'note_indicator.label'),用于标识序列断裂、方法修订等质量标注,方便研究者评估数据可靠性与连续性。所有字段均以清晰字符串或数值类型呈现,且集合仅包含ILO选取的最优来源数据,排除了多源冲突,确保数据质量与使用便利性。
使用方法
借助HuggingFace的datasets库,用户可通过一行代码load_dataset('electricsheepasia/asia-ilo-une-5une-sex-age-nb-unemployment-by-sex-and-age-19th-icls-thousands')将数据集加载为Pandas DataFrame,开始交互式分析。典型使用场景包括:依据'ref_area'列过滤至单一国家进行时间序列分析,利用'sex'维度探究性别差异,或使用pivot_table构建国家×年份的表格化面板数据。对于时序建模与回归任务,数据天然以年为频次排列,可直接应用于预测模型训练与评估。
背景与挑战
背景概述
在全球劳动统计领域,国际劳工组织(ILO)的ILOSTAT数据库是衡量劳动力市场动态的权威基石。该数据集由Electric Sheep Asia于2025年重新封装发布,聚焦亚洲26个国家在2014至2025年间按性别与年龄划分的失业情况,包含1719条观测记录,源自ILO第19届国际劳动统计学家会议(ICLS)定义的标准化指标。其核心研究问题在于揭示亚洲区域劳动力市场的结构性特征与演变趋势,为政策制定者、经济学家及社会学者提供细粒度数据支持。凭借ILOSTAT在全球劳动统计中的引领地位,该数据集通过整合各国劳动力调查与行政记录,显著增强了对亚洲失业模式的理解,推动了比较劳动经济学与可持续发展目标(SDG)监测的实证研究。
当前挑战
该数据集面临的核心挑战包括:首先,解决领域问题方面,失业率统计常因各国定义差异与调查方法不一致而难以直接比较,ILO通过ICLS定义进行协调,但亚洲国家间劳动力市场正规化程度悬殊,使得跨区域分析面临概念与度量偏误。其次,构建过程中,数据整合需处理多来源调查的异质性,例如不同国家采用的抽样框架、数据收集频率及统计编码各异,导致来源列可能与最佳来源选择冲突。此外,数据集中部分观测被标记为“序列中断”或“方法论修订”,反映出历史数据可比性的脆弱,需谨慎处理因政策变更或技术调整引起的结构性断点,以保障时间序列分析的稳健性。
常用场景
经典使用场景
该数据集收录了2014年至2025年间亚洲26个国家的失业率观测数据,细分为性别与年龄层次,共计1719条记录。作为ILOSTAT官方统计资料的重构版本,它特别适用于劳动经济学中的时间序列分析与面板数据建模,能够让研究者追踪亚洲各国在不同时间段内失业率的动态演化轨迹,是进行跨国比较研究和劳动力市场结构剖析的珍贵素材。
衍生相关工作
依托于ILOSTAT这一权威来源,该数据集催生了一系列关于亚洲劳动力市场的比较与预测研究,衍生出针对特定性别或青年群体的失业率建模工作。基于该数据的时间序列特性,研究者开发了多种宏观经济预测模型,并整合至R和Python等环境下的分析管道中。这些工作不仅拓展了劳动经济学的方法论工具箱,也为后续开展因果推断和政策模拟研究奠定了基础。
数据集最近研究
最新研究方向
该数据集聚焦于亚洲地区失业率按性别与年龄分层的精细刻画,基于国际劳工组织第19届ICLS标准,涵盖2014至2025年间26个亚洲经济体的时序观测。在劳动经济学与可持续发展目标(SDG)研究前沿,该数据为解析后疫情时代亚洲劳动力市场的结构性变迁、性别就业差距的演化轨迹以及青年失业率的区域异质性提供了权威的量化支撑。其与ILOSTAT官方体系的衔接,使得研究者能够串联全球与区域劳动力流动,深度挖掘非正规就业、技术替代效应及社会保护缺口等热点议题,为政策模拟与比较制度分析奠定了坚实的实证基础。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务