遇见数据集

electricsheepasia/asia-ilo-une-deap-sex-geo-mts-rt-unemployment-rate-by-sex-rural-urban-area-and-mari

收藏
Hugging Face2026-05-26 更新2026-05-31 收录
官方服务:

资源简介:

这是一个关于亚洲国家按性别、城乡地区和婚姻状况划分的失业率(百分比)的表格数据集,包含1970年至2025年的年度观测数据,涵盖30个亚洲国家,数据来源于国际劳工组织(ILO)的ILOSTAT数据库,并由Electric Sheep Asia重新打包。数据集包含21,545个观测值,涵盖1个独特指标(UNE_DEAP_SEX_GEO_MTS_RT),数据列包括国家代码、国家名称、数据来源、指标代码、性别分类、城乡分类、婚姻状况分类、观测年份、观测值、观测状态等。数据适用于表格分类、回归和时间序列预测等任务。

This dataset contains tabular data on the unemployment rate by sex, rural/urban area, and marital status (percentage) for Asian countries, with annual observations spanning from 1970 to 2025, covering 30 Asian countries. The data is sourced from the International Labour Organization (ILO) ILOSTAT database and repackaged by Electric Sheep Asia. It includes 21,545 observations and 1 distinct indicator (UNE_DEAP_SEX_GEO_MTS_RT), with columns such as country code, country name, data source, indicator code, sex classification, urban/rural classification, marital status classification, observation year, observed value, and observation status. The dataset is suitable for tasks like tabular classification, regression, and time-series forecasting.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-une-deap-sex-geo-mts-rt-unemployment-rate-by-sex-rural-urban-area-and-mari 数据集图片
构建方式
数据集源自国际劳工组织(ILO)的ILOSTAT统计数据库,该数据库作为全球劳动统计的权威来源,汇集了各国劳动力调查、家庭收入调查及行政记录等多渠道数据。构建过程通过ILOSTAT的REST API接口直接提取指标UNE_DEAP_SEX_GEO_MTS_RT的原始记录,并依据ISO3国家代码筛选出亚洲地区30个国家的观测值,最终形成涵盖1970至2025年、共计21,545条记录的标准化表格数据集。ILOSTAT采用国际劳工统计学家会议(ICLS)的定义对原始调查微观数据进行统一协调,确保了跨国家、跨时间的可比性。
特点
该数据集聚焦于亚洲地区失业率的精细化刻画,其核心特征在于多维度分解能力:按性别(男、女、总计及其他)、城乡区域和婚姻状况三个维度交叉分类,提供了失业率指标的细致切片。数据集覆盖30个亚洲国家,时间跨度逾半个世纪,年度频率数据包含观测状态标志和系列断裂注释,便于识别数据可靠性。数据以表格形式组织,包含国家代码、指标编码、分类变量及观测值等字段,规模介于一万至十万行之间,适用于表格分类、回归及时间序列预测等多种机器学习任务。
使用方法
研究者可通过Hugging Face的datasets库便捷加载该数据集,使用load_dataset函数获取训练集并转换为Pandas数据框进行分析。典型操作包括按国家代码(如IDN)筛选子集以聚焦特定区域,或针对单一指标按时间排序绘制趋势图,亦可利用透视表功能将数据重构为国家与年份的矩阵形式,从而支持跨国比较或时序建模。数据字段中的分类变量和注释信息有助于在建模时考虑数据质量与系列一致性,适合开展劳动经济学、社会政策评估及相关预测研究。
背景与挑战
背景概述
失业率作为劳动力市场运行的核心表征指标,长期受到劳动经济学与政策研究领域的密切关注。国际劳工组织(ILO)自1919年成立以来,始终致力于全球劳工统计标准的制定与数据协调,其ILOSTAT数据库涵盖200余个经济体的多维度劳动指标。本数据集由Electric Sheep Asia于2025年基于ILOSTAT REST API重新封装发布,覆盖亚洲30个国家、1970至2025年间共计21,545条观测记录,以性别、城乡区域及婚姻状况为分类维度刻画失业率分布。该数据集延续了ILO依托国际劳工统计学家会议(ICLS)定义进行微观数据协调的传统,为探究亚洲劳动力市场结构性差异提供了长时序、细粒度的可信数据支撑,对区域就业政策评估与可持续发展目标监测具有重要参考价值。
当前挑战
该数据集所应对的核心领域问题在于失业率的多维异质性测度,即如何将性别、城乡与婚姻状况等社会人口属性纳入统一框架加以系统刻画,从而揭示不同群体在劳动力市场中的脆弱性差异。构建层面的挑战尤为突出:亚洲各国劳动力调查体系成熟度参差不齐,统计口径与抽样设计存在显著国别差异,ILO虽以ICLS标准进行协调,但数据可比性仍受制于原始调查质量的波动;部分国家时间序列存在中断,方法学修订导致观测值前后不可直接衔接;城乡与婚姻状况分类变量的非全覆盖特性使得稀疏单元估计稳定性不足,加之部分观测被标注为暂定或不可靠,对后续建模与推断提出了稳健性要求。
常用场景
经典使用场景
在国际劳动统计与区域发展研究领域,该数据集最为经典的运用场景在于依托其涵盖30个亚洲国家、1970至2025年逾两万条观测值的面板结构,刻画失业率在性别、城乡地域及婚姻状况等多重维度上的长期演变轨迹。研究者通常借助其时间序列属性开展趋势拟合与周期分解,或通过跨国横截面比较揭示亚洲劳动力市场在性别差距、城乡二元结构以及婚姻状态关联性上的异质性模式。
衍生相关工作
围绕该数据集,已衍生出一系列与ILOSTAT体系相关的经典工作:基于其多维度失业率数据开展的性别就业差距分解研究、城乡劳动力市场分割的计量检验,以及亚洲国家失业率收敛性的空间计量分析。此外,Electric Sheep Asia对其进行的Parquet重封装与标准化数据集卡片发布,亦推动了机器学习可复现研究在劳动统计领域的应用拓展。
数据集最近研究
最新研究方向
在全球劳动力市场结构性转型与后疫情复苏不均衡的背景下,该数据集所承载的性别、城乡及婚姻状况多维失业率信息,正成为劳动经济学与性别研究交叉领域的前沿切入点。近期研究愈发关注婚姻状况作为调节变量如何与性别和城乡区位交互,塑造差异化的失业风险暴露,尤其聚焦于亚洲发展中国家女性在城乡迁移与家庭角色变迁中的就业脆弱性。该数据集跨1970至2025年的长时序覆盖,为检验经济周期、结构性改革与突发事件对细分群体失业率的异质性冲击提供了难得的观测窗口,亦为评估ILO体面劳动议程在亚洲的落地成效、推动兼顾性别与空间正义的就业政策设计奠定了实证基础。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务