遇见数据集

electricsheepasia/asia-ilo-une-tune-sex-dur-mts-nb-unemployment-by-sex-duration-and-marital-status-th

收藏
Hugging Face2026-05-26 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲29个国家从1996年至2025年的失业统计数据,具体指标为按性别、持续时间和婚姻状况划分的失业人数(千人),共有11,816个观测值。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,该数据库是劳动统计的全球权威来源,通过标准化处理来自各国劳动力调查、家庭收入调查、机构调查和行政记录的数据。数据集涵盖了性别(总计、男性、女性)、失业持续时间和婚姻状况等分类维度,并提供国家代码、年份、观测值、数据来源、指标代码及标签、分类变量、观测状态和相关注释等详细字段。数据以年度频率发布,并经过ILO的最佳来源选择和处理,确保一致性和可追溯性。该数据集由Electric Sheep Asia重新打包,旨在为亚洲地区提供机器学习就绪的数据层,方便研究人员和开发者快速加载和使用。

This dataset contains unemployment statistics for 29 Asian countries from 1996 to 2025, specifically the indicator Unemployment by sex, duration and marital status (thousands), with a total of 11,816 observations. The data is sourced from the ILOSTAT database of the International Labour Organization (ILO), the leading global authority on labour statistics, which harmonizes raw data from national labour force surveys, household income surveys, establishment surveys, and administrative records. The dataset includes disaggregation dimensions such as sex (total, male, female), duration of unemployment, and marital status, and provides detailed fields including country codes, years, observed values, data sources, indicator codes and labels, classification variables, observation statuses, and relevant notes. The data is published at an annual frequency and is processed using ILOs best source selection to ensure consistency and traceability. Repackaged by Electric Sheep Asia, this dataset aims to provide a machine learning-ready data layer for Asia, enabling researchers and developers to quickly load and utilize the data.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-une-tune-sex-dur-mts-nb-unemployment-by-sex-duration-and-marital-status-th 数据集图片
构建方式
该数据集源自国际劳工组织ILOSTAT统计数据库,通过其REST API接口直接提取指标代码为UNE_TUNE_SEX_DUR_MTS_NB的原始记录,并依据ISO3国家代码筛选出亚洲地区的数据子集。ILOSTAT依据国际劳工统计学家会议定义对各国劳动力调查等微观数据进行标准化调和,数据集由Electric Sheep Asia重新打包为Parquet格式,完整保留来源标签与注释字段以供溯源,最终形成涵盖二十八个亚洲国家、时间跨度为一九九六年至二零二五年的面板数据。
使用方法
研究者可通过HuggingFace datasets库以一行代码加载数据并转换为Pandas数据框,进而按国家代码筛选特定经济体的时间序列,或按指标代码提取单一指标的趋势曲线。利用pivot_table方法可将数据重塑为国家与年份的二维矩阵,便于开展跨国比较与面板回归。加载后的数据亦可直接接入scikit-learn或PyTorch等框架,用于表格分类、回归及时间序列预测等机器学习任务的基准实验。
背景与挑战
背景概述
国际劳工组织(ILO)长期致力于全球劳动力市场统计的标准化与可比性建设,ILOSTAT作为其核心统计数据库,为监测就业与失业状况提供了权威数据基础。该数据集由Electric Sheep Asia于2025年从ILOSTAT REST API抽取并重新封装,聚焦亚洲29个国家1996年至2025年间的失业人口统计,按性别、失业持续时间和婚姻状况三个维度进行细分,共计11,816条观测记录。其核心研究问题在于揭示亚洲地区失业结构的异质性,为劳动力市场政策评估、性别差异研究及脆弱群体识别提供量化依据。该数据集凭借统一的ICLS定义与来源追溯机制,显著提升了跨国比较研究的便利性与透明度,对劳动经济学和区域发展研究具有重要参考价值。
当前挑战
该数据集所应对的领域问题在于传统失业统计往往忽视持续时间与婚姻状况等结构性维度的交互影响,难以刻画失业的异质性特征。在构建过程中,主要挑战包括:其一,亚洲各国劳动力调查方法与ILO标准的衔接程度不一,部分国家数据缺失或仅覆盖特定年份,导致面板不均衡;其二,同一国家同年份可能存在多源数据,需依赖ILO的“最佳来源”选择机制,但该机制可能引入选择偏差;其三,部分观测值被标注为“不可靠”或“序列中断”,影响时序建模的稳健性;其四,性别、持续时间与婚姻状况的分类聚合层级不一致,增加了细粒度分析的复杂性。这些因素共同制约了数据在因果推断与精准预测中的应用潜力。
常用场景
经典使用场景
在劳动经济学与人口统计学的交叉领域,剖析失业现象的性别分化与婚姻状态关联始终是核心议题。该数据集凭借国际劳工组织(ILO)统一口径的跨国可比数据,成为探究亚洲地区失业结构的经典素材。研究者常以之构建按性别、失业持续时间与婚姻状况三重维度分组的失业水平面板,通过时间序列分解与横截面聚类,揭示不同国家在劳动力市场性别平等进程中的分化轨迹,为后续因果推断提供坚实的数据基石。
解决学术问题
该数据集有效回应了失业研究中长期存在的测量一致性难题。ILO通过国际劳工统计学家会议(ICLS)定义对各国劳动力调查原始数据进行调和,使得跨国比较不再受制于本土化定义差异。在此基础上,学者得以检验婚姻状态是否为失业持续时间的性别差异之调节变量,并评估经济周期对不同群体失业风险的异质性冲击。其存在推动了比较政治经济学与性别研究在微观数据层面的对话,为制定精准就业政策提供了实证依据。
实际应用
政策制定者与劳动力市场分析师可将该数据集用于监测亚洲各国失业问题的演变态势。国际组织在评估区域就业保障项目成效时,可依此识别性别与婚姻状态双重弱势群体,优化社会保护资源的配置。金融机构与咨询公司亦能将其纳入宏观经济预警模型,辅助研判消费信贷风险与人力资本投资策略。依托数据集提供的2025年预估值,前瞻性政策模拟与情景分析成为可能。
数据集最近研究
最新研究方向
在全球劳动力市场性别差距持续引发政策关注的背景下,该数据集凭借其覆盖29个亚洲国家、跨越近三十年的性别、失业持续期与婚姻状况三维交叉时序记录,正成为劳动经济学前沿研究的关键实证基础。近期研究聚焦于运用面板数据模型与机器学习方法,探究婚姻状况对男女失业持续期的非对称影响,并揭示亚洲金融危机、新冠疫情等外生冲击下性别失业结构的动态演变规律。此类分析为理解非正规经济中家庭角色分工与劳动供给弹性提供了独特视角,亦为国际劳工组织制定精准就业保障政策、推动体面劳动目标实现提供了可验证的数据支撑,对缩小亚洲区域性别就业差距具有重要的学术与政策意义。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务