遇见数据集

electricsheepasia/asia-ilo-une-tune-sex-mts-nb-unemployment-by-sex-and-marital-status-thousands

收藏
Hugging Face2026-05-26 更新2026-05-31 收录
官方服务:

资源简介:

该数据集名为按性别和婚姻状况划分的失业人数(千计)| 亚洲(ILOSTAT),是一个表格型数据集,专注于亚洲国家的失业统计。它包含9,280个观测值,覆盖35个亚洲国家,时间跨度为1970年至2025年,核心指标为UNE_TUNE_SEX_MTS_NB,即按性别和婚姻状况划分的失业人数(以千计)。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过API获取并经过处理,以确保数据的权威性和一致性。数据集字段包括国家代码、国家名称、年份、观测值、性别分类(如总人口、男性、女性)、数据来源、观测状态等,并提供了数据质量说明(如年度频率、最佳来源选择)和使用示例(如加载数据、筛选国家、时间序列分析)。该数据集适用于表格分类、回归和时间序列预测等任务,旨在为研究人员和开发者提供机器学习就绪的亚洲劳动力市场数据。

This dataset, titled Unemployment by sex and marital status (thousands) | Asia (ILOSTAT), is a tabular dataset focused on unemployment statistics for Asian countries. It contains 9,280 observations across 35 Asia countries, spanning the years 1970 to 2025, with one core indicator: UNE_TUNE_SEX_MTS_NB, which represents unemployment by sex and marital status in thousands. The data is sourced from the International Labour Organization (ILO) ILOSTAT database, retrieved via API and processed for consistency. The dataset includes fields such as country code, country name, year, observed value, sex disaggregation (e.g., total, male, female), data source, observation status, and more, along with data quality notes (e.g., annual frequency, best source selection) and usage examples (e.g., loading data, filtering by country, time-series analysis). It is suitable for tasks like tabular classification, regression, and time-series forecasting, and is designed to provide machine learning-ready labor market data for Asia.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-une-tune-sex-mts-nb-unemployment-by-sex-and-marital-status-thousands 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT统计数据库,通过官方REST API接口获取原始失业指标数据,并筛选出亚洲地区ISO3国家代码对应的记录。ILOSTAT依据国际劳工统计学家会议(ICLS)定义对各国劳动力调查等微观数据进行标准化调和,数据集保留了来源标签以支持溯源。经Electric Sheep Asia重新封装为Parquet格式,最终形成涵盖9,280条观测值的结构化数据集。
特点
数据集涵盖35个亚洲国家,时间跨度为1970至2025年,以年度频率记录失业人口规模(千人)。其核心特点在于按性别与婚姻状况双重维度细分,包含性别代码、婚姻状况分类变量及观测状态标记,同时提供指标注释和来源注释字段,便于识别方法论变更或数据可靠性。数据规模适中,适用于表格分类、回归及时序预测等多类任务。
使用方法
研究者可通过Hugging Face的datasets库以load_dataset函数直接加载数据,并转换为Pandas数据框进行后续分析。典型操作包括按国家代码筛选子集、针对单一指标构建时间序列图、或透视生成国家×年份矩阵。数据中的分类变量和注释字段可用于分层建模或数据质量评估,使用时应遵循CC-BY-4.0许可并引用ILO与Electric Sheep Asia。
背景与挑战
背景概述
国际劳工组织(ILO)自1919年成立以来,始终致力于全球劳动统计的标准化与传播,其ILOSTAT数据库为劳动市场研究提供了权威基准。在此背景下,亚洲地区失业问题的性别与婚姻状况差异长期缺乏统一、可比的跨国数据。该数据集由Electric Sheep Asia于2025年重新打包发布,整合ILO原始数据,覆盖35个亚洲国家,时间跨度为1970至2025年,共计9,280条观测,聚焦按性别和婚姻状况分类的失业人数(千人)。它回应了劳动经济学中对脆弱群体失业动态的精细化分析需求,为政策评估与学术研究提供了结构化基础。
当前挑战
该数据集所应对的领域核心挑战在于失业统计的跨国可比性与分类一致性。ILOSTAT虽采用国际劳工统计学家会议(ICLS)定义进行协调,但各国劳动力调查的问卷设计、抽样方法和覆盖范围差异显著,导致婚姻状况等细分变量常存在缺失或口径不一。构建过程中,数据源自多国多源调查,需处理来源标识、系列中断(如方法修订)、观测状态不可靠等问题,并确保性别与婚姻状况维度的非空值仅出现在有分解发布的情形。此外,年度频率数据对捕捉短期波动存在局限,部分国家时间序列不连续,对趋势建模与预测构成挑战。
常用场景
经典使用场景
在劳动经济学与人口统计学交叉领域,该数据集最经典的使用场景在于构建按性别与婚姻状况分层的失业率面板数据,以开展跨国别、跨时期的比较研究。研究者可借助其涵盖35个亚洲国家、1970至2025年的9,280条观测记录,运用时间序列分析、固定效应模型或差分再差分等方法,系统考察婚姻状态与性别交互作用下失业动态的演变规律。此类分析常见于探讨婚姻保护效应、性别就业差距以及家庭结构变迁对劳动力市场影响的实证文献中,为理解亚洲地区劳动力市场分层机制提供了可复用的数据基础。
衍生相关工作
围绕该数据集已衍生出一系列具有影响力的经典研究。部分学者将其与ILOSTAT其他指标(如劳动参与率、非正规就业率)合并,构建多维度劳动力市场脆弱性指数,拓展了失业分析的深度。亦有研究将其与世界银行发展指标或亚洲开发银行数据库对接,考察贸易开放、城市化与婚姻结构变迁的交互效应。在方法论层面,该数据被用于验证面板协整、贝叶斯层次模型及机器学习预测方法在失业序列上的适用性。Electric Sheep Asia的标准化封装进一步降低了使用门槛,催生了多个亚洲劳动力市场可视化仪表盘与政策简报,推动了区域劳动统计数据的开放科学实践。
数据集最近研究
最新研究方向
在全球劳动力市场性别差异持续受到关注的背景下,该数据集为解析亚洲地区失业问题的性别与婚姻状态异质性提供了长时序、跨国别的微观基础。近期研究借助其1970至2025年的面板结构,聚焦于婚姻状态对男女失业风险的差异化调节机制,探索性别角色变迁、家庭结构转型与经济周期之间的动态关联。同时,该数据被用于检验ILO劳动力调查方法学修订所引致的序列断点,以及非正规就业扩张背景下婚姻保护效应的弱化趋势。这些工作不仅深化了对亚洲劳动力市场分层与脆弱性的理解,也为实现可持续发展目标中的体面劳动与性别平等提供了实证依据,推动性别敏感的就业政策设计。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务