遇见数据集

electricsheepasia/asia-ilo-luu-xlu3-sex-mts-rt-combined-rate-of-unemployment-and-potential-labour

收藏
Hugging Face2026-05-27 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲29个国家从1999年至2025年的5,270条观测记录,聚焦于“失业与潜在劳动力综合率(LU3)按性别和婚姻状况划分”这一指标。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过API提取并过滤至亚洲国家,涵盖了劳动力利用不足的其他衡量标准。数据集提供了详细的表格结构,包括国家代码、年份、性别分类、婚姻状况分类、观测值及其状态等字段,适用于表格分类、回归和时间序列预测等任务。数据以CC-BY-4.0许可证发布,由Electric Sheep Asia重新打包,旨在为亚洲地区提供机器学习就绪的统一数据层。

This dataset contains 5,270 observations of the combined rate of unemployment and potential labour force (LU3) by sex and marital status across 29 Asia countries, spanning from 1999 to 2025. It is sourced from ILOSTAT (the ILOs central statistics database), focusing on other measures of labour underutilization. Data was pulled via the ILOSTAT REST API, filtered to Asian countries, and includes detailed tabular schema with columns such as country codes, year, sex disaggregation, marital status classification, observed values, and status flags. It is designed for tabular classification, regression, and time-series forecasting tasks, released under the CC-BY-4.0 license, and repackaged by Electric Sheep Asia to provide a unified, ML-ready data layer for Asia.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-luu-xlu3-sex-mts-rt-combined-rate-of-unemployment-and-potential-labour 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT数据库,聚焦于亚洲地区劳动力和就业统计中‘失业与潜在劳动力综合比率(LU3)’这一核心指标。数据通过ILOSTAT的REST API接口提取,并依据ISO 3166-1 alpha-3标准筛选出29个亚洲国家的观测记录,时间跨度覆盖1999年至2025年。为保障数据的一致性与可比性,ILO依据国际劳工统计学家大会(ICLS)的定义对原始调查微观数据进行统一协调处理,并在数据集中保留来源标签(source.label)以增强可追溯性。每个观测值均包含国家、年份、性别分类、婚姻状况等维度属性,以及观测状态与注释信息,便于研究者识别数据中断或方法论修订等特殊情形。
特点
此数据集的核心特色在于其严谨的结构化设计与丰富的分类维度。其收录了5,270条观测记录,涵盖29个亚洲国家,时间跨度长达27年,为区域劳动力市场分析提供了坚实的数据基础。数据集的分类体系尤为细致,按性别(总、男、女)及婚姻状况进行多重细分,使得研究者能够深入剖析不同人群的劳动参与差异。此外,数据集继承了ILOSTAT的权威性,所有指标均遵循国际可比口径,并辅以ILO选定的‘最佳来源’策略,确保在多个数据来源并存时采用质量最高的数据。这种精细的分类层次与严格的质控流程,使其成为洞察亚洲劳动力市场结构性变迁的宝贵资源。
使用方法
该数据集的使用便捷高效,兼容Python数据科学生态。用户可通过HuggingFace的`datasets`库直接加载数据,将其转换为Pandas DataFrame即可进行后续分析。具体而言,研究者能够依据`ref_area`字段筛选特定国家(如印度尼西亚),或针对`LUU_XLU3_SEX_MTS_RT`指标构建时间序列并绘制趋势图。数据集的透视功能支持将数据重塑为国家与年份的矩阵形式,便于进行跨国的横向比较或社会经济影响评估。此外,数据集中包含的`source.label`、`obs_status`等注释信息,为用户进行敏感度分析或数据质量评估提供了必要线索,使得复杂的经济计量研究得以建立在透明可核验的数据基础之上。
背景与挑战
背景概述
该数据集由Electric Sheep Asia于2025年重新整理发布,源自国际劳工组织(ILO)的ILOSTAT数据库,聚焦亚洲29国1999至2025年间失业与潜在劳动力综合比率(LU3)的性别及婚姻状况细分数据,共含5270条观测。其核心研究问题在于揭示亚洲地区劳动力未充分利用的多元维度,为劳动经济学、社会政策及区域发展研究提供标准化、可复用的数据基础。该数据集的发布填补了亚洲区域劳动力微观结构比较分析的数据空缺,推动了跨国时序研究在劳动统计领域的深化,并为实现联合国可持续发展目标中的体面工作议程提供了关键数据支撑,在学术界与政策制定领域具有重要参考价值。
当前挑战
该数据集面临的挑战首先体现在领域问题层面:劳动力未充分利用(如LU3指标)的测度涉及多维度细分(性别、婚姻状态等),且各国统计口径与调查方法存在差异,导致跨区域可比性不足;同时,时序数据存在断裂(如方法论修订、调查来源变更),影响长期趋势分析的可靠性。其次,在构建过程中,需整合ILOSTAT多源异构数据,处理不同国家调查频率不一致、数据缺失及异常值标记等问题,并确保与原始来源的准确映射;此外,针对性别和婚姻状态的分类聚合可能丢失微观细节,对后续基于此数据集的精细分析构成潜在限制。
常用场景
经典使用场景
该数据集聚焦于亚洲29个国家1999至2025年间劳动力利用不足的综合度量指标——失业与潜在劳动力合计比率(LU3),按性别与婚姻状况细分。在劳动经济学与区域发展研究中,此数据常被用于构建面板数据模型,分析宏观经济波动、人口结构变迁与劳动力市场刚性之间的关联。学者可借此评估不同婚姻状态群体在就业机会获取上的结构性差异,或追踪特定国家(如菲律宾、越南)劳动力市场的周期性演变。其标准化编码与时间跨度设计,为跨国比较与纵向研究提供了便利,尤其适用于探索亚洲经济体在劳动参与率、性别平等及社会保障层面的动态特征。
解决学术问题
此数据解决了亚洲区域劳动力统计口径不统一、跨国可比性薄弱的核心痛点。ILOSTAT基于国际劳工组织协定框架进行数据协调,使得研究者在分析失业与潜在劳动力时免受各国统计标准差异的干扰。其细粒度分类(性别×婚姻状态)支持考察婚姻状况对劳动供给决策的异质性影响,弥补了既往研究仅关注性别或年龄维度的不足。通过提供来源标记与中断记录等质量指标,该数据帮助学者识别估算噪声,进而提升劳动力市场预测模型的稳健性,为发展经济学中关于未充分就业的经典理论提供了实证检验基础。
衍生相关工作
围绕此数据,研究者已构建多种衍生分析工具与学术成果。例如,基于时间序列预测模型(如ARIMA或Prophet)对亚洲各国LU3趋势进行短期外推,用于情景规划;结合机器学习分类器,利用性别与婚姻特征预测高失业风险群体。在学术上,相关论文常将之与GDP增长率、教育水平等宏观指标关联,探讨劳动力市场灵活性与社会保障制度的交互效应。此外,该数据集作为开源资源,已被纳入‘Electric Sheep Asia’统一数据层,促进了跨数据集的无缝整合,为构建区域劳动力市场综合评估平台奠定了基础,进而推动了开发经济学与计算社会科学的交叉研究。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务