遇见数据集

electricsheepasia/asia-ilo-ged-xlu1-sex-hht-chl-rt-prime-age-unemployment-rate-by-sex-household-type

收藏
Hugging Face2026-05-26 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲28个国家的23,645个观测值,时间跨度为2000年至2025年,涵盖一个独特指标:按性别、家庭类型和子女情况划分的黄金年龄失业率(%)。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过REST API获取并过滤到亚洲国家代码。数据集包括国家代码、来源信息、指标代码、性别分类(总计、男性、女性、其他)、家庭类型分类、子女情况分类、观测年份、观测值、观测状态等列。数据以年度频率发布,并提供了数据质量注意事项,例如使用ILO选择的“最佳来源”和分类列的非空条件。数据集适用于表格分类、回归和时间序列预测任务,旨在为研究人员和开发者提供机器学习就绪的亚洲劳动力统计数据。

This dataset encompasses 23,645 observations across 28 Asian countries, covering the time frame from 2000 to 2025. It includes a unique metric: the prime-age unemployment rate (%), disaggregated by gender, household type, and presence of children. The data is retrieved from the ILOSTAT database of the International Labour Organization (ILO) via a REST API, and filtered to retain only entries corresponding to Asian country codes. The dataset comprises the following columns: country code, source information, indicator code, gender classification (total, male, female, other), household type classification, presence of children classification, observation year, observed value, and observation status. It is published at an annual frequency, with accompanying data quality notes, including the utilization of ILO-selected "best sources" and non-null requirements for classification columns. This dataset is applicable for tasks such as tabular classification, regression, and time series forecasting, and is designed to provide machine learning-ready Asian labor force statistics for researchers and developers.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-ged-xlu1-sex-hht-chl-rt-prime-age-unemployment-rate-by-sex-household-type 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的中央统计数据库ILOSTAT,通过其REST API接口直接提取指标代码为GED_XLU1_SEX_HHT_CHL_RT的原始数据,并依据ISO3国家代码筛选出亚洲地区28个国家的记录。ILOSTAT对各国劳动力调查等微观数据进行统一 harmonization,遵循国际劳工统计学家会议(ICLS)的定义标准,确保指标跨国可比。经Electric Sheep Asia重新打包为Parquet格式,保留源标签与注释字段,最终形成23,645条年度观测记录,覆盖2000至2025年。
特点
数据集聚焦于亚洲地区_prime-age_人群(25至54岁)的失业率,按性别、家庭类型及是否存在六岁以下子女进行多维交叉分类。其核心特点在于细分维度丰富,不仅区分男女性别,还纳入家庭结构与子女抚养因素,为探究就业脆弱性提供了精细视角。数据以年度频率呈现,时间跨度达二十六年,涵盖28个亚洲国家,样本量逾两万条,且附带来源标识与观测状态标记,增强数据可追溯性。
使用方法
研究者可通过HuggingFace的datasets库以一行代码加载数据集,并转化为Pandas数据框进行灵活操作。典型用法包括按国家代码筛选特定区域数据、按指标代码提取时间序列并排序绘图,或利用pivot_table生成国家与年份的交叉矩阵。数据集支持表格分类、回归及时间序列预测等任务,使用时需留意各列非空仅当指标发布该细分维度,且应结合obs_status字段评估数据可靠性。
背景与挑战
背景概述
国际劳工组织(ILO)长期致力于全球劳动力市场统计体系的构建与完善,其维护的ILOSTAT数据库作为全球劳动统计的权威来源,为政策制定与学术研究提供了坚实的数据基础。在此背景下,针对亚洲地区性别、家庭类型与子女抚养状态交互作用下黄金年龄失业率的研究需求日益凸显。该数据集由Electric Sheep Asia于2025年基于ILOSTAT官方API重新封装发布,涵盖28个亚洲国家、2000至2025年间23,645条观测记录,核心研究问题在于揭示性别与家庭结构如何差异化影响黄金年龄劳动力的失业风险。该数据集为亚洲劳动力市场性别不平等、家庭政策效应评估等议题提供了精细化面板数据支撑,对推动区域比较研究与循证决策具有显著意义。
当前挑战
该数据集所应对的领域问题在于传统失业统计通常仅按性别或年龄粗分,难以刻画家庭结构与育儿责任对男女失业率的异质性影响,而这一精细化维度恰是理解性别就业差距形成机制的关键所在。在构建过程中,数据集面临多重挑战:一是不同国家劳动力调查的抽样设计、问卷定义与统计口径存在显著差异,ILO虽以国际劳工统计学家会议标准进行调和,但部分国家数据仍标注为不可靠或临时性;二是分类维度如家庭类型与子女年龄组的交叉导致部分单元格样本量不足,推高了观测值的抽样误差;三是年度频率数据在捕捉短期经济冲击对特定家庭类型失业动态的影响方面存在时效性局限,且部分国家存在年份缺失与源更替问题,对时间序列建模与跨国比较构成潜在约束。
常用场景
经典使用场景
在劳动经济学与人口统计学的交叉研究中,该数据集凭借其按性别、家庭类型及子女存在状况细分的_prime-age_失业率指标,成为刻画亚洲地区劳动力市场结构性差异的经典面板数据源。研究者通常借助其2000至2025年的长时序特性,构建双向固定效应模型或时间序列预测模型,以揭示性别与家庭照料责任对失业风险的异质性影响。
解决学术问题
该数据集有效回应了劳动经济学中关于家庭结构如何调节劳动力市场结果的长期争论。通过提供性别与子女存在状况交互分类的标准化失业率,它使学者能够量化育儿责任对女性劳动参与和失业概率的独立效应,并检验家庭类型在亚洲不同国家间的调节作用。这为理解性别就业差距的微观机制提供了可跨期比较的实证基础。
衍生相关工作
基于该数据集,研究者衍生出多项关于亚洲性别就业差距分解与家庭政策模拟的经典工作。部分文献利用其分类维度进行失业率的性别分解,量化家庭照料负担的解释份额;另有研究将其与生育率、托育服务覆盖率等辅助数据链接,评估普惠托育对prime-age女性失业率的缓解效应,推动了劳动供给理论在亚洲情境下的实证拓展。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务