遇见数据集

electricsheepasia/asia-ilo-eap-3wap-sex-age-edu-rt-youth-labour-force-participation-rate-by-sex-age-a

收藏
Hugging Face2026-05-27 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲38个国家从1970年至2025年的青年劳动力参与率数据,共有23,687个观测值,涵盖1个核心指标:EAP_3WAP_SEX_AGE_EDU_RT(按性别、年龄和教育程度分组的青年劳动力参与率百分比)。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过API获取并过滤为亚洲国家。数据集提供了详细的分类维度,包括性别(总计、男性、女性、其他)、年龄组(如15-29岁)和教育水平(总计等)。数据结构包括国家代码、年份、观测值、数据来源、分类标签及注释列,适用于表格分类、回归和时间序列预测等任务。数据集以CC-BY-4.0许可发布,由Electric Sheep Asia重新打包,便于机器学习使用。

This dataset contains 23,687 observations of youth labour force participation rates across 38 Asia countries, spanning from 1970 to 2025, with one core indicator: EAP_3WAP_SEX_AGE_EDU_RT (Youth labour force participation rate by sex, age and education, in percentage). The data is sourced from the International Labour Organization (ILO) ILOSTAT database, retrieved via API and filtered for Asian countries. It includes detailed disaggregation dimensions such as sex (total, male, female, other), age groups (e.g., 15-29 years), and education levels (e.g., total). The schema comprises columns for country codes, year, observed values, data sources, classification labels, and notes, suitable for tabular classification, regression, and time-series forecasting tasks. The dataset is released under CC-BY-4.0 license and repackaged by Electric Sheep Asia for machine learning readiness.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-eap-3wap-sex-age-edu-rt-youth-labour-force-participation-rate-by-sex-age-a 数据集图片
构建方式
本数据集源自国际劳工组织(ILO)的ILOSTAT数据库,通过调用其REST API接口,筛选出亚洲地区38个国家的相关指标数据,经Electric Sheep Asia团队重新封装后形成。数据涵盖了1970年至2025年间的23,687条观测记录,基于ILO的统计标准(ICLS定义)对原始调查微观数据进行统一协调处理,并保留了数据来源标签以供追溯。构建过程确保了数据的一致性与可复现性,为后续分析提供了可靠基础。
使用方法
用户可通过HuggingFace Datasets库快速加载该数据集,例如使用'load_dataset'函数直接获取。加载后即可转为Pandas DataFrame进行探索性分析,如按国家筛选、绘制特定指标的时间序列趋势图,或通过数据透视表构建国家×年份矩阵。数据集以结构化表格形式呈现,包含国家代码、指标值、分类变量等字段,便于直接应用于分类、回归或时间序列预测等机器学习任务。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)于2025年整合发布,并由Electric Sheep Asia团队在HuggingFace平台上重新打包,旨在系统性地研究亚洲地区青年劳动力参与率的性别、年龄及教育维度差异。数据集囊括1970年至2025年间38个亚洲国家的23,687条观测记录,核心关注青年(15-29岁)劳动力参与率这一关键指标,为区域劳动力市场分析、性别平等政策评估及教育投资回报研究提供了坚实的数据基础。作为ILOSTAT统计数据库的子集,该数据集通过严格的数据协调方法,使得跨国、跨时域的比较研究成为可能,对于理解亚洲各国青年就业格局的演变具有重要推动意义,已被广泛应用于社会经济学与劳动科学的实证研究中。
当前挑战
数据集的构建面临多重挑战。从领域问题看,亚洲各国在青年劳动力参与率上存在显著异质性,如何基于统一标准(如ICLS定义)协调不同国家的劳动调查数据,以准确反映因性别、年龄组别与教育程度分化而产生的劳动力市场参与差异,是核心难题。此外,该数据集需应对数据来源多样性带来的挑战,包括不同调查类型(如住户劳动力调查与行政记录)在方法上的不一致性,以及时间序列上因统计指标修订或调查方法变更(如“methodology revised”标注)导致的断点问题。同时,部分国家的样本量不均与观测值可靠性标注(如“unreliable”状态)增加了数据分析的复杂性,考验着研究者对数据质量的辨识与处理能力。
常用场景
经典使用场景
该数据集收录了1970年至2025年间亚洲38个国家的青年劳动力参与率,按性别、年龄和教育水平细致划分,共计23,687条观测记录。研究者常将其用于时间序列分析与面板数据建模,以追踪青年劳动力市场参与度的长期演变趋势。通过按国家、性别或教育层级进行切片,可系统揭示不同群体在劳动力市场中的结构性差异,为理解亚洲青年就业格局提供坚实的数据基础。
解决学术问题
该数据集有效回应了劳动力经济学中关于青年就业决定因素的经典问题,尤其聚焦于性别、年龄与教育水平如何交互影响劳动力参与率。它使学者能够检验人力资本理论、性别不平等假说以及教育回报率在亚洲多元社会中的适用性。此外,跨国的纵向覆盖为评估政策干预效果(如教育普及或就业促进计划)提供了难得的自然实验窗口,推动了发展经济学与公共政策研究的实证深化。
实际应用
在实际应用中,该数据为国际组织及亚洲各国政府制定青年就业策略提供了量化依据。依托ILOSTAT的标准化统计框架,数据集可直接用于构建劳动力市场监测仪表盘、预测未来劳动力供给,或评估特定教育层次对就业率的影响。非政府组织和研究机构亦可利用其进行区域比较,识别劳动力参与率偏低的脆弱群体,从而设计更具针对性的技能培训与社会保护项目。
数据集最近研究
最新研究方向
该数据集聚焦于亚洲地区青年劳动力参与率的性别、年龄与教育维度交叉分析,为理解全球劳动力市场结构性变迁提供了关键数据支撑。前沿研究趋向于利用该长时间序列(1970–2025)与跨国面板数据(38国),结合ILOSTAT标准化的基尼系数与教育分类变量,剖析亚洲新兴经济体在数字化转型与后疫情时代中,青年就业参与率的异质性演变路径。尤其值得关注的是,该数据为联合国可持续发展目标(SDG 8.6)中关于青年NEET群体(未就业、未受教育、未受培训)的监测与政策评估提供了实证基础,并与国际劳工组织(ILO)近年倡导的以人为本的复苏战略形成呼应,推动了对非正规就业与性别工资差距等热点议题的量化研究。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务