遇见数据集

electricsheepeurope/europe-ilo-emp-nifl-sex-how-rt-informal-employment-rate-by-sex-and-weekly-hours-a

收藏
Hugging Face2026-05-26 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含了欧洲5个国家(摩尔多瓦、塞尔维亚、波黑、北马其顿、俄罗斯)从2003年至2025年的非正规就业率数据,共计2,335个观测值。核心指标为EMP_NIFL_SEX_HOW_RT,即按性别和每周实际工作小时数划分的非正规就业率(百分比)。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过API获取并经过处理,覆盖了不同性别(总计、男性、女性)的分类数据。数据集以表格形式呈现,包含国家代码、国家名称、数据来源、指标代码、性别分类、年份、观测值等列,适用于表格分类、回归分析和时间序列预测等自然语言处理任务。

This dataset contains 2,335 observations of informal employment rate data across 5 European countries (Moldova, Serbia, Bosnia and Herzegovina, North Macedonia, Russia) spanning from 2003 to 2025. The core indicator is EMP_NIFL_SEX_HOW_RT, which represents the informal employment rate by sex and weekly hours actually worked (%). The data is sourced from the International Labour Organization (ILO) ILOSTAT database, retrieved via API and processed, covering disaggregation by sex (total, male, female). The dataset is presented in tabular format with columns including country code, country name, data source, indicator code, sex classification, year, observed value, etc., and is suitable for natural language processing tasks such as tabular classification, regression, and time-series forecasting.

提供机构:
electricsheepeurope
搜集汇总
数据集介绍
electricsheepeurope/europe-ilo-emp-nifl-sex-how-rt-informal-employment-rate-by-sex-and-weekly-hours-a 数据集图片
构建方式
该数据集源于国际劳工组织(ILO)的ILOSTAT中央统计数据库,依托其REST API接口直接提取指标EMP_NIFL_SEX_HOW_RT的原始记录,并筛选至欧洲区域ISO3国家代码。ILOSTAT通过国际劳工统计学家会议(ICLS)定义对各国劳动力调查、家庭收入调查等微观数据进行标准化调和,确保跨国可比性。随后由Electric Sheep Europe进行重打包,统一模式并以Parquet格式发布,保留源标签列以追溯数据来源。
使用方法
研究者可通过HuggingFace的datasets库以load_dataset()函数加载数据,并转换为Pandas数据框进行探索。典型操作包括按国家代码筛选特定国家、按指标与年份排序绘制时间序列图、或利用透视表生成国家×年份矩阵以分析非正规就业率的时空演变。代码示例展示了筛选、可视化与矩阵重构的基本流程,支持表格分类、回归及时间序列预测等任务。
背景与挑战
背景概述
非正规就业作为全球劳动力市场结构性议题,其测度长期受制于定义分歧与数据碎片化。国际劳工组织(ILO)依托国际劳工统计学家会议(ICLS)框架,经由ILOSTAT平台系统汇编各国劳动力调查等微观资料,构建了跨区域可比的非正规就业统计体系。该数据集由Electric Sheep Europe于2025年再包装发布,聚焦欧洲五国2003至2025年非正规就业率,按性别与周实际工作时长双重维度细分,共2,335条年度观测。其核心价值在于将工作时长纳入非正规就业分层分析,为探究性别差异、工时结构与非正规性之间的交互提供标准化基础。
当前挑战
非正规就业测度的根本难题在于概念边界随ICLS决议演进而变动,导致跨国与跨时比较面临口径断裂风险。数据集所涉五国转型经济体在劳动力调查体系成熟度、非正规部门识别能力上参差不齐,部分观测因样本不足被标记为不可靠,且多国存在方法论修订所致的序列断点。构建层面,ILOSTAT对同国同年多重来源采用择优选取策略,虽提升一致性却可能掩盖来源间系统性偏差;工作时长分类的组距设计亦需兼顾各国调查差异,使细分维度下的观测密度不均,制约精细估计的稳健性。
常用场景
经典使用场景
在劳动经济学与非正规经济研究领域,该数据集最经典的使用场景在于刻画欧洲五国非正规就业率的时序演变与性别差异。研究者常以性别和每周实际工作小时数为核心分组变量,构建面板数据模型,进而揭示非正规就业在劳动力市场中的结构性分布特征。借助其年度频率与跨国比较维度,该数据集亦被广泛用于时间序列预测与跨国收敛性分析,成为探究转型经济体劳动力市场动态的重要实证基础。
解决学术问题
该数据集有效回应了非正规就业测量中性别维度与工时维度长期割裂的学术困境。既有研究多局限于单一性别或笼统工时口径,难以精确识别非正规就业的异质性群体。此数据集通过性别与周工时双重视角,解决了非正规就业率在细分劳动供给强度下的可比性难题,为检验性别不平等理论、非正规部门分割假说以及工时—就业质量关联机制提供了标准化数据支撑,推动了劳动统计方法的精细化发展。
实际应用
在政策制定与劳动力市场监测层面,该数据集为欧洲转型经济体设计非正规就业治理方案提供了量化依据。国际组织与各国劳工部门可借助其性别与工时分解结果,精准识别非正规就业高风险群体,评估劳动法规覆盖缺口,并制定有针对性的社会保障扩展策略。同时,该数据集亦服务于世界银行、欧盟委员会等机构的国别就业诊断报告,支撑体面劳动议程的进展追踪与跨国比较评估。
数据集最近研究
最新研究方向
在全球非正规经济持续引发政策关切、国际劳工组织将体面劳动与非正规就业测度纳入可持续发展目标监测框架的背景下,基于国际劳工组织ILOSTAT数据库、覆盖五个欧洲转型经济体2003至2025年的非正规就业率面板数据,为劳动经济学与经济社会学的交叉研究提供了新的实证基础。当前前沿研究聚焦于以周工作时长作为划分维度,系统解构非正规就业的性别异质性与时间配置差异,并借助面板计量与时序预测方法,识别经济转型、制度变迁与劳动力市场规制对非正规就业动态的非线性影响。该数据集的性别与工时双重分层结构,亦为探讨非正规就业与贫困脆弱性、社会保障覆盖及非标准就业形态之间的关系提供了可检验的量化支撑,对推动欧洲边缘劳动力市场的一体化比较研究具有显著的学术价值与政策意涵。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务