遇见数据集

electricsheepeurope/europe-ilo-eip-teip-sex-mts-nb-persons-outside-the-labour-force-by-sex-and-marita

收藏
Hugging Face2026-05-27 更新2026-05-31 收录
官方服务:

资源简介:

该数据集是关于欧洲按性别和婚姻状况划分的非劳动力人口(以千计)的统计信息,源自国际劳工组织(ILO)的ILOSTAT数据库。它包含14,535个观测值,覆盖39个欧洲国家,时间跨度为1983年至2025年,涉及一个具体指标(EIP_TEIP_SEX_MTS_NB),该指标衡量非劳动力人口的数量。数据集以表格形式组织,包括国家代码、国家名称、数据来源、指标代码、性别分类、婚姻状况分类、观测年份、观测值、数据状态标志和注释等列。数据为年度频率,并经过ILO的标准化处理,以确保一致性和可追溯性。该数据集适用于表格分类、回归和时间序列预测等任务,主要用于劳动力市场分析和研究。

This dataset contains statistical information on persons outside the labour force by sex and marital status (in thousands) for Europe, sourced from the International Labour Organization (ILO) ILOSTAT database. It includes 14,535 observations across 39 European countries, spanning from 1983 to 2025, with one specific indicator (EIP_TEIP_SEX_MTS_NB) that measures the number of persons outside the labour force. The data is organized in tabular format, with columns for country codes, country names, data sources, indicator codes, sex disaggregation, marital status classification, observation year, observed values, data status flags, and notes. The data is annual frequency and harmonized by ILO for consistency and traceability. It is suitable for tasks such as tabular classification, regression, and time-series forecasting, primarily for labour market analysis and research.

提供机构:
electricsheepeurope
搜集汇总
数据集介绍
electricsheepeurope/europe-ilo-eip-teip-sex-mts-nb-persons-outside-the-labour-force-by-sex-and-marita 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT中央统计数据库,通过其REST API接口直接获取指标代码为EIP_TEIP_SEX_MTS_NB的原始数据,随后依据欧洲ISO3国家代码进行地理范围筛选。数据经过Electric Sheep Europe的重新封装与标准化处理,转换为Parquet格式并整合至HuggingFace数据集平台,确保研究者能够通过简单的API调用快速加载使用。构建过程中严格遵循ILO基于国际劳工统计学家会议(ICLS)定义的协调方法,并在source.label列中标记原始调查数据的来源类型,以保障数据的可追溯性与权威性。
特点
该数据集收录了1983年至2025年间39个欧洲国家关于“按性别和婚姻状况划分的劳动力市场外人口(千人)”的年度观测数据,共计14,535条记录。其核心特色在于提供了按性别(总、男、女)和婚姻状况(以分类变量classif1表示)的精细分层,使得研究者能够深入分析不同社会群体在劳动力市场边缘的状态。此外,数据集包含观测状态标志(如“不可靠”)和系列断裂注释,为用户评估数据质量提供了透明依据,同时涵盖来自不同调查源的多源数据,增强了分析的稳健性与覆盖广度。
使用方法
用户可通过HuggingFace Datasets库以load_dataset函数直接加载该数据集,返回的Dataset对象可便捷地转换为Pandas DataFrame进行后续分析。推荐的使用路径包括:按国家代码筛选特定国家的子集以进行国别研究;利用时间列对单一指标进行时间序列排序与可视化;或通过透视表操作构建国家×年份的观测值矩阵,支持面板数据回归与时序预测任务。该数据集兼容表格分类、回归及时间序列预测等任务类型,特别适用于劳动经济学、社会政策评估及欧洲劳动力市场动态研究领域。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)下属的ILOSTAT数据库整理发布,后经Electric Sheep Europe于2025年进行重封装,专注于欧洲39个国家1983年至2025年间按性别和婚姻状况划分的劳动力市场以外人口(以千计)的观测数据。共包含14,535条记录,覆盖1项核心指标。ILOSTAT作为全球劳动统计的权威来源,整合了来自各国劳动力调查、住户收入调查及行政记录的数据,并依据国际劳工统计学家会议(ICLS)定义进行标准化处理。该数据集为研究欧洲隐性失业、劳动力市场参与不足及人口结构变化提供了高分辨率的时间序列素材,尤其适合分析婚姻状况和性别对非劳动力群体构成的长期影响,在劳动经济学、社会政策评估及跨国比较研究中具有重要应用价值。
当前挑战
该数据集所解决的领域问题主要在于,传统失业率指标往往无法全面捕捉劳动力市场的闲置状况,而“劳动力市场以外人口”这一指标能够揭示因家庭责任、教育、健康或丧失信心等原因未参与就业的群体,从而更完整地评估劳动资源利用效率。构建过程中面临多重挑战:首先,数据来源涉及39个国家的多种调查类型,需协调不同统计体系间的定义差异和分类标准;其次,时间跨度长达43年,期间多国经历过调查方法修订(如数据集中标注的“方法论变更”),导致序列中断或口径不统一;此外,婚姻状况、性别等细分维度使得部分年份或国家的观测值因数据缺失或样本量不足而标记为“不可靠”,增加了因果推断与跨国可比分析的难度。
常用场景
经典使用场景
在劳动经济学与社会人口统计学交汇处,该数据集因其对欧洲劳动力边缘化人群的精细化刻画而成为经典研究素材。其经典使用场景聚焦于对适龄劳动人口中脱离劳动力市场之群体的时序与截面分析,研究者可借助'性别'与'婚姻状况'双重分类维度,系统剖析欧洲39国自1983年至2025年间非劳动力人口的结构性演变,通过构建面板数据模型,追踪经济周期、政策干预或社会变迁对不同婚姻状态男女生理上退出劳动的决定性影响。
解决学术问题
该数据集有效破解了传统劳动力统计中'就业率'与'失业率'指标所无法涵盖的隐性劳动力闲置问题,将学术目光引向那些既未就业亦未积极求职的沉默群体。它使得学者能够量化婚姻与家庭纽带如何成为不同性别进入劳动市场的差异化壁垒,揭示社会抚养责任、退休文化或地域性就业歧视在塑造非劳动力人口分布格局中的深层作用,为国际劳工组织推行的体面劳动议程提供了坚实的经验证据,推动了关于劳动参与率非线性变化的理论革新。
衍生相关工作
基于该数据集,衍生出若干影响深远的学术工作,尤其集中在对劳动力市场刚性测度方法的改进领域。部分研究将其与同期就业率、失业率数据合并,构建综合劳动闲置指数,提出了超越传统失业率评估劳动力市场健康度的新范式;另有学者利用其时间序列特性,开发适用于非平稳面板数据的潜在劳动力预测模型,预估经济复苏周期中隐藏劳动力回流的速度与规模。这些衍工作证了性别与婚姻变量在劳动退出预测中的关键解释力,推动了劳动统计学由静态描述向动态归因演进。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务