遇见数据集

electricsheepasia/asia-ilo-ear-pmta-sex-nb-average-monthly-earnings-of-public-sector-employee

收藏
Hugging Face2026-05-28 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲25个国家公共部门雇员的平均月收入(以当地货币计)数据,时间跨度为1997年至2025年,共有627个观测值。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,涵盖了1个核心指标(EAR_PMTA_SEX_NB),并包括国家代码、年份、性别分类(总计、男性、女性)、观测值、数据来源和质量标志等列。数据集以表格形式呈现,适用于表格分类、回归和时间序列预测等任务,旨在为研究亚洲劳动力市场、公共部门薪酬趋势提供机器学习就绪的数据支持。

This dataset contains 627 observations of average monthly earnings of public sector employees (in local currency) across 25 Asia countries, spanning from 1997 to 2025. It covers 1 distinct indicator (EAR_PMTA_SEX_NB) and is sourced from the ILOSTAT database of the International Labour Organization (ILO). The data includes columns such as country code, year, sex disaggregation (total, male, female), observed value, source information, and quality flags, presented in a tabular format suitable for tasks like tabular classification, regression, and time-series forecasting. It is designed to provide ML-ready data for analyzing labor market trends and public sector wages in Asia.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-ear-pmta-sex-nb-average-monthly-earnings-of-public-sector-employee 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT综合劳动统计数据库,经由Electric Sheep Asia团队通过REST API接口直接获取原始数据,并依据亚洲ISO3国家代码进行过滤筛选。ILOSTAT本身基于各国劳动力调查、家庭收入调查、企业调查及行政记录等多元源头,遵循国际劳工统计学家会议(ICLS)定义进行数据协调与标准化处理。最终整合为包含627条观测记录、覆盖25个亚洲国家、时间跨度为1997年至2025年的结构化表格数据,以Parquet格式发布,确保机器学习的即用性。
特点
该数据集聚焦于公共部门从业人员平均月薪(以当地货币计)这一核心指标,具有鲜明的区域针对性和时间纵深性。数据按性别维度进行分解,涵盖总计数、男性与女性三个类别,便于开展性别薪酬差异分析。每条记录均附带详细的数据来源标签、观测状态及注释信息,增强了数据的可追溯性与透明度。此外,数据集经由标准化处理,提供了统一的列模式,降低了多源异构数据整合的复杂度,为跨国家、跨时期的比较研究奠定了坚实基础。
使用方法
用户可通过HuggingFace的datasets库便捷加载该数据集,仅需调用`load_dataset`函数即可获取训练集格式的DataFrame。在数据分析实践中,可利用`ref_area`字段按国家筛选子集,或按`indicator`与`time`字段构建时间序列进行趋势观察。支持通过pandas的pivot_table方法将数据重塑为国家×年份的矩阵形式,便于进行面板数据分析或可视化呈现。该设计降低了劳动经济学研究的数据准备门槛,特别适合亚洲区域公共部门薪酬动态的实证研究。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)统计部门ILOSTAT于2025年创建,后经Electric Sheep Asia团队重新整理并发布于HuggingFace平台,核心研究问题聚焦于亚洲地区公共部门雇员的平均月收入水平(以本币计)。作为全球劳动统计的权威来源,ILOSTAT基于国际劳工统计学家会议(ICLS)定义,对各国劳动力调查、家庭收入调查及行政记录数据进行统一协调,确保了指标的可比性与规范性。该数据集覆盖25个亚洲国家、1997年至2025年间共627条观测记录,为区域劳动经济学、公共部门薪酬比较及时间序列分析提供了宝贵的基础数据资源,对理解亚洲劳动力市场结构性特征具有重要推动作用。
当前挑战
在领域问题层面,该数据集直面亚洲公共部门薪酬数据碎片化与不统一的挑战——各国统计口径、货币单位及调查方法差异显著,且部分国家数据频次(如季度或月度)与年度数据混存在衔接困难。构建过程中则面临多源数据融合的复杂性:ILOSTAT需从劳动力调查、企业调查等多个来源筛选“最佳来源”,而对同一国家年份的多源冲突处理(如序列断裂标记)增加了归一化难度;此外,性别维度(总、男、女)的细分虽丰富了分析层次,但部分观测值为非公开或不可靠状态,需谨慎处理缺失值与质量标记,这要求使用者具备专业的数据清洗与调谐技能。
常用场景
经典使用场景
该数据集收录了亚洲25个国家1997年至2025年间公共部门雇员的平均月收入数据(以当地货币计价),共计627条观测记录。在劳动经济学与公共财政研究领域,研究者常将其用于跨国工资水平比较分析,通过构建面板数据模型,探讨亚洲各国公共部门薪酬体系的差异及其与经济发展阶段、财政能力之间的关联。数据涵盖性别维度(总、男性、女性),使得基于性别视角的公共部门工资差距研究成为可能,是分析亚洲劳动力市场结构性特征与公共政策效果的经典素材。
解决学术问题
该数据集有效解决了亚洲区域公共部门薪酬数据碎片化、标准化程度不足的学术难题。通过ILOSTAT统一采集与ILO统计标准(ICLS)定义,研究者得以规避各国统计口径不一致带来的比较障碍,进而回答诸如公共部门工资水平如何随通货膨胀与经济增长调整、性别薪酬差异在亚洲不同体制国家中呈现何种演变规律等核心问题。该数据为检验公共选择理论中官僚薪酬决定机制、评估财政紧缩政策对公共部门劳动力市场的冲击效应提供了可靠依据,对发展经济学与劳动经济学交叉领域具有重要推动作用。
衍生相关工作
基于该数据集,学术界衍生出一系列聚焦亚洲公共部门薪酬动态的实证研究。经典工作包括利用面板固定效应模型分析金融危机前后公共部门工资的韧性变化,以及运用时间序列分解方法识别工资与消费者价格指数之间的长期均衡关系。部分研究将其与ILOSTAT同期发布的私营部门工资数据结合,构建公私部门薪酬溢价指数,探讨公共部门就业吸引力与财政可持续性的平衡。此外,性别薪酬差距的纵向分析催生了关于女性劳动参与率与公共部门福利政策效能的计量经济学论文,拓展了劳动市场制度比较研究的边界。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务