遇见数据集

electricsheepasia/asia-ilo-emp-care-sex-cct-nb-care-employment-by-sex-and-citizenship-thousands

收藏
Hugging Face2026-05-28 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含亚洲15个国家从2000年至2024年关于有偿护理工作者的647个观测值,涵盖1个独特指标(EMP_CARE_SEX_CCT_NB,即按性别和公民身份划分的护理就业,单位:千)。数据来源于国际劳工组织(ILO)的ILOSTAT数据库,通过API获取并过滤至亚洲国家代码,使用国际劳工统计学家会议(ICLS)定义进行标准化处理。数据集包含结构化表格,列包括国家代码、国家名称、数据来源、指标代码、性别分类、时间年份、观测值、数据状态标志等,提供按性别和公民身份维度的细分数据。数据频率为年度,涵盖伊朗、塞浦路斯、格鲁吉亚、文莱、约旦、马尔代夫、东帝汶、蒙古、泰国、老挝、亚美尼亚、黎巴嫩、不丹、印度尼西亚和伊拉克等国家。

This dataset contains 647 observations of Paid care workers data across 15 Asia countries, spanning 2000–2024, covering 1 distinct indicator (EMP_CARE_SEX_CCT_NB — Care employment by sex and citizenship in thousands). The data is sourced from the International Labour Organizations ILOSTAT database, retrieved via API and filtered to Asia ISO3 country codes, harmonized using International Conference of Labour Statisticians (ICLS) definitions. The dataset is structured in tabular format with columns including country code, country name, data source, indicator code, sex disaggregation, time year, observed value, observation status flags, etc., providing breakdowns by sex and citizenship dimensions. Data is annual frequency, covering countries such as Iran, Cyprus, Georgia, Brunei, Jordan, Maldives, Timor-Leste, Mongolia, Thailand, Laos, Armenia, Lebanon, Bhutan, Indonesia, and Iraq.

提供机构:
electricsheepasia
搜集汇总
数据集介绍
electricsheepasia/asia-ilo-emp-care-sex-cct-nb-care-employment-by-sex-and-citizenship-thousands 数据集图片
构建方式
该数据集源自国际劳工组织(ILO)的ILOSTAT数据库,通过其REST API直接获取指标EMP_CARE_SEX_CCT_NB的原始数据,并依据ISO 3166-1 alpha-3标准筛选出覆盖亚洲15个国家的观测记录。数据经过ILOSTAT基于国际劳工统计学家会议(ICLS)定义的统一化处理,来源类型在source.label字段中予以标注,以确保数据来源的可追溯性。Electric Sheep Asia团队对数据进行重新封装,将其转化为适用于机器学习的Parquet格式,并整合为统一的模式,最终发布至HuggingFace平台。
特点
该数据集包含647条观测值,时间跨度从2000年至2024年,覆盖了包括伊朗、塞浦路斯、格鲁吉亚在内的15个亚洲国家,是研究亚洲地区有偿护理工作就业状况的珍贵资料。数据集的核心指标为护理就业人数(单位:千人),按性别和公民身份进行细致分解,提供SEX_T(总计)、SEX_M(男性)、SEX_F(女性)三个分类维度。此外,数据集还包含观测状态、数据来源注释等辅助字段,帮助用户评估数据质量,并标注了如断点等潜在问题。
使用方法
用户可通过HuggingFace的datasets库便捷加载该数据集,使用load_dataset函数即可将数据读取为Pandas DataFrame格式,进而进行各类分析。例如,可通过筛选ref_area字段锁定特定国家的时间序列数据,或使用pivot_table函数将数据集重塑为国家×年份的矩阵形式,便于进行跨国家比较。数据集还支持按具体指标进行筛选和排序,适用于时间序列预测、分类或回归等机器学习任务。使用时需遵循CC-BY-4.0许可协议,并正确引用ILO及Electric Sheep Asia团队。
背景与挑战
背景概述
该数据集由国际劳工组织(ILO)于2024年创建,经Electric Sheep Asia重新打包发布,聚焦亚洲15个国家2000至2024年间有偿护理工作的就业情况,包含647条观测记录。其核心研究问题在于揭示性别与公民身份对护理行业从业规模的影响,弥补了亚洲区域在正式护理劳动力统计方面的数据空白。作为ILOSTAT数据库的子集,该数据集依托国际劳工统计大会定义的标准,整合了各国劳动力调查、人口普查等来源的微观数据,为分析亚洲护理经济、评估可持续发展目标中体面劳动指标的进展提供了关键支撑。
当前挑战
该数据集面临的挑战首先体现在领域问题的复杂性上:护理工作常被低估或与家庭无偿劳动混淆,基于性别的职业隔离和移民护理工的身份界定使得精准统计异常困难,现有分类体系难以完全捕捉非正规护理就业的全貌。在构建过程中,挑战则来自多源异构数据的整合——各国调查方法、时序断裂(如代码变更导致的序列中断)以及部分国家观测值稀疏(例如印度尼西亚和伊拉克仅各有6条记录)均可能影响时间序列分析的稳健性,而源数据中标注的‘最佳来源’选择机制也要求研究者对缺失值和异常标志保持警惕。
常用场景
经典使用场景
该数据集收录了来自国际劳工组织ILOSTAT数据库的647条观测数据,覆盖亚洲15个国家在2000至2024年间关于有偿照护工作者雇佣状况的性别与国籍细分信息。研究者可借此构建面板数据模型,分析亚洲地区照护经济中劳动力市场的时空演变轨迹,例如通过时间序列分析揭示不同国家照护行业雇佣规模的长期趋势,或利用固定效应模型探讨性别与国籍维度下雇佣差异的驱动因素。
实际应用
在实际应用中,该数据集可为国际发展机构与政策制定者提供证据支持。例如,通过追踪女性照护工作者的雇佣占比变化,监测可持续发展目标中体面工作与经济增长指标(SDG 8)的达成进展;或结合公民身份维度,评估移民劳工政策对劳动力市场融合的效果。跨国企业亦可利用其区域雇佣分布数据,优化照护服务供应链的人力资源配置策略。
衍生相关工作
该数据集作为ILOSTAT体系在亚洲区域的精细化子集,衍生了一系列劳动经济学与计量经济学经典工作。例如,学者可基于其时间跨度和国家覆盖,复现或扩展关于照护工作性别隔离的跨国面板回归研究;或结合微观调查数据,采用双重差分法评估经济危机对照护行业雇佣规模的冲击。数据集中标注的数据来源与断点标识(如"Break in series")也催生了关于统计方法变异性对估计结果稳健性影响的方法论文献。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务