lang-uk/recruitment-dataset-job-descriptions-english
收藏资源简介:
Djinni招聘数据集(英文职位描述部分)包含150,000个职位描述和230,000份匿名候选人简历,这些数据发布于2020年至2023年间的Djinni IT职位平台。数据集包括英文和乌克兰文的样本。数据集包含与职位描述相关的各种属性,如职位名称、职位描述、公司名称、经验要求、关键词、英语水平、发布日期、职位描述语言和唯一标识符。
Djinni招聘数据集(英文职位描述部分)包含150,000个职位描述和230,000份匿名候选人简历,这些数据发布于2020年至2023年间的Djinni IT职位平台。数据集包括英文和乌克兰文的样本。数据集包含与职位描述相关的各种属性,如职位名称、职位描述、公司名称、经验要求、关键词、英语水平、发布日期、职位描述语言和唯一标识符。
Djinni Dataset (English Job Descriptions part)
概述
Djinni Recruitment Dataset(英语职位描述部分)包含150,000份职位描述和230,000份匿名候选人简历,这些数据发布于2020年至2023年期间在Djinni IT职位平台上。数据集包括英语和乌克兰语样本。
数据集包含与职位描述相关的各种属性,包括职位名称、职位描述、公司名称、经验要求、关键词、英语水平、发布日期、职位描述的语言和唯一标识符。
预期用途
Djinni数据集旨在支持多种应用:
-
推荐系统和语义搜索: 它作为增强职位推荐引擎和语义搜索功能的关键资源,使职位搜索过程更加直观和个性化。
-
大型语言模型(LLMs)的进步: 该数据集为英语和乌克兰语领域特定LLMs提供了宝贵的训练数据。它在提高模型理解和生成能力方面发挥着重要作用,特别是在专业招聘环境中。
-
AI辅助招聘中的公平性: 通过作为AI公平性的基准,Djinni数据集有助于减轻AI辅助招聘过程中的偏见,促进更公平的招聘实践。
-
招聘自动化: 该数据集支持简历和职位描述自动化创建工具的开发,简化招聘流程。
-
市场分析: 它提供了对乌克兰科技行业动态的洞察,包括冲突的影响,有助于全面的市场分析。
-
趋势分析和主题发现: 该数据集支持科技行业内趋势分析和主题发现的建模和分类。
-
战略规划: 通过实现公司领域的自动识别,该数据集有助于战略市场规划。
加载数据集
python from datasets import load_dataset
data = load_dataset("lang-uk/recruitment-dataset-job-descriptions-english")[train]




