opensporks/resumes|简历分类数据集|职业分析数据集
收藏数据集概述
数据集描述
- 数据集名称: Resume Dataset
- 数据集摘要: 包含超过2400份简历,以字符串和PDF格式存储,用于将简历分类到预定义的标签中。
- 内容:
- 数据集包含的简历分为多个类别,如HR、Designer、Information-Technology等。
- 每份简历在CSV文件中对应一个ID,以及简历的文本(Resume_str)和HTML格式(Resume_html)。
- 简历的PDF文件存储在数据文件夹中,根据类别分组。
数据集结构
- 数据字段:
- ID: 唯一标识符和PDF文件名。
- Resume_str: 简历文本,字符串格式。
- Resume_html: 简历数据,HTML格式。
- Category: 简历申请的职位类别。
数据集创建
- 数据来源: 数据通过抓取www.livecareer.com网站上的个人简历示例获得。
- 数据抓取代码: 可在Github仓库resumeScraper找到。
许可证信息
- 许可证: cc0-1.0
数据集贡献者
- 数据集分享者: @snehaanbhawal

学生课堂行为数据集 (SCB-dataset3)
学生课堂行为数据集(SCB-dataset3)由成都东软学院创建,包含5686张图像和45578个标签,重点关注六种行为:举手、阅读、写作、使用手机、低头和趴桌。数据集覆盖从幼儿园到大学的不同场景,通过YOLOv5、YOLOv7和YOLOv8算法评估,平均精度达到80.3%。该数据集旨在为学生行为检测研究提供坚实基础,解决教育领域中学生行为数据集的缺乏问题。
arXiv 收录
38-Cloud
该数据集包含38幅Landsat 8场景图像及其手动提取的像素级云检测地面实况。数据集被分割成多个384*384的补丁,适合深度学习语义分割算法。训练集有8400个补丁,测试集有9201个补丁。每个补丁包含4个对应的谱通道:红色、绿色、蓝色和近红外。
github 收录
HUSTgearbox
This reposotory release a gearbox failure dataset, which can support intelliegnt fault diagnosis research
github 收录
HazyDet
HazyDet是由解放军工程大学等机构创建的一个大规模数据集,专门用于雾霾场景下的无人机视角物体检测。该数据集包含383,000个真实世界实例,收集自自然雾霾环境和正常场景中人工添加的雾霾效果,以模拟恶劣天气条件。数据集的创建过程结合了深度估计和大气散射模型,确保了数据的真实性和多样性。HazyDet主要应用于无人机在恶劣天气条件下的物体检测,旨在提高无人机在复杂环境中的感知能力。
arXiv 收录
MOOCs Dataset
该数据集包含了大规模开放在线课程(MOOCs)的相关数据,包括课程信息、用户行为、学习进度等。数据主要用于研究在线教育的行为模式和学习效果。
www.kaggle.com 收录